DeepSeek成为6月30日AI排名领先者的市场隐含概率仅为1%,24小时交易量为$95,流动性超$11K。通过Polymarket Trade在Polymarket上实时交易。
该市场已归档。下方保留历史内容。
DeepSeek是一家位于北京的AI研究公司,与OpenAI(GPT系列)、Google(Gemini)、Anthropic(Claude)和Meta(Llama)竞争顶级语言模型性能排名。该市场将于2026年6月30日根据主要基准的共识排名进行裁定:MMLU通识知识评分、HumanEval编程评估和LMSys偏好投票。这种可裁定性源于这些排行榜的公开、持续的性质——DeepSeek在6月30日之前的任何发布都会立即被测试并排名。1%的市场隐含概率反映了交易者的信念,即DeepSeek在这一个月的时间窗口内无法取代既有的领先者。DeepSeek已发布DeepSeek-67B等开源模型,吸引了开发者的兴趣,但独立基准测试显示,与拥有巨大计算预算的闭源现有产品相比,结果参差不齐。轻度的交易量(日均$95)表明对结果的分歧最少;大多数交易者可能认为在如此短的时间内,对于中国竞争者来说,顶级模型地位几乎是不可能实现的。从历史上看,模型领导力表现出显著的稳定性,转变通常由现有产品发布新版本而非外部挑战者突破所驱动。
DeepSeek是一家位于北京的AI研究公司,由量化交易公司High-Flyer的工程师创办。自2024-2025年首次亮相以来,DeepSeek已发布包括DeepSeek-67B和DeepSeek-Coder在内的开源模型,通过低推理成本和合理的基准性能吸引了开发者的兴趣。该公司团队在优化和效率领域拥有专业知识,这些领域是中国AI实验室展现竞争力的地方。然而,到2026年6月30日哪个模型持有"顶级"地位这个问题,关键取决于排名的衡量方式。标准基准——MMLU(通识知识)、HumanEval(编程)以及来自Hugging Face和LMSys等网站的基于偏好的排名——主导了行业讨论。截至2026年6月,OpenAI(GPT-4 Turbo / GPT-5预期)、Google(Gemini Ultra)和Anthropic(Claude 3)仍然牢固占据大多数排行榜的顶端。 推向YES的因素(朝向DeepSeek领导地位):DeepSeek在6月初至中旬发布具有优越MMLU或编程评分的主要模型,在理论上可能改变排名。由于社区快速微调,开源模型有时在特定基准上的表现优于闭源同行。如果DeepSeek在缩放效率方面取得突破——以竞争对手10%的计算成本训练顶级模型——市场可能会重新定义"顶级"以奖励效率指标。来自独立评估者的有利基准结果可能会压倒怀疑者。 推向NO的因素(远离DeepSeek):现有领导者控制着庞大的计算基础设施、专有数据集和多年的优化。GPT-5(如果在6月30日之前发布)将是OpenAI维持主导地位的主要举措。基准评估是众所周知的;DeepSeek的发布可能会面临对可重复性和可转移性的更高怀疑。围绕中国科技的地缘政治紧张局势可能会抑制市场认可,即使技术声称是有效的。模型领导地位的历史记录显示稳定性:变化很少发生,通常来自现有产品,而非外部产品。历史先例:当GPT-4在2023年3月发布时,尽管Anthropic和Google发布了竞争性模型,OpenAI仍保持了一年多的顶级排名。市场心理倾向于已知的数量。 1%的市场隐含概率反映了交易者的极端信念,即DeepSeek无法在这个时间框架内达到顶级地位。这种深度折扣通常不仅表示对基础率的怀疑(外部挑战者很少获胜),也表示对现有领导者持有的结构性优势的认识:品牌价值、机构信任和基准熟悉度。轻度的交易量(日均$95)表明这个结果没有受到主动争议;大多数交易者可能认为它已确定。截至6月30日的裁定意味着市场只有几周的时间来观察DeepSeek是否有任何意外公告改变对话。
如果DeepSeek被确认为2026年6月30日基于共识基准的最高性能AI模型,则市场裁定为是。如果OpenAI、Google、Anthropic或其他现有产品保持顶级地位,则裁定为否。
预测市场将交易者的预期聚合为实时概率估计。在 Polymarket Trade 上,每个市场问题根据特定事件结果裁定为 YES 或 NO;交易者购买他们认为会以正面结果裁定的一方的份额。价格范围从 0¢(确定 NO)到 100¢(确定 YES),自然反映人群隐含的 YES 概率。本页面为来自搜索引擎的读者总结市场状态;如需实时交易(下单、查看订单簿深度、执行交易),请打开上方链接的完整交互页面。