微信

Kimi K3刷屏72小时,美国或酝酿封堵

凤凰网科技07-21 20:01

  摘要:预测市场平台Polymarket近期发布的一条消息称,Anthropic的估值因中国Kimi K3模型的发布而受到冲击,其在年底前达到1.5万估值的概率从原先的78%大幅下降至67%。

  7月17日凌晨,月之暗面发布Kimi K3后的72小时内,推特(X)上的时间线当即被刷屏了。

  这当然不是中国AI的第一场逆袭胜利。2025年初,DeepSeek曾让硅谷重新审视中国的创新能力,并引起小范围恐慌,这后来被定义为DeepSeek时刻。

  自那时候,中国模型也多次发起冲锋,2026年初的GLM虽然在前端编程盲测中拿下过第二,但在长达一年半的时间里,海外没有等来一个真正意义上的反转时刻。

  直到这次K3出现,K3引发的讨论烈度,上了一个台阶——不只是惊叹,而是被当作生产力工具来实测、拆解、对比和质疑。

  硅谷的科技领袖们纷纷表态。云开发平台Vercel的CEO吉列尔莫·劳赫在X上发文称,K3标志着“开放模型首次在这一 综合 性网页工程基准测试中领先于所有闭源模型”。马斯克在Artificial Analysis的K3评测帖下留了一个词:“Impressive(令人印象深刻)”。然后很快,他就专门发帖宣战,称:“我们的 2 万亿模型,在各个方面都优于我们的 1.5万亿模型,将在下周完成初步训练。它有可能超越 Kimi,但速度和 Token 效率接近我们的 1.5 万亿(即 Grok 4.5)。

  特朗普政府科技顾问戴维·萨克斯在X上转发Arena榜单时写道,这是中国模型首次在前端编程中登顶,并警告说美国正在“自缚手脚”——限制数据中心、叠加州监管、推动联邦机构预审前沿模型,“这就是输掉AI竞赛的方式”。

  争议也随之而来。Redis作者antirez把K3放在开放权重模型快速进步的大背景里,同时强调需要长期真实结果才能判断其真实水平。有开发者提醒,K3的榜单成绩“过于突出”,仍需用更难污染的测试继续验证,尤其是在长上下文、多轮对话和复杂Agent循环中。

  但两派都承认一件事,K3让全球AI从业者不得不重新评估中国开源模型的位置。它已经从“便宜替代品”变成了一个需要认真对比的生产力工具。

  Axios在7月17日发表了一篇标题极具冲击力的文章——《中国刚刚抹去了美国在AI领域的领先地位》。并在稍后的一篇报道中称,美国方面感受到了Kimi对OpenAI和Anthropic主导地位的威胁,之前特朗普政府内部部分人士已试图对外国开源模型实施事实上的禁令。特别是Kimi的崛起,正在重新点燃这些努力。

  一个段子开始流传,海外网友调侃说“中国人造出了时间机器,蒸馏了美国未来发布的模型”,这既是对此前“中国模型靠蒸馏美国模型”论调的嘲讽,也折射出一种微妙的焦虑:当中国模型在前端代码榜上超越Fable 5时,旧有的解释框架完全失效了。

  一场“去杠杆”抛售,一次新辩论

  更有趣的是,K3引发的讨论很快超出了技术社区的范围,蔓延到了资本市场。

  K3发布后的第一个完整交易日, 纳斯达克 100指数期货一度跌近2%,费半一度跌约5.2%,较6月高点的回撤超过20%。抛售波及全球,日经225指数周五重挫逾4%,MSCI亚太指数单日跌幅创三周最大。

   摩根大通 全球市场情报主管Andrew Tyler在客户报告中直言,K3的发布“无疑雪上加霜”,“对‘DeepSeek 2.0’时刻的担忧令亚洲和美国科技股双双承压”。 高盛 合伙人Rich Privorotsky将此次下跌定性为“去杠杆事件”,并抛出了一个更值得深思的判断:“算力扩张时代”或已走到尽头。

  Privorotsky的核心论点是:一家无法匹配西方最大规模预训练算力的中国实验室,通过架构创新、合成数据、强化学习和后训练技术迅速缩小了与顶尖美国模型的差距。

  CNN和AP都把K3列为进一步动摇市场的因素之一。港股市场给出了相似的反应,7月17日,曾被看做是Anthropic的中国对标企业 智谱 直接大跌28.49%,MiniMax也跌了15.62%。一位行业人士对凤凰网科技表示,“市场永远只对最前沿的技术买单”。

  当然,这轮下跌并非由K3单独制造。油价因地缘冲突上升、Netflix等公司财报压低风险偏好、芯片股在K3发布前已连续回调——K3更像是给一场已经发生的抛售补上了一个新理由。

  但外界依旧联想到了DeepSeek R1引发震动时 英伟达 的大跌,因为背后的确涌现了新的问题。投资人突然需要重新回答,如果中国开放模型不仅便宜,而且开始在高端市场与美国闭源模型正面竞争,那么过去几年建立在巨额算力投入、能力领先和高毛利之上的AI估值,还能维持多久?

  或者说,接近万亿美元市值的Anthropic和9000亿美元的OpenAI,他们的价值到底稀缺在哪里?

  答案已经呼之欲出,预测市场平台Polymarket近期发布的一条消息称,Anthropic的估值因中国Kimi K3模型的发布而受到冲击,其在年底前达到1.5万估值的概率从原先的78%大幅下降至67%。

  当K3成为 新坐标

  回到更切实的技术能力上,K3到底在什么位置?

  先看几组硬指标。2.8万亿总参数,100万Token上下文窗口,原生多模态。在前端编程匿名对战竞技场,K3以1679分登顶,超过Claude Fable 5的1631分和GPT-5.6 Sol的1618分。上一代K2.6排在第18位,K3直接跃升了17个名次。7个前端细分领域中,K3在6个排名第一。

  在Artificial Analysis 的智能指数综合评测中,K3拿到57分,排名第三,仅次于Fable 5和GPT-5.6 Sol,与Claude Opus 4.8和GPT-5.5处于同一水平区间。在长程知识工作评估中,K3的Elo评分达到1547,同样仅次于Fable 5。在自动化SaaS工作流评估AutomationBench-AA中,K3以53%的得分位居第一。

  但局限也同样存在。月之暗面在官方公告中主动说明,K3的整体表现仍落后于Claude Fable 5和GPT-5.6 Sol,内部确切的知道,K3还不是最强模型。Artificial Analysis的评测也确认,K3的智能水平与Opus 4.8和GPT-5.5相当,但仍在Fable 5和GPT-5.6 Sol之后。

  定价上,K3的API输出价格为每百万Token 15美元,输入3美元,缓存命中输入仅0.30美元。这个定价与Anthropic Sonnet 5完全相同,是中国大模型第一次敢于直接对标美国模型的价目表,但更具性价比:“Opus性能,Sonnet价格”。

  如果把中国AI开源模型的全球冲击排个序,K3是第三次。第一次是DeepSeek,以低成本、高效率震动全球,证明中国模型能在有限算力下做出顶尖性能。第二次是Seedance,用大模型的方式做视频生成,大力出奇迹。第三次就是K3,2.8万亿参数、前端代码第一、7月27日开源完整权重,这是中国开源模型第一次同时在参数规模、前沿性能和全球开发者声量上冲击第一梯队。

  全球御三家的座次真要换了

  K3发布当天有一个细节也被提及:模型没有第一时间开放权重。官方口径是完整权重将于7月27日前发布。

  过去,是中国开发者担心海外模型停止服务。现在,是海外开发者担心中国模型不再开源。这种角色反转本身,就是产业格局变化的副产品。

  K3的开与不开,成为牵动全球格局的一道悬念。如果最终开源,K3将成为开放权重模型的绝对领先者,远超GLM-5.2(7530亿参数)和DeepSeek V4 Pro(1.6万亿参数)。

  另有市场消息称,Kimi可能进一步调整Coding套餐的权益结构。两种情绪指向同一个事实:K3的能力释放和潜在需求量,可能已经超出了原有产品体系的承载方式。

  回到“御三家能否重组”这个问题。从品牌溢价和消费级认知层面看,Anthropic、OpenAI和Google的头部位置短期内不会发生结构性变化。它们在用户习惯、开发者工具链和云服务捆绑上的积累,构成了比benchmark分数更深的壁垒。

  但在实际调用、工程性价比和开发者付费行为层面,情况正在起变化。OpenRouter平台上,来自Google、OpenAI和Anthropic模型的Token请求占比已从一年前的72%降至33%。中国模型全球周调用量达27.58万亿Token,是美国的四倍以上。

  一个真实的趋势是,美国在先进AI领域的绝对领先地位正在松动。

  2026年的大模型行业,“御三家”的定义权正在从品牌方转移到开发者手中。谁能在成本、效果和可用性之间找到最优解,谁就有资格重新划定这张权力版图。K3只是开了个头。接下来几周,随着完整权重释出、第三方评测大规模铺开和定价策略落地,这场重组的真实进度才会逐渐清晰。