来源:互联网 更新时间:2026-07-29 16:22
半小时后,K3就拿到了4000多个点赞,直接冲上平台趋势榜第一。Hugging Face联合创始人兼CEO Clem Delangue说了句实话:“这是平台迄今增长最快的一次发布。”

美国公司也没闲着。Vercel创始人兼CEO Guillermo Rauch直接定性:K3是“目前全球最强的开放权重模型”。话音未落,Vercel已经通过美国本土推理服务商接入了K3。vLLM在权重公开当天就上线支持,Fireworks AI、Together AI、Modal、Baseten、DigitalOcean……一个接一个宣布上线。
就在K3开放权重前,OpenAI和Anthropic正在华盛顿那边强调中国开放模型的蒸馏和安全风险。黄仁勋公开唱反调,微软、Meta、英伟达等公司也联名反对过早限制开放权重模型。
过去三个月,中国开放模型已经连续落下三锤。
第一锤,DeepSeek-V4预览版。部分测试性能已经接近美国闭源旗舰,价格却低得不像话。第二锤,GLM-5.2:支持100万Token上下文,重点放在复杂、长时间运行的Agent任务上。第三锤,刚刚开放完整权重的Kimi K3:总参数达到2.8万亿,在多项独立评测中进入全球第一梯队,部分编程和长任务成绩甚至超过了Claude或GPT。
三锤分别打向美国闭源模型的价格、长任务能力和模型规模——这三个维度,曾经是闭源模型最引以为傲的护城河。
接下来,尚未发布的DeepSeek-V4正式版将是第四锤。它要挑战的,是美国闭源模型最后还占优势的地方。
7月27日,月之暗面开放了Kimi K3的完整模型权重。几乎同一时间,硅谷关于开放模型的争论也烧到了最旺。
据《纽约时报》和Axios的报道,OpenAI和Anthropic近期向美国政策制定者喊话,说中国AI公司可能通过大量调用美国模型、收集输出结果,蒸馏出成本更低的新模型。API还能限制账户和地区,模型权重一旦公开,开发者就能下载、修改、自行部署,再想收回就难了。美国闭源公司耗费巨资训练出的能力,可能迅速变成全球开发者都能使用的基础设施。
黄仁勋对此公开唱反调。7月22日,他告诉Axios,优秀的中国开放模型

7月24日,英伟达、微软、Meta等25家公司和机构首批签署《开放权重与美国AI领导力》,要求华盛顿避免过早限制开放模型。

OpenAI、Google和SpaceX最初没有出现在名单中,随后在周末陆续加入。
CEO Dario Amodei当天专门回应,称公司从未主张全面禁止开放权重模型。他承认普通开放模型具有公共价值,同时认为最强模型开放后很难保留安全护栏,因此仍支持打击工业级蒸馏、限制先进芯片流向中国,并要求所有强模型接受安全测试。

当然了,OpenAI的立场同样微妙:它支持美国发展开放模型,也继续向华盛顿示警中国公司可能存在的违规蒸馏问题。
英伟达随后又联合微软、IBM、Hugging Face、SpaceX AI等公司,成立了一个“开放安全AI联盟”。联盟公告提到,Hugging Face处理此前的Agent越界安全事件时,部分闭源工具因安全限制拒绝协助取证,团队最终在本地运行GLM-5.2,分析超过1.7万次操作并控制入侵。联盟由此提出,防守者也需要能够本地部署、修改和检查的强模型。
OpenAI和Anthropic依靠订阅和API出售模型能力,仅Claude Code今年2月的年化收入就已超过25亿美元。英伟达卖芯片,微软卖云服务,Meta需要扩大开发者生态,都希望市场上出现更多便宜、开放的模型。
今年1月,Kimi、Qwen和GLM三家在清华AGI-Next峰会上同台,“中国开源四杰”中,只有DeepSeek没有出现在会上。几家的判断很接近:单纯比拼聊天能力已经很难拉开差距,下一轮竞争要看谁能让Agent处理更长、更复杂的任务。
半年后,DeepSeek、GLM和Kimi连续更新,已经逼得硅谷公开站队。Kimi K3只是最新的火星,真正点燃争议的,是中国开放模型过去三个月落下的三锤。
2026年,中国开放模型已经连续追了三轮。每一轮,都冲着拆掉美国闭源模型的一项优势而去。
4月24日,DeepSeek发布V4预览版,并同步开放模型权重。V4-Pro共有1.6万亿参数,每次调用激活490亿参数,支持100万Token上下文。

在DeepSeek模型卡公布的自测中,V4-Pro在最高推理强度下的SWE-bench Verified得分达到80.6%,与Claude Opus 4.6的80.8%几乎相同。BrowseComp达到83.4%,接近Claude Opus 4.6的83.7%,也高于GPT-5.4的82.7%。
更狠的是价格。5月23日,DeepSeek宣布将原本限时提供的75%折扣变成长期价格,5月31日后继续执行。目前每百万Token非缓存输入、输出分别收费0.435美元和0.87美元。
6月16日,智谱发布GLM-5.2,同样支持100万Token上下文,并以MIT许可证开放权重。

它的重点已经从回答问题转向长时间干活——阅读大型代码库、反复调用工具,在数百轮操作中完成软件工程任务。
按照智谱汇总的各家最佳测试结果,GLM-5.2在Terminal-Bench 2.1中达到82.7%,略低于GPT-5.5的83.4%,高于Claude Opus 4.8的78.9%。
7月27日,月之暗面开放K3完整权重。按照月之暗面的说法,这是全球首个开放权重的3万亿参数级模型:总参数达到2.8万亿,每次激活1040亿参数,同时支持图像、视频和100万Token上下文。此前很难同时出现在开放模型上的参数规模、多模态和长任务能力,被K3放到了一起。
在月之暗面公布的测试中,K3在Terminal-Bench 2.1拿到88.3%,超过Claude Fable 5的88.0%,距离GPT-5.6 Sol的88.8%只差0.5个百分点。
在考验超长软件工程任务的SWE-Marathon中,K3得到42分,也高于GPT-5.6 Sol的39分和Claude Opus 4.8的40分。
但这些结果大多来自公司测试,部分比较还混用了不同的Agent工具和运行环境。它们尚未证明在真实项目和反复运行中,中国开放模型的整体稳定性已经赶上美国闭源旗舰。
这正是DeepSeek-V4正式版还要打穿的最后一道墙。
月之暗面在K3官方模型卡里给出了一个很诚实的答案。K3虽然在多项评测中达到顶级水平,整体使用体验与Claude Fable 5和GPT-5.6 Sol相比,仍有“明显差距”。
GLM-5.2也有类似的问题。它在Terminal-Bench 2.1中最高达到82.7%,已经接近美国顶级模型。换到专门考验超长软件工程任务的SWE-Marathon,智谱公布的测试中,GLM-5.2只有13分,Claude Opus 4.8达到26分。
企业选择模型时,需要把API费用和返工时间一起计算。
DeepSeek-V4-Pro每百万Token缓存未命中输入和输出分别收费0.435美元和0.87美元,Claude Opus 5则需要5美元和25美元,输出价格接近DeepSeek的29倍。
这项价格优势很大,但如果长任务做到最后失败,工程师还要重新检查、修改和运行,省下的调用费很快就会耗在返工上。
因此,V4正式版需要拿出的,除了更高的分数,还有反复运行仍然稳定的工具调用、长上下文和多轮修改能力。它要让开发者敢把大型代码库、复杂研究和长时间Agent任务交给开放模型。
截至目前,DeepSeek尚未公布V4正式版的发布时间和具体规格。在近期流传的与投资人的交流中,梁文锋有言,公司大概率仍会开放最强模型,商业化只追求“合理利润”。
如果这句话最终兑现,V4正式版还会继续采用DeepSeek最有杀伤力的组合:能力接近美国旗舰,价格低得多,同时开放权重。
三锤已经接连落下,它们不想等到V4正式版发布后再应对。因此,Kimi K3刚刚开源,两家公司便推动华盛顿调查模型蒸馏,并讨论制裁和使用限制。模型权重一旦被大量下载和部署,再出台限制,效果就会大打折扣。
现在比的是谁先到——DeepSeek-V4正式版,还是华盛顿的限制措施。
摩托车活塞环性能如何
ThinkBook系列最新价格全解析:2026年选购避坑与实时询价指南
GPT5.6惨遭切脑,Fable 5回归要变弱鸡版?
Ondo将于今日上线股票永续合约
电视剧《罗曼诺夫后裔》剧情介绍
暗黑4S14野蛮人终局BD攻略
区块链OTC交易所有哪几家比较正规?
什么是山寨币?山寨币指数如何查看?全球前10大山寨币盘点
Binance新增15种bStocks代币化证券为杠杆抵押资产
全球十大加密货币APP v3.11.5正版下载
GLM-4.5发布,全网最全测评和使用教程来了!
洛的网名三字男生霸气(精选100个)
本周比特币行情预判:BTC后市的三种推演与两强对决
剑侠世界3雪峰论剑怎么打-剑侠世界3雪峰论剑打法介绍
Meme币DOGS今晚上线!开局就解锁91%代币是否带来风险?
五千元以下的笔记本几乎消失!经销商:至少一年看不到涨价尽头
姓徐和李取网名男生霸气(精选100个)
25年来最惨单月 微软市值本月重挫近4万亿:押注AI也没赢麻
超长高标准质保+总部直保售后体系:小牛真实售后体验大起底
比特币守住关键支撑,HYPE市值升至第九并反超DOGE
手机号码测吉凶
本站所有软件,都由网友上传,如有侵犯你的版权,请发邮件haolingcc@hotmail.com 联系删除。 版权所有 Copyright@2012-2013 haoling.cc