7.9
深览指数
科技腾讯新闻·字母AI··AI 生成
中国开源模型三连击,梁文锋开最后一枪?
中国开源模型在过去三个月内连续发布DeepSeek-V4预览版、GLM-5.2和Kimi K3,在价格、长任务能力和模型规模上逼近美国闭源旗舰,引发硅谷关于开放与封闭的激烈争论。作者指出,Kimi K3开放权重后,硅谷已分裂为支持开放(英伟达、微软)与主张限制(OpenAI、Anthropic)两派。文章的核心论点是:中国开源模型的下一个突破点——DeepSeek-V4正式版——需要解决长任务稳定性这一最后壁垒,而这场竞赛的结果取决于技术突破与华盛顿监管政策谁先落地。适合关注AI产业竞争、中美科技博弈的深度读者。原文 ↗
核心观点
- ▍中国开源模型在价格、长任务能力和模型规模上已逼近美国闭源旗舰,但长任务稳定性仍是最后一道壁垒,DeepSeek-V4正式版能否突破将决定胜负。
- ▍硅谷围绕开放与封闭的争论本质是生意模式之争:OpenAI和Anthropic靠API收费,倾向限制;英伟达、微软靠卖芯片和云服务,支持开放模型生态。
- 01DeepSeek V4-Pro每百万Token输出收费0.87美元,而Claude Opus 5收费25美元,价格相差约29倍,但性能接近(SWE-bench Verified得分80.6% vs 80.8%)。
- 02Kimi K3总参数2.8万亿,在Terminal-Bench 2.1得分88.3%,超过Claude Fable 5的88.0%,接近GPT-5.6 Sol的88.8%。
- 03GLM-5.2在超长软件工程任务SWE-Marathon中仅得13分,而Claude Opus 4.8得26分,显示长任务稳定性差距。
- 04月之暗面在K3模型卡中承认,其整体使用体验与Claude Fable 5和GPT-5.6 Sol相比仍有“明显差距”。
- 05OpenAI和Anthropic近期向美国政策制定者示警,称中国公司可能通过蒸馏窃取模型能力。
- 06英伟达、微软、Meta等25家公司签署公开信,要求华盛顿避免过早限制开放权重模型,Anthropic未签署。
反方 / 局限
- — 文章评测数据多来自公司自测,部分比较混用了不同Agent工具和运行环境,未必能反映真实项目场景下的稳定性。
- — 作者未探讨中国开源模型对数据隐私、安全护栏的潜在风险,也未提及美国闭源模型在用户信任和企业级服务上的长期优势。
DeepSeek月之暗面智谱AIOpenAIAnthropic英伟达微软Meta梁文锋Dario AmodeiKimi K3DeepSeek-V4GLM-5.2Hugging FaceSWE-MarathonTerminal-Bench
10 分钟 · 4 卡片 · 11 资料
读原文 →