DeepSeek「R2」正式发布——推理成本削减90%,开源LLM竞争格局全面重塑
機械翻訳 / Machine-translated
DeepSeek于2026年8月9日22:00(UTC+8)正式发布推理专用模型「R2」。输入token单价为$0.014/M,与现行GPT-4o相比约便宜89%,同时官方宣称在主要基准测试中(AIME 2025:92.3%,SWE-bench Verified:61.8%)达到GPT-5水准。开放权重分发与商业授权解禁的组合,有望带来超越2025年1月R1发布时的结构性冲击。
模型权重与技术报告已在GitHub及DeepSeek官方网站同步公开。架构采用MoE(混合专家)设计,总参数量未披露,但官方说明活跃参数量相比R1减少约40%。
推理成本(通过API,以2026年8月9日为准):
基准测试速报(来源:DeepSeek官方报告):
「R2的SWE-bench 61.8%是内部测试值,官方排行榜尚未更新。不过本地跑下来明显比R1快,代码也更顺手。含成本在内,暂时想不到更好的选择。」
(X,工程师账号,2026-08-09)
自DeepSeek-R1于2025年1月发布以来的18个月间,整个LLM市场的推理成本急剧下滑。在OpenAI、Anthropic、Google相继下调API价格的背景下,DeepSeek持续推进「效率非对称战略」。R1在Hugging Face上线后3个月内下载量突破1800万,亚洲及欧洲中小企业的本地化部署案例也迅速增多。
许可证变更同样值得关注。R1在商业使用上存在部分限制,而R2采用「DeepSeek Model License 2.0」,原则上对月活跃用户不足1亿的商业用途免费开放。这一变更预计将进一步加速对国内SaaS厂商的渗透。
输入$0.014/M token意味着,处理相当于100万字的文档(约700K token)的成本不足$10。对于法务、会计、医疗等大量文档处理场景而言,月度成本估算将出现1到2个数量级的变化。
由于直接分发权重而非仅提供API,金融、医疗、政府机构等「无法将原始数据上传至云端」的行业可即日实现本地化运行。在数据主权顾虑根深蒂固的日本市场,预计其影响将比其他模型更早、更广泛地显现。
AIME 2025的92.3%较R1提升12个百分点,已进入目前顶尖模型的同等水准圈。正在考虑将其集成到编程智能体或数理分析工具中的开发者,将需要立即重新评估成本预算。
R2来自中国企业、以开放权重形式发布的事实没有改变。仍有欧美企业将安全审查与合规应对成本视为引入R2的障碍。日本企业正面临「成本削减 vs 治理风险」的权衡,需要各组织自行作出判断。
R1发布时,竞争对手在两周内相继调整了定价。此次预计同样会在72小时内出现某种形式的应对举措。
R2所提出的问题,并非「性能竞争已经结束、转向成本竞争」这样简单的论断。当前的状况是性能与成本同时在移动。无论在哪个维度都难以形成差异化的API提供商,预计将在2026年底前逐步失去市场地位。
在日本市场中,受影响最大的群体预计是面向企业的SaaS开发者。如果能以$0.014/M输入的成本在本地以GPT-4o水准的精度运行,那些「因成本过高而放弃集成AI」的产品,其盈亏平衡线将发生根本性转变。考虑到开发者对R1的响应速度,R2的评估周期预计将在未来1至2周内集中展开。
另一方面,数据治理与出口管制的视角不容忽视。需要将与法务、信息安全部门的协调成本纳入ROI计算,「先试用再说」的方式在某些场景下将行不通。
未来48至72小时内需关注的两个重点——竞争对手API的调价时机,以及R2正式进入SWE-bench官方排行榜。若后者得到确认,编程智能体市场的采用讨论将迅速进入快车道。
DeepSeek R2几乎消解了AI模型选型中「性能还是成本」的二元对立。精度90%+、推理成本降低89%的组合,有望成为加速企业AI导入决策的催化剂。你的组织中那个「因成本过高而无法引入AI」的前提,或许已到了从今天起重新审视的时刻。
※本文由 未来新闻编辑部 AI 写作助手(AI新闻)撰写。