DeepSeek V4震撼登场|性能媲美GPT,价格仅为其二十分之一
機械翻訳 / Machine-translated

機械翻訳 / Machine-translated
@aifriends
AI Friends(https://aifriends.jp)のクロスポスト公式アカウント。AIツールの紹介・使い方・できることを、中学生でもわかるやさしい日本語で届けます。
"中国AI再次改写了全球定价表"——2026年4月24日,DeepSeek(深度求索)正式发布了V4。
还记得一年前V3带来的震撼吗?这款来自中国的超低价AI,这次携1.6万亿参数、百万token上下文的怪兽级规格强势回归。
更值得关注的是,它完全不依赖美国英伟达,仅凭华为昇腾(Huawei Ascend)芯片即可运行,实现了自主化部署。
"比GPT-5.5 Pro便宜98%,性能却不相上下?这是真的吗?"针对这一疑问,本文将从最新基准测试、定价表到对日本市场的影响,用通俗易懂的语言为您一一解析。
首先用5分钟梳理发布内容。
DeepSeek于2026年4月24日通过官网和技术论文发布了下一代大规模模型"V4"的预览版。上一代V3震撼全球AI行业是在2025年1月,因此这次可谓"时隔恰好一年的新一代发布"。
"用烹饪来比喻,就像一位去年惊艳全球的年轻主厨,这次大方发布了续集菜单。"
除论文外,模型权重(预训练文件)也上传至HuggingFace,以"MIT许可证开放权重(可商用的公开AI)"的形式向所有人开放,任何人均可查阅其内部结构。
4月24日,CNBC、彭博、《财富》等主要财经媒体争相报道,成为席卷AI行业的重磅发布。
V4的特点在于同时提供两款面向不同用途的模型。
"V4-Pro"总参数达1.6万亿(1600B),每次推理激活490亿(49B)参数,属于超大型模型;"V4-Flash"总参数2840亿,激活130亿,属于轻量级模型。
"V4-Pro是法式全套大餐,V4-Flash是快捷美味的拉面"——两者定位各有侧重。
两款模型均采用MoE(Mixture of Experts,专家混合)设计,即只在需要时激活部分"大脑"的节能架构。"1.6万亿的庞大模型,实际运行时只启动490亿参数,因此电费和速度都保持在合理范围",这正是其核心优势。
文件大小方面,V4-Pro为865GB,V4-Flash为160GB,V4-Pro目前也被称为"全球最大的开放权重模型"。
V4-Pro与V4-Flash均支持最长100万token(中文约60~80万字)的上下文,输出也最高支持384K token,可一次性输出大型分析报告。
"相当于一口气读入300~400页A4文档,即两三本普通图书的内容并直接作答。"
会议纪要一年份、司法文件、数百页合同、企业内部Slack历史记录全文、完整源代码——以往需要分段输入的材料,现在可以直接整体投入。
百万token达到与GPT-5.5 Pro同级别的业界最高水准,在一次性输入海量资料进行摘要与提取的场景中,具有决定性优势。
不只看规格,用数据验证它是否真的足够智能。
在编程竞赛平台"Codeforces(代码力量)"的评级中,V4-Pro达到3206,GPT-5.4为3168,Gemini-3.1-Pro为3052。
"在汇聚全球顶尖程序员的道场中,中国新人超越了美国代表队"——这正是该分数所代表的含义。
LiveCodeBench(实际编程题目)中,V4-Pro得分93.5,Gemini为91.7,Claude为88.8。
SWE-Verified(实际软件修复任务)中,V4-Pro得分80.6,与Claude(80.8)不相上下。
"在编程领域,'中国产品略逊一筹'的固有认知已彻底瓦解",这一结论有充分依据。
在汇集奥林匹克数学难题的"IMOAnswerBench"中,V4-Pro得分89.8。对比Claude Opus 4.6的75.3、Gemini-3.1-Pro的81.0、GPT-5.4的91.4,V4-Pro"大幅超越Claude和Gemini,以微弱差距位居第二,仅次于GPT",表现出色。
"通俗来说,就是一个能稳定解出顶尖高考数学题的AI,而且价格极其低廉地出现了"——冲击力不言而喻。综合知识测试"MMLU-Pro"中,V4-Pro得分87.5,与GPT-5.4持平,略低于Gemini(91.0)和Claude(89.1),但实用智能层面的差距已经极为有限。
另一方面,衡量事实准确性的"SimpleQA-Verified"中,V4-Pro得分57.9%,Gemini为75.6%。
"在知识量层面,Gemini凭借Google海量搜索数据的支撑,具有明显优势。"
"超级优秀,但偶尔会自信满满地说错话"——这是目前V4的真实写照。对于医疗、法律、金融等需要严格事实核查的最终决策,与其他生成式AI一样,人工审核和外部搜索的配合必不可少。
"正因为便宜,才应该用节省下来的预算建立核查机制"——这才是务实的使用姿态。
V4真正的重磅炸弹不是规格,而是定价表。
V4-Pro的API定价为每百万token输入1.74美元(约12元人民币)、输出3.48美元(约25元人民币)。
对比GPT-5.5 Pro的输入30美元、输出180美元,"输出约便宜52倍,输入约便宜17倍"。
与Claude Opus 4.7相比,据称也约便宜20倍。
"用一杯星巴克拿铁的钱,就能支付原本一个月的AI使用费"——堪称破格。
"与高档牛肉品质相当的肉,在批发超市以5%的价格出售"——冲击力大抵如此。对开发者和企业而言,这一定价让此前因API费用高昂而不敢尝试的用途一下子变得触手可及。
轻量版V4-Flash定价为输入0.14美元(约1元人民币)、输出0.28美元(约2元人民币)。更有"缓存命中时输入低至0.028美元(约0.2元人民币)"的设计,"相同提示词重复使用时实际几乎免费"。
"企业内部聊天机器人、电商咨询自动回复、内部文档问答等大批量应用场景,都能以极具现实感的成本搭建起来。"
说"用自来水费驱动的AI"也毫不夸张。预计2025年API费用还属于高位的不少用途,借助V4-Flash将一举实现盈利。
根据DeepSeek官方论文,V4-Pro相比上一代V3.2,"每token计算量(FLOPs)降至27%,KV缓存使用量降至10%"。
"就像同样的学习量,用十分之一的笔记量搞定,计算量也只需四分之一的天才学生"——这种效率令人叹服。
在模型规模扩大的同时降低运营成本,这一看似矛盾的目标通过架构创新得以实现。
"便宜不是因为降价促销,而是因为运营成本本来就低"——这一点与2025年DeepSeek V3时代一样,持续引发业界关注。
V4的另一大冲击来自芯片层面。
V4采用仅凭"华为昇腾(Huawei Ascend)NPU"即可完成推理与训练的设计。华为本身也于4月24日宣布"最新昇腾AI计算集群支持DeepSeek V4运行",公开证明"无需英伟达H100或Blackwell,中国境内即可完整运行前沿级AI"。
"在美国出口管制的最先进GPU缺席的情况下,中国境内运行全球顶尖AI成为现实"——这一成就被视为中美科技竞争中划时代的节点。
多家英文媒体报道,中国主要科技巨头阿里巴巴、字节跳动、腾讯预见到V4发布,已大量采购华为芯片。
"中国正在将'摆脱对美国英伟达的依赖、构建自给自足AI经济圈'的意图以可见的方式加速落地。"
"从依赖进口粮食,转向全部自种的国产化转型"——这一比喻形象地描绘了这一趋势。美方媒体也有报道称"是否通过第三国走私Blackwell芯片用于训练"存疑,技术自立的真实性仍是持续争议的焦点。
DeepSeek与华为联合宣布,"V4在昇腾NPU与英伟达GPU上实现了同等性能"。
"'中国芯片落后好几代'的固有行业认知,首次遭到官方层面的正式反驳。"
"无名年轻投手在职业比赛中投出与大联盟先发投手相当球速"——冲击力如此之大。若这一主张能获第三方验证,将从根本上动摇美国AI芯片出口管制战略的实际效果,并在未来数年内对全球供应链与地缘政治产生深远影响。
V4胜过谁,又输给谁?下面来梳理一下。
GPT-5.5 Pro是OpenAI的最新旗舰,在知识量、对话质量、多模态能力上处于全球最高水准。V4-Pro的格局是:价格碾压(便宜98%)、编程胜出、数学基本持平、通用知识略逊。
"GPT是全能家教,V4是擅长专科的极低价补习班"——这样记忆比较清晰。内部开发和大量API调用选用V4,日常对话选用GPT——这种分工是现实可行的方案。每月为API支付数十万至数百万元的企业,引入V4的经济效益越大。
Claude Opus 4.7是Anthropic在编程和Agent(自主AI执行者)领域口碑极佳的最新模型。V4-Pro在Codeforces、LiveCodeBench上均领先,价格约为其二十分之一,冲击力巨大。
"单论写代码,V4明显更划算"——这一判断成立。另一方面,Claude在严格遵循长指令和伦理考量方面依然强势,在Agent用途上仍具优势。
"对失误零容忍的业务级Agent用Claude,大批量生成和原型验证用V4"——这种组合有望成为2026年下半年的主流。
Google Gemini 3.1 Pro在搜索联动和多模态方面表现压倒性,SimpleQA-Verified得分75.6%,远超V4-Pro的57.9%。
"作为实时掌握全球信息的行走百科全书,Gemini独树一帜。"代码生成与推理方面V4-Pro胜出,最新信息准确性方面Gemini占优,两者形成清晰的定位分工。
"需要获取最新资讯选Gemini,大量代码生成选V4,综合对话选GPT,业务Agent选Claude"——这四张牌的格局,有望成为2026年AI行业的标准配置。
V4将对日本产生怎样的影响?
对日本SaaS企业和企业内部AI应用部门而言,V4的价格颠覆将从根本上改变AI成本决策。
"每月100万日元的OpenAI费用,换成V4来承担,理论上可降至约5万日元"——这一计算完全成立。
"从高档租房搬到同一地段的公租房,房租降至二十分之一"——冲击力大抵如此。乐天、LINE雅虎、Mercari、Sansan、freee等深度推进AI应用的国内企业,有望在2026年下半年加速推进按用途分别选用模型的多模型战略。
GPT/Claude从首选方案,到成本优先时V4进入比较评估——这个时代已经到来。
另一方面,日本政府机关、金融、医疗等对机密性要求较高的行业,对直接使用中国产AI仍持谨慎态度。
"使用DeepSeek官方服务时,数据可能经由中国境内服务器,从个人信息保护角度看,不适合敏感用途"——这一看法较为普遍。但由于是开放权重(模型本身以MIT许可证公开),技术上可以在企业自有服务器或AWS、樱花云(さくらクラウド)上自行部署V4运行。
"设计图已公开,在自家工厂组装、挂自家车牌上路"——这一比喻形象说明了其用法。企业导入时,官方API与自有托管的选择将成为关键。
对个人开发者和自由职业者而言,V4-Flash是极具吸引力的"随意使用"型AI。
"每月5~10美元的预算,就能打造GitHub Copilot替代、翻译机器人、博客草稿、数据整理等日常工具的完整套件"——成本感极为亲民。V4的日语性能自V3时代以来持续改善,已接近ChatGPT水平。
"海外购物中,即便日元贬值也能买到国内没有的实用小工具"——大致是这种感觉。将V4融入副业、个体经营、博客运营、学习辅助等场景,每月工具费用只需数百元人民币的世界已成现实。
佐々木经营着一家有4名员工的服装电商公司。
"用GPT-4搭建了咨询机器人,但每月12万日元的费用太重,最终暂停了。"2026年5月,切换到V4-Flash后,同等质量的机器人每月约5000日元即可运行。
"感觉像是在Slack DM里多了一位全天候AI助理,24小时处理库存查询、退货政策、配送日程。"
"AI不该强行模仿大企业,而应该选择与自己体量匹配的价格方案"——他深有感触地说。
信息工程专业研究生二年级的中野,面临"修士论文截稿前必须读完200篇英文论文"的压力。他利用V4-Pro的百万token上下文,一次性投入10篇PDF论文→提取要点→自动生成对比表。
"与导师的讨论,从'一起读论文'变成了'基于AI摘要展开讨论'的会议形式"——他切实感受到了这种变化。每月API费用约800日元。
"硕士生能处理博士级别的文献量的时代","研究的起跑线本身就提高了"——他如此表达。
在某中核市DX推进科任职的稻葉,面临"通读过去20年所有修订条例,梳理矛盾之处"这一近乎不可能的任务。他在AWS上自行部署V4-Pro,将条例全文(约300万字)分批投入,提取矛盾候补及法规整合性问题。
"10名职员花半年才能完成的纸质条例集审查工作,2周就有了眉目"——成效显著。
不得直接使用中国产AI服务,但可在自有服务器上运行模型——这成为地方政府善用开放权重优势的典型案例。
A. DeepSeek官方网页聊天(chat.deepseek.com)在日常使用范围内可免费使用。通过API进行开发使用是收费的,但V4-Flash每百万token仅需0.14美元(约1元人民币),价格极为低廉。
"个人每月花一枚硬币(约几块钱)就能正经玩转"的价格水平。商业用途大批量处理时,V4-Pro的成本也通常不及其他平台的二十分之一。
A. 使用DeepSeek官方服务(网页版・API)时,数据有可能经由中国服务器。
"机密信息、个人信息不要输入官方服务"是基本原则。但由于V4以MIT许可证公开了模型权重,可以在AWS、Azure、樱花云(さくらクラウド)等平台自行部署,从而无需将数据发送至中国。
"买来发动机,装在自家车身上使用"——这种用法正是开放权重的最大优势。
A. 与V3时代相比,日语自然度大幅提升,日常对话、博客文章、商务邮件、简单代码注释等场景已基本无违和感。不过在敬语的细微表达以及法律、医疗等专业领域的日语固有表达上,仍略逊于GPT-5.5 Pro和Claude Opus 4.7。
"类似于外国留学生通过了日语检定一级的状态"——日常业务已完全胜任,面向最终读者的文章由日本人润色一遍更为稳妥。
A. "精度优先・复杂推理・长文理解=V4-Pro","大批量・高速・成本优先=V4-Flash"——这是基本原则。例如企业内部聊天机器人99%的问题用Flash即可胜任,只有复杂问题才升级至Pro,两级配置是现实可行的方案。
"平时开小型车通勤,出远门才租SUV"——这种思路很贴切。多数企业导入案例中,Flash占90%、Pro占10%的比例能有效优化运营成本。
A. 主要有三种选择:"①使用DeepSeek官方API"、"②经由OpenRouter等中转服务"、"③在AWS・Azure・樱花云等平台自有托管"。
①最简便且价格最低,但不适合高机密业务。
②成本略高,但可灵活切换多个模型。
③初期构建成本较高,但在信息安全与合规方面更有保障。
"相当于餐饮业的加盟连锁・代理商・直接从工厂进货三选一"——根据企业信息分类,逐步向③过渡的企业预计会越来越多。
这绝不是"中国便宜AI又来了"可以一笔带过的发布。
1.6万亿参数的超大型模型以GPT二十分之一的价格运行,编程测试超越美国顶尖水准,支持百万token长文本,还仅凭华为昇腾即可运行——这是价格×性能×地缘政治同步崩塌的结构性变革。
如果说2025年1月的DeepSeek V3留下了"低成本AI的冲击",那么2026年4月的V4则是"中国AI与前沿并驾齐驱,甚至开始撼动美国芯片霸权的历史时刻"。
对日本企业而言,这意味着"AI成本降至二十分之一的选择终于成为现实";对个人用户而言,这是"每月花几十元就能自如运用专业级AI的时代真正到来"的瞬间。
先用V4-Flash在一个项目上试试——仅凭这一步,半年后的开发速度就可能大为不同。这正是本次发布带来的深远意义。
本文为 AI Friends 的转载文章。