中国AI"Qwen3.8-Max"超越GPT-5.6,下周开源
機械翻訳 / Machine-translated

機械翻訳 / Machine-translated
@aifriends
AI Friends(https://aifriends.jp)のクロスポスト公式アカウント。AIツールの紹介・使い方・できることを、中学生でもわかるやさしい日本語で届けます。
本文要点
中国阿里云于2026年8月3日发布了最新AI模型"Qwen3.8-Max"。
该模型拥有2.4万亿参数的庞大规模,但实际运行时仅使用95亿参数,具备高效的设计特点。
在部分基准测试中,该模型已超越Claude Fable 5和GPT-5.6 Sol等前沿模型,并预计于下周内开源发布。
在衡量编程能力的"Terminal Bench 2.1"测试中,Qwen3.8-Max超越了Claude Fable 5;在"SWE-bench Pro"测试中,超越了GPT-5.6 Sol。
在衡量论文理解能力的"PaperBench"测试中,该模型取得93.0的成绩,超越GPT-5.6 Sol(90.5)和Fable 5(88.8)。
Qwen3.8-Max采用了"MoE(混合专家)"架构。
打个比方,就像有一支由2.4万亿名专家组成的团队,当问题来临时,只有所需的95亿名专家出来作答。
这一机制大幅降低了计算成本和响应时间,实现了每百万输入token仅需2美元、输出6美元的低价格。
DeepSeek的V4系列和Mistral的Mixtral也采用了这一架构,是中国AI阵营在成本竞争中占据优势的重要技术。
Alibaba宣布,将于下周内在Hugging Face和ModelScope上公开Qwen3.8-Max的模型权重。
一旦开源,全球开发者便可将其部署到自己的服务器上免费使用。
已迁移至Qwen 3.7 Max的开发者反映,"API成本降低了87%"。
截至2026年7月,在热门AI使用服务OpenRouter的月度榜单中,前10大端点中约82%由中国系模型占据。
主要参与者如下:
这些模型在性能上逐渐追赶西方顶尖模型,同时在价格上具有压倒性优势,形成双重竞争力。
Qwen3.8-Max的开源对日本企业而言既是机遇也是风险。
机遇在于:对于处理大量token的业务,如客服聊天机器人或内部文件摘要,可显著降低成本。
另一方面,在使用中国企业提供的AI模型时,需注意数据主权及跨境数据传输的相关法规。
在金融、医疗等高度保密的行业,必须慎重考量数据存储位置和访问权限。
本文转载自 AI Friends。