xAI「Grok 4」正式发布——X整合实时推理,信息战略的前提发生转变
機械翻訳 / Machine-translated
xAI于日本时间2026年8月15日凌晨2时正式发布「Grok 4」。该模型结合X(原Twitter)实时数据整合与强化推理引擎,在复合任务基准测试「HALO-2026」中取得78.3分——xAI声称首次超越GPT-5(75.1分)与Claude Opus 4.6(76.8分)。这一时间节点被视为竞争轴线从「文本生成能力」明确转向「实时信息处理」的重要转折点。
根据xAI官方博客(blog.x.ai),Grok 4的主要规格如下:
「Grok 4的实时搜索,在其他模型对昨天发生的新闻返回『没有相关信息』的场景下,依然能给出附有准确来源的回答。作为信息收集工具,其差异化优势已十分鲜明。」(X平台媒体研究员,匿名)
Elon Musk在发布公告的同时于X上发帖称:「Grok 4是首个真正具备实时世界知识的AGI前阶段模型。」但「AGI前阶段」的技术定义尚未公开,仍需独立验证。
Grok 3自2026年1月发布以来,在X数据利用的速度与精度上一直存在不足。在媒体与调查领域专项基准MARS中,曾落后于Perplexity Sonar Pro,企业用户也持续反映「未能充分发挥X的实时性优势」。
Grok 4采用了名为「X Neural Bridge」的架构,将X的基础设施与AI流水线直接连接。X上的帖子、图片、视频几乎以实时方式完成嵌入,并针对用户提问以附带来源的形式返回「何时、何人、如何表述」——整套机制经历了全面革新。
xAI于2026年4月宣布确保了超过10万块NVIDIA H200集群,本次推理能力的强化据认与该算力扩充直接相关。
GPT-5和Gemini 2.5 Ultra同样具备外部搜索功能,但Grok 4的本质差异在于拥有访问X特有的互动速度与网络传播数据的权限。在新闻速报、股票情绪分析、危机监测等「当下这一刻」决定判断的业务场景中,其他厂商若要缩小这一差距,将不可避免地需要签订新的数据协议。
官方文档确认,Deep Think模式会将用户输入在xAI服务器上保留最长72小时。从GDPR及修订版《个人信息保护法》的角度来看,金融、医疗领域的企业可能面临使用限制。xAI已宣布将于2026年第四季度提供本地部署版「Grok 4 Enterprise」,但详细规格目前尚未公开。
Grok 4从发布当天起即可通过API使用,基于Grok 3的应用据称仅需修改端点版本号即可完成迁移。但需注意,Deep Think模式的异步处理必须支持Webhook,仅使用同步API的实现方案将无法使用该功能。
xAI公布,日语推理精度评分相比上一代提升约22%。该模型同时支持日语新闻的实时获取,预计将加速在国内媒体、公关及竞品信息监测领域的采用。
Grok 4之所以引人关注,在于它不仅仅是「模型性能的竞争」,更将「数据的结构性优势」引入了另一个维度的角力。GPT-5与Gemini 2.5以共同的互联网爬取为基础,而Grok 4则以X特有的实时数据流为核心。这是一种无法通过简单基准测试衡量的非对称竞争结构,对信息部门和研究部门而言,这或许是「重新审视工具栈」的契机。
定价层面同样出现了新动向。输入$1.5/M tokens与具备同等实时功能的Perplexity Sonar Pro(约$5.0/M tokens)相比,存在实质性的成本差距。我们预计,面向调查与新闻摘要的API用户将在未来30至60天内开始着手迁移决策。
另一方面,对单一平台的依赖同样构成风险。X的条款变更、访问限制或政治性决策,可能使Grok 4的核心功能在一夜之间发生本质改变——这一点应作为企业引入评估的必要风险项目加以重视。
Grok 4的发布,将AI竞争的轴线从「推理精度」扩展至「信息时效性与数据结构性优势」。真正的验证在于:超越基准测试名次,拥有实时数据访问权限的模型能否真正融入业务的信息循环——这一点将在未来90天内得到实证。或许,正是将「实时性」这一变量纳入你的信息收集工作流的时候了。
※本文由ミライ・ニュース编辑部AI撰稿人(AI新闻)撰写。