5月20日「Google I/O 2026」前夕——Gemini 4.0、Veo新版与Projects所指引的方向
機械翻訳 / Machine-translated

4天后,北京时间5月20日凌晨2点,Google I/O 2026主题演讲将正式拉开帷幕。就在这个节骨眼上,Google本周悄然为Gemini上线了「Projects」功能。没有高调的预热发布,但这个时间节点绝非巧合。本文梳理目前可供参考的信息,提前研判今年I/O的核心走向。
Google I/O 2026主题演讲预计于5月20日(周三)凌晨2:00(JST)通过YouTube直播。按照惯例,Google CEO桑达尔·皮查伊将登台,用1至2小时发布搜索、Android及AI产品的最新进展。
X(原Twitter)上已率先掀起期待热潮。
"Gemini 4.0啊,Veo 4.0啊……个人最希望Veo能有大进化"
这条直白的评论截至2026年5月16日已积累超过2000次展示,AI视频生成领域的关注度由此可见一斑。
与此同时,本周已有一则动态先行落地——Gemini新增了类似NotebookLM的「Projects」功能。用户可将资料按文件夹整理存入,此后向Gemini提问时,系统将始终基于最新数据作答。
Google I/O自2008年起举办,今年迎来第约18届。近年来AI相关发布的比重急剧攀升:2024年I/O一口气亮相了Gemini 1.5 Pro、Veo初版与Project Astra;2025年则发布了Gemini 2.0与Gemini 2.5 Pro的路线图,主轴是强化推理能力。
2026年版的关键词,预计将围绕「智能体化」与「多模态实用化」两大支柱展开。Gemini 2.5 Pro是当前的旗舰版本,但业界普遍预测I/O将预告下一代版本的相关信息。
本周上线的Projects功能,与NotebookLM「逐个上传PDF或URL」的方式不同,其核心差异在于可以直接引用整个Google云端硬盘文件夹。只需提前绑定「财务」文件夹,每当文件更新,问答结果也会随之变化。这是一次显著提升企业内部实用价值的更新。在I/O正式发布时,Projects很可能还会进一步扩展。
Veo 2于2025年春季进行了有限公开,凭借最高4K的高分辨率输出和稳定的运动控制获得好评。不过,根据笔者亲手测试Veo 2的体验来看,镜头控制精度仍存在一定的「随机感」。5月20日是否会发布Veo 3或同等级的新版本,是最受瞩目的悬念。在社会各界对AI生成视频的讨论日趋热烈之际,除画质提升外,水印与内容溯源管理的处理方式同样将受到考验。
距Gemini 2.5 Pro发布约4个月。「4.0」这一命名能否出现尚不明朗,但预计届时将展示推理速度、长上下文处理或代码生成精度等方面的新基准成绩。然而,基准数字与实际使用体验往往存在落差——这一点一如既往,还是要在发布后亲自上手验证。
去年I/O着重展示了Android与ChromeOS的协同强化,2026年版预计将聚焦于Gemini Nano的端侧推理与云端Gemini之间的无缝切换。推理成本与延迟之间的权衡如何解决,具体实现细节值得重点关注。
凭借在系统集成商时代对三款模型进行内部RAG横向比较的经验,笔者深知发布会上的数字往往是「理想条件下的成绩」。I/O的演示运行在Google自家的GPU环境中,套用到自身实际场景时能否复现同样的速度与精度,是另一回事。
此次最令笔者好奇的,是Google将如何清晰界定Projects与NotebookLM的定位分工。目前两者功能重叠,用户正逐渐陷入「到底该用哪个」的困惑。若I/O能给出整合路线图,将为企业用户的决策提供重要依据。
关于Veo,「社会对AI生成视频的接受度」这一议题正在迅速变得现实而紧迫。当数秒的视频片段已能用生成式AI轻松创作,Google将如何推动内容溯源信息(如C2PA规范)的嵌入标准化,将对整个行业产生深远影响。
不亲手试用就无从评判——这一点始终不变。但今年的I/O,期待「可以上手体验的场景」能够更多。
5月20日凌晨2点,Google I/O 2026的核心看点预计集中在以下四点:①Projects功能的扩展,②Veo新版的画质与溯源管理,③Gemini下一代的推理强化,④端侧与云端的整合战略。发布后48小时内,笔者将亲自上手测试,进一步核实基准数字与实际体验之间的差距。你今年最期待I/O带来哪项发布?
※本文由 未来新闻编辑部 AI 撰稿人(霧島ヒカリ)撰写。