Gemini震撼业界|AI研究员93%×20分钟完成160次搜索
機械翻訳 / Machine-translated

機械翻訳 / Machine-translated
@aifriends
AI Friends(https://aifriends.jp)のクロスポスト公式アカウント。AIツールの紹介・使い方・できることを、中学生でもわかるやさしい日本語で届けます。
『把调研任务交给AI,睡一觉醒来,它已经查阅了160个网站并生成了报告』——这个未来,终于真的到来了。
2026年4月21日,谷歌正式发布搭载Gemini 3.1 Pro的自主AI研究智能体『Deep Research』与『Deep Research Max』。
『有什么不同?』『到底有多厉害?』『我们的工作将如何改变?』——本文将用通俗易懂的语言,为你一一解答。
谷歌本次发布的是自主型AI研究智能体的全新系列。
"Deep Research:优先速度与成本的标准版,最适合实时交互场景"。
"Deep Research Max:耗时深度调研的终极版,夜间批量处理,早上即可收到报告"。
『就像便利店饭团(Deep Research)与高级料亭怀石料理(Max),各有用武之地』的差异。
"两者均搭载Gemini 3.1 Pro最新大脑,单任务最多可自主执行160次网页搜索"。
"调研结果自动生成图表与信息图,以HTML或Nano Banana图像形式可视化呈现"。
"附带引用来源的完整报告,20分钟内送达"是其核心卖点。
"单任务可参考100余个来源,横跨网络公开信息、用户自有文件及MCP连接数据进行全面检索"。
"内部评估已确认,相比2025年12月的旧版本,新版本胜率大幅领先"。
谷歌公布的基准数据正在震撼整个业界。
"DeepSearchQA(复杂检索任务问答):93.3%(上代66.1%,大幅跃升+27.2分)"。
"BrowseComp(浏览器调研能力):85.9(较Gemini 3 Pro提升+25分以上)"。
"Humanity's Last Exam(人类终极考试:超难题测试):54.6%(较上次46.4%提升+8.2分)"。
"GPQA Diamond(研究生水平理科题目):94.3%"。
『就像一个考试总是70分的学生,突然开始连续考出93分——这种飞跃令人震惊』。
"尤其是DeepSearchQA的93.3%,已接近人类专业分析师的精准度"。
"OpenAI的Deep Research在上一代指标中约为60%台,Anthropic Claude估计在80%左右,谷歌目前领先一个身位"。
"不过所有数据均基于谷歌内部测试,第三方评估有待后续验证"。
"即便如此,这仍是AI真正踏入『深度智识领域』的历史性数字,业界人士纷纷表示『距离AGI又近了一步』"。
目前以付费公开预览版形式提供。
"开发者可通过Gemini API立即使用,免费额度已于2026年4月1日起取消"。
"约10行Python代码即可调用,Interactions API也支持异步处理"。
"费用按官方按量计费,以输出token与搜索接地费用计算"。
『像在便利店(Gemini API)买AI助手,需要时随时调用使用』一样方便。
"正式部署至Google Cloud预计需数月,企业级客户目前需排队等候"。
"面向普通用户的Gemini App已搭载部分Deep Research功能,可通过Google AI Pro(月费约30元人民币)使用"。
"但Deep Research Max的完整功能仅限通过API使用,需要一定开发能力"。
"目前处于公开预览阶段,需注意谷歌可能在正式运营前发出规格变更通知"。
"未来还计划将其整合至Google Workspace(Gmail・Docs・Sheets),商业用途将进一步扩大"。
Gemini 3.1 Pro是谷歌最新的旗舰语言模型。
"是2025年12月发布的Gemini 3 Pro的继承者,仅历经4个月便完成大幅更新"。
"BrowseComp得分:60.x → 85.9(+25分以上),堪称『从普通水平跃升至世界顶尖水平』的飞跃"。
"专为长时间调研任务(long-horizon research workflows)优化,最长可持续自主推理2小时"。
『就像班级第20名的学生,半年后在全国模拟考中拿下第一——这种进化速度令人震惊』。
"同步强化的功能还包括:多模态理解(可一次性读取PDF・CSV・图像・音频・视频)"。
"原生工具调用能力(自主选择并调用外部工具)也大幅提升"。
"知识截止日期更新至2026年初,所持信息比ChatGPT和Claude更新鲜"。
"与竞争对手GPT-5.5(OpenAI)・Claude Opus 4.7(Anthropic)相比,在搜索与推理的综合能力上略胜一筹"。
"这是谷歌押注公司命运的模型,将搜索引擎与AI融合的独特路线终于结出硕果"。
本次最重大的创新是『支持MCP(Model Context Protocol)』。
"MCP是:AI与外部数据源及工具安全连接的行业标准协议"。
"由Anthropic于2024年提出,仅用1年便跃升为行业标准的『AI通用语言』"。
"Deep Research支持MCP后,可自由连接内部系统、专业数据库与定制工具"。
"具体示例:FactSet(金融数据巨头)・S&P Global(评级机构)・PitchBook(投资信息)的MCP服务器已先行支持"。
『以前AI只能在『店外』活动,现在连家里冰箱里有什么都能看清楚了』的重大变化。
"借助此功能,企业无需训练专属数据,即可在实时参考自有数据的同时完成调研"。
"数据泄露风险也大幅降低,机密信息由MCP服务器端管理,更加安全"。
"开发者可自定义MCP工具,打造专属AI研究员"。
"2026年下半年,Salesforce・SAP・Oracle・Workday等主流SaaS预计将陆续宣布支持MCP,商业应用范围将大幅扩展"。
另一大优势是『多模态研究接地』。
"用户上传PDF・CSV・图像・音频・视频后,AI将以全部资料为依据进行参考调研"。
"例如:将会议录音+历史幻灯片PDF+行业报告一次性上传→只需说『分析这家公司的战略』"。
"报告中会附带引用来源,明确注明『您提供资料的第3页』『会议录音第25分钟处』等出处"。
『就像把文件交给新员工说「以此为依据调查一下」,3天后收到一份详细注明了查阅资料哪一页哪一处的报告』一般精准。
"原生图表与信息图生成已作为标配功能,将复杂数据转化为一目了然的可视化内容"。
"同时支持HTML与Nano Banana图像,可直接嵌入报告"。
"还搭载研究计划预确认功能,AI在调研前会询问『计划按照这样的步骤进行,可以吗?』"。
"用户可修正调研方向,有效减少无效工作量"。
Deep Research(标准版)的特点是『快速易用』。
"响应时间:约5〜10分钟,最适合注重即时性的交互场景"。
"单任务执行30〜80次网页搜索,调研深度充分适用"。
"API费用:约为Max的1/2〜1/3,面向注重性价比的用户"。
"输出质量:高质量,但彻底程度略低于Max"。
『就像便利店的现磨咖啡,日常工作中品质与价格恰到好处』的定位。
"典型用法:会议前3分钟备战、邮件回复前的事实核查、博客文章调研"。
"Gemini Apps(Google AI Pro月费约相当于30元人民币)也已集成部分功能,普通用户可体验"。
"还计划与Slack・Microsoft Teams・Notion等整合,作为办公工具的一部分运行"。
"延迟(等待时间)低,专为用户边等边用的场景设计"。
"一天内多次调用也能控制费用,适合重度用户"。
Deep Research Max是『耗时深度调研』的终极模式。
"响应时间:15〜20分钟,最长可支持约1小时的长时间任务"。
"单任务最多执行160次网页搜索,横跨100余个来源"。
"延长测试时计算(extended test-time compute):AI使用更长的『思考时间』,反复执行搜索→推理→修正"。
"输出质量:媲美专业分析师,报告篇幅可达数千至数万字"。
『就像高级料亭的怀石套餐,耗时将最优食材以最精良的烹饪方式呈现』的极致追求。
"典型用法:投资决策的尽职调查、竞争对手分析、新药市场可行性评估、诉讼资料前期研究"。
"设计用途为异步批量处理,夜间运行,早上即可收到成品"。
"例如:金融机构分析师下班前指示『用Max分析这10家公司的财务状况』→次日清晨桌上已有完整报告"。
"API费用为标准版的3〜5倍,但与人类分析师一天的人力成本(数万元)相比,依然极为经济"。
"与其说是替代专家,不如说是将专家生产力提升10倍的增效器"。
选择标准简单明了:以『时间轴×重要程度』两个维度判断。
"①需要即时性+重要程度低〜中:Deep Research(标准版)即可"。
"②需要即时性+重要程度高:多次调用Deep Research进行比较"。
"③不需要即时性+重要程度高:Deep Research Max最为适合"。
"④不需要即时性+重要程度中:结合两者的混合策略"。
『就像点外卖时根据「马上要吃」还是「招待客人」来选店一样,判断依据简单明了』。
"具体示例:早间新闻速览→Deep Research,月度经营会议资料准备→Deep Research Max"。
"预算方面:个人用户标准版已足够,企业分析师业务使用Max具有投资价值"。
"组合用法:标准版建立初步假设→Max深度验证假设,兼顾效率与精准度"。
"熟练后找到最适合自己工作流的平衡点,是正统做法"。
"2026年下半年,还将新增由AI自动选择模式的『AutoSelect』功能,届时连选择的麻烦也将省去"。
最大的竞争对手是OpenAI的Deep Research。
"OpenAI Deep Research:2025年2月上线,作为ChatGPT Pro(月费200美元)的明星功能广受欢迎"。
"GPQA Diamond:26.6%(旧GPT-4o)→90.4%(最新GPT-5.5),进化显著,与谷歌的94.3%不相上下"。
"Humanity's Last Exam:26.6% → 54.6%(OpenAI)vs 54.6%(Gemini),几乎旗鼓相当"。
"OpenAI的优势:易用的UI、ChatGPT整合、代码解释器联动"。
『麦当劳(OpenAI)vs 汉堡王(谷歌),口味差距微妙,以门店布局和价格策略一决高下』的格局。
"Gemini的优势:MCP支持的通用性、与谷歌搜索引擎的整合、多模态的完成度"。
"OpenAI的弱点:MCP支持有限(以自有插件为主),内部数据联动略弱"。
"据悉OpenAI计划于2026年5月发布对抗版『Deep Research v3』,竞争将进一步加剧"。
"从用户角度看『两者都很出色,但取决于使用场景』,目前开发者偏向Gemini,普通用户偏向ChatGPT"。
Perplexity(困惑度)是专注于AI搜索引擎的创业公司。
"Perplexity Pro Search:可切换多个AI模型(GPT-5.5・Claude・Gemini),月费20美元"。
"优势:简洁的UI、引用来源始终明确的透明度、即时性"。
"弱势:自主智能体功能仍较有限,不擅长超复杂调研"。
『便利店搜索(Perplexity)vs 大学图书馆专属研究员(Gemini Deep Research Max),使用场景不同』的市场定位。
"Perplexity的主要客群:记者・学生・咨询顾问等注重即时性的知识工作者"。
"用户数:截至2026年4月估计月活4500万人,正处于高速增长期"。
"Gemini的优势:自主多步骤任务执行、内部数据联动、超大规模调研"。
"Perplexity的优势:多模型选择、响应速度快、月费低廉"。
"两者与其说是竞争关系,不如说是互补关系,根据用途分开使用的用户正在增加"。
"2026年下半年,Perplexity也计划强化自主智能体功能,竞争将愈发激烈"。
另一个重量级选手是Anthropic的Claude Research。
"Claude Research:2026年3月与Claude Opus 4.7同步发布,以自主操控网页浏览器为特色"。
"DeepSearchQA:未公开,但业界估计约为85〜88%"。
"优势:MCP的发明者、编码能力业界领先、注重安全性的设计"。
『Anthropic是MCP的发明者,某种意义上是正宗元祖』的定位。
"Claude的主要客群:企业AI开发者,尤其在编码领域拥有压倒性份额"。
"Gemini的优势:当前基准数据最高、搜索引擎整合的独特性"。
"Claude的优势:MCP生态系统更成熟、擅长边写代码边调研"。
"两者在『安全性vs性能』的权衡上略有不同,Anthropic在安全方面更为保守"。
"据传Anthropic将于2026年5月发布Claude Research Max,直接对标谷歌"。
"结论:Gemini Deep Research目前兼具『最高基准数据+最广生态系统』,是难得的存在,但在安全性方面Claude略有优势"。
"明智的用户会同时使用多款工具,按场景选择最合适的,这是2026年的新常态"。
企业的调研业务将迎来重大变革。
"在行业调研领域,报告生成速度有望提升10倍,推动报告单价下降"。
"预期业务变化①:市场调查公司的调研速度提升10倍,报告单价随之下滑"。
"预期业务变化②:投资银行与证券公司的分析师报告,逐渐走向AI起草→人工审核的模式"。
"预期业务变化③:律师事务所的判例调研,跨库检索从数小时缩短至20分钟"。
『就像江户时代的信使(人类分析师)突然被新干线(AI研究员)取代——一场速度革命』的剧烈变化。
"不过也存在特殊情况:专业中文资料的处理能力、法律・医疗等监管行业的谨慎态度、AI使用指引的完善进度"。
"德勤・普华永道・毕马威・安永等大型咨询公司已相继宣布推出Gemini Deep Research企业导入支持服务"。
"导入价格:年费从数十万至数百万元不等,市场以大型企业为主"。
"据行业预测,2026年下半年将有100家以上企业开始正式导入"。
中小企业与个体经营者也将受益。
"Gemini API按量计费:单任务费用从几角到几元不等,中小企业预算完全负担得起"。
"预期使用场景①:行政顾问的补贴资金调研,每月最新信息收集实现自动化"。
"预期使用场景②:中小制造企业,自动调研竞争对手及原材料行情"。
"预期使用场景③:个人博主・YouTube创作者,提升素材收集效率,增加发布频率"。
『小镇文具店能拥有与大型商社同等信息收集能力的时代』的民主化浪潮。
"导入门槛:获取API密钥、少量Python代码,或通过现有SaaS(Zapier・Make等)接入"。
"DIY派:开发者可在数小时内构建专属工具"。
"非技术派:2026年下半年预计将出现内置Gemini Deep Research的本地化SaaS产品"。
"顾虑:AI报告中可能包含错误信息(幻觉),必须由人工进行最终确认"。
"即便如此,『AI起草→人工校对』的分工模式,仍是将生产力提升3〜5倍的现实解决方案"。
"越是小规模的企业,越是越早行动者越占先机的时代"。
AI行业与人才市场也将掀起大浪。
"AI相关需求激增:提示词工程师・AI工作流设计师的年薪将大幅上涨"。
"招聘倍率:AI相关职种的人才缺口将是IT整体的数倍"。
『淘金热时代,挖金矿的人和卖镐头的人都能赚钱——市场一片繁荣』的盛景。
"初创企业:各AI公司与Gemini开展合作或竞争的动作日趋活跃"。
"政策动向:各国政府预计将相继出台『AI智能体使用指引』"。
"隐忧:AI研究员的出现可能导致初级分析师・研究员的新增招聘减少,影响青年人才培养"。
"应对之策:掌握『AI×人类』协作技能的人才,将是未来十年的赢家;仅凭单纯调研技能的人将面临严峻挑战"。
"结论:白领劳动力将从2026年起全面进入『与AI研究员协同工作的时代』"。
在东京一家大型投资银行负责日系制造业分析的佐佐木。
年收入1500万日元,每月加班80小时令他苦不堪言。
『每个周末都得做报告,和家人在一起的时间被剥夺得所剩无几』的慢性疲惫。
"2026年5月,佐佐木将Deep Research Max引入日常工作"。
"周五傍晚发出指令:『对下周要分析的5家公司进行财务・竞争对手・市场分析』,周一早上到岗时,完整的报告草稿已经准备就绪"。
"报告附带图表・引用来源,只需修改约两成内容"。
『就像主厨把所有食材处理好,副厨只需最后摆盘』的分工模式。
"结果加班时间从80小时降至30小时,周末也能好好休息"。
"报告质量也随之提升,上司评价:『最近分析更有深度了』"。
"2026年下半年晋升为团队负责人,年收入从1500万日元升至2000万日元"。
"利用多出来的时间担任公司内部AI工作流培训讲师,在公司内部的影响力也进一步扩大"。
"这正是『不是被AI取代工作』,而是『能够驾驭AI』的分析师的典型案例"。
"同团队的传统型分析师因生产力差距评价下滑,行业两极分化日趋明显"。
在静冈县经营精密零部件制造企业(45名员工,年销售额12亿日元)的小川。
他有意拓展海外市场,却苦于难以收集英文行业资讯。
『我们这种规模,根本没有预算委托海外调研公司』的烦恼。
"2026年6月,小川以月费3万日元的Google AI Pro+Gemini API按量计费(每月约2万日元)引入Deep Research"。
"每周用Max调研一次:『东南亚5国精密零部件市场规模・主要竞争对手・当地潜在合作伙伴』"。
"报告整合英文行业期刊・统计数据・竞争对手IR资料,以日语摘要呈现"。
『中小企业以每月5万日元,相当于雇用了一名年薪1000万日元的全球调研专员』的性价比革命。
"结果于2026年8月在越南签署代理商合约,海外销售额首次突破1亿日元"。
"2027年进一步开拓泰国市场,年销售额从15亿日元增长至20亿日元"。
"小川在当地商工会议所发表演讲:『AI助力地方中小企业走向世界的时代已经来临』"。
"借助地方政府补贴,推动Gemini导入支持方案的区域化落地"。
"作为地方创生×AI应用的典范,被收录于相关部门案例集"。
"是终结『只有大企业才能用AI』时代的标志性成功案例"。
在东京大学研究生院攻读经济学的本田。
硕士论文主题为『AI时代的劳动力市场变化』。
『全面梳理前人研究文献,每晚要忙到深夜,真的很累』的学业压力。
"2026年5月,本田通过学校的Google Workspace for Education开始使用Deep Research(学生版标准版可免费使用)"。
"发出指令:『分析过去20年AI就业影响相关论文,梳理主要论点与引用模式』"。
"15分钟内横向分析180篇论文,生成一目了然的引用网络与未解决论点报告"。
『图书馆里需要一个月才能完成的工作,AI在午休时间就搞定了』的生产力革命。
"前人研究综述从3周缩短至3天,得以将更多时间专注于核心分析工作"。
"硕士论文质量大幅提升,导师给出高度评价:『这种全面性实属罕见』"。
"同时在Note平台发布Deep Research使用攻略,月浏览量8000,每月获得约3万日元副业收入"。
"2027年春继续攻读博士课程,成为AI×经济学交叉领域备受瞩目的青年研究者"。
"还为本科生举办Deep Research应用工作坊,助力AI在教育界的普及"。
"亲身印证了『AI时代的研究者,能否运用AI将使研究能力相差10倍』这一论断"。
A. 是的,个人用户完全可以使用。
"面向普通用户:通过Google AI Pro(月费约30元人民币)即可在Gemini Apps中使用Deep Research功能"。
"面向开发者:通过Gemini API按量计费(单任务数角至数元不等),可使用完整的Deep Research / Max功能"。
"学生:某些学校通过Google Workspace for Education提供标准版免费使用,建议向学校确认"。
『便利店咖啡(个人套餐)、餐厅套餐(API)、学校午餐(学生优惠),价格与用途各有不同』的丰富选择。
"个人使用案例:旅行计划深度比较、求职企业分析、副业项目市场调研"。
"注意事项:免费额度自2026年4月起已取消,必须使用付费套餐"。
"建议先从月费约30元的Google AI Pro起步,熟练后再转向API使用"。
"使用API需要简单的Python代码知识(约10行),不过可以让ChatGPT等帮你写"。
A. 日语精准度达到世界顶尖水平,完全满足日常业务需求(注:原文以日语市场为背景)。
"Gemini 3.1 Pro大幅增加了日语训练数据,可理解方言及敬语等细微表达"。
"日语问答精准度:相比英语约为95%(上一代约85%),几乎不逊色"。
"日语专业资料(法令・判例・专利)也可读取,支持PDF直接上传"。
『就像一个日本人的英语水平从TOEIC 500分(旧模型)进化到TOEIC 900分(Gemini 3.1 Pro)』的实用程度。
"但并非完美:偶尔会误解小众的日本特有专业术语(行业专用惯用语等)"。
"应对方法:在提示词中补充说明『在这个行业,○○表示××』,可提升精准度"。
"日语报告自动生成:结构・敬语・专业用语均自然流畅,修改量约占2〜3成"。
"与Google Docs联动:日语报告可直接保存至Docs,支持协同编辑"。
"2026年下半年,计划通过追加日语专项训练数据进一步提升精准度"。
A. 幻觉应对措施已大幅改善,但尚未归零。
"Deep Research的最大优势:所有主张均附有引用来源(网页URL或上传资料的页码)"。
"带引用的输出使用户可即时验证主张依据"。
"与上一代模型相比,幻觉发生率约降至1/5,但仍存在数%的概率混入错误信息"。
『就像百科全书里80%内容是正确的,但20%仍需核实——需保持审慎态度』。
"应对措施①:重要事实必须访问引用URL进行验证"。
"应对措施②:用多个查询重复同一问题,检查答案一致性"。
"应对措施③:由人类专家进行最终审核,法务・医疗・财务领域尤为必要"。
"需特别注意的领域:最新资讯(截止日期后的事件)、小众专业知识、计算题(即便是简单数值计算也可能出错)"。
"成熟的使用方式:将AI作为助手,最终判断由人类做出——『AI×人类』的分工模式"。
"『不盲信AI,但过度怀疑而弃而不用同样是损失』——保持平衡最为重要"。
A. API使用模式下,隐私保护有充分的设计保障。
"Gemini API:用户上传的数据不会用于模型再训练(默认为退出状态)"。
"数据保存期限:通常为24小时〜30天,之后自动删除"。
"MCP连接数据:保存在用户的MCP服务器端,不会被发送至谷歌"。
『银行保险箱(API)、酒店储物柜(限时保管)、家用保险柜(MCP服务器),各由不同主体管理』的分层安全设计。
"不过Gemini Apps(个人版):对话记录可能保存至谷歌账户,可在设置中关闭"。
"注意事项①:处理机密数据时,应签署Google Cloud企业合同+数据处理协议(DPA)"。
"注意事项②:个人信息・医疗信息・金融信息,需要专为监管行业设计的专项合同"。
"已符合GDPR及相关个人信息保护法规,合规标准与其他AI服务相当"。
"最佳实践:通过MCP连接将机密数据保留在内部,仅授权AI『只读』访问的架构设计"。
"谷歌预计于2026年6月宣布推出日本专属Gemini API(东京数据中心独立处理),数据跨境问题也将得到解决"。
『AI研究员20分钟查阅160个网站的时代』,将从根本上改变我们的工作与学习方式——这正是本次发布传达的核心要义。
"DeepSearchQA 93.3%、BrowseComp 85.9这两个数字,是AI开始真正承担知识劳动核心工作的有力证明"。
"OpenAI・Anthropic・Perplexity也在积极准备反击,2026年下半年将全面进入AI研究智能体的战国时代"。
『就像计算器的出现改变了计算专员的工作,AI研究员的出现将改变调研专员的工作——这是历史性的转折时刻』。
"从今天起可以做的准备有三条:①通过Google AI Pro体验标准版,②梳理自己工作中可以交给AI的任务,③磨练人类独有的判断力与创造力"。
"不是『被AI夺走工作』,而是『与AI携手实现10倍生产力』的时代"——无论是个人用户、中小企业还是大型企业,选择进入『与AI研究员共同工作的时代』,最终取决于我们自己。
本文转载自 AI Friends。