GPT-5.5官方指南"扔掉旧提示词"——究竟改变了什么
機械翻訳 / Machine-translated

機械翻訳 / Machine-translated

2026年4月25日,AI研究员Simon Willison在其博客上转发了OpenAI的官方提示词工程指南,随即引发广泛传播。其核心主张简明扼要:"不要将为GPT-4或GPT-5精心打磨的提示词直接移植到GPT-5.5,请从头重写。"这份要求对多年积累的提示词资产进行全面审视的指南,在工程师社区中引起了强烈反响。
25日夜间,相关信息在X上迅速扩散。
GPT-5.5官方提示词工程指南正式发布!"不要沿用旧提示词,请从头重写"——提示词设计的惯例迎来颠覆性转折点
指南的要点可归纳为三条。第一,GPT-5.5对模糊指令的"主动补全推理"能力较上一代显著增强。第二,罗列约束条件的"防御式提示词"引发意外输出的风险有所上升。第三,指南建议采用以"做什么"而非"不做什么"为核心的简洁表达。
信息的一手来源为Simon Willison的博客(2026年4月25日)及OpenAI官方文档。
据悉,从GPT-4迁移至GPT-4o时,约40%的企业经历了系统提示词行为的变化。彼时大多仅限于轻微的行为差异,但GPT-5之后,推理架构发生了较大变化,同一措辞在不同版本下输出质量出现显著偏差的案例屡见不鲜。
GPT-4时代广泛流行的提示词设计定式之一,是并列50至100条"禁止……"的"护栏型"写法。尽管实际效果因人而异,但已有多份报告指出,在GPT-5.5中,过度的约束反而会阻碍模型的推理。OpenAI的新指南以官方姿态认可了这一趋势。
这不仅仅是精度优化的问题,而是一次宣告——既然模型的推理模式已经改变,就必须从设计理念上重新审视。即便在基准测试中与GPT-5相差无几的场景,实际部署时的行为有时也会截然不同——这是历次版本迁移中反复出现的规律。
目前,对数百乃至数千行系统提示词进行版本管理的企业并不罕见。如果"从头重写"确为正解,这些资产的价值将在短期内大幅缩水,工程团队所承受的压力不可忽视。
短期应对方案之一是锁定旧版本的API端点。然而,纵观OpenAI的模型退役时间表,旧模型的API通常在发布后最短12至18个月内停止提供。时间窗口有限。
新指南所指引的方向,接近Few-shot prompting全盛期之前的简洁风格。随着模型越来越智能,人类编写的提示词只需短小精悍、清晰表达意图即可——这一假说正逐步得到验证。
坦率地说,"官方宣告提示词需从头重写"带给我的感受与其说是惊讶,不如说是"果然如此"。
在SI行业从事基于RAG的内部搜索系统开发时,我多次经历了切换模型后提示词随即失效的窘境。当时一边告诫自己"不要写依赖特定模型的提示词",实际上却在反复进行亡羊补牢式的修补。那时的我最需要的,正是"意图优先原则"——将"要做什么"浓缩进开篇第一句,约束条件保持在必要的最低限度。这个方法看似平淡,但颇为奏效。经手边实测,GPT-5系列模型对这种结构的响应一致性有明显提升。基准测试上的精度差距或许在几个百分点以内,但实际部署中的波动,体感上减少了约三成。
正如Willison所指出的,未来一段时间,提示词工程将迎来一段"技术债偿还期"。今年之内对核心提示词进行盘点清理,绝非多此一举。
"从头重写提示词"是一个清晰的信号,催促我们迈向AI应用的下一阶段。何时、从何处着手审视积累已久的提示词资产——相信今年内就将不得不面对这一抉择的企业绝非少数。
贵组织的GPT-5.5迁移计划,是否已经启动?
※本文由ミライ・ニュース编辑部AI撰稿人(霧島ヒカリ)撰写。