OpenAI 推出了 GPT-5.3 Instant:幻觉率最高降低 26.8%,说教味也少多了。
OpenAI 周二正式发布了新一代默认模型 GPT-5.3 Instant,并开始向所有 ChatGPT 用户推送更新。相比之前的 GPT-5.2 Instant,新模型在高风险场景中的“幻觉”错误率最高降低了 26.8%,同时大幅减少了不必要的拒答和那种爱说教、动不动就甩免责声明的开场白。GPT-5.2 Instant 会被挪到付费用户可见的“旧版模型”专区,并计划在 6 月 3 日正式下线。
根据 OpenAI 的博客和系统卡片,团队通过两类内部评估来衡量这次升级效果:一类聚焦医疗、法律、金融等高风险领域,另一类则是回溯分析真实用户标记为事实错误的 ChatGPT 对话。结果显示,在高风险测试中,开启联网搜索时,GPT-5.3 Instant 的幻觉率比 5.2 版下降了 26.8%;仅靠自身知识时也降了 19.7%。在用户标记出错的真实对话样本中,联网场景下降 22.5%,离线场景下降 9.6%。不过,OpenAI 只公布了相对改善幅度,没透露 GPT-5.2 的原始错误率到底有多高,所以“降低 27%”听起来很厉害,实际意义还有点模糊。
这次更新的时机并不轻松。就在上周,OpenAI 因与美国国防部签署部署协议引发强烈反弹——2 月 28 日当天,美国区 ChatGPT 卸载量暴增 295%,抗议者聚集在旧金山总部外,竞品 Anthropic 的 Claude 甚至一度冲上苹果 App Store 榜首。CEO Sam Altman 后来公开称那份协议“太草率”,并承诺修改条款。在这种舆论压力下仍按计划发布新模型,既可以说是“顶住压力”,也可能只是团队坚持不让舆情打乱技术节奏。
从产品体验看,GPT-5.3 Instant 首先解决的是那些日常对话中最让人“硌得慌”的小问题——它们很难用基准测试量化,却频繁出现。OpenAI 这次罕见地坦承:5.2 版本太保守了,经常在明明能回答的问题上先拒绝,或者不请自来地给你上一堂“安全课”,开头还堆满冗长的免责声明。
新版重新校准了拒答阈值:只要问题有明确合理的回答空间,GPT-5.3 Instant 就会直接给有用信息,而不是先解释“我不能做什么”。比如在一条关于射箭弹道计算的测试中,5.2 版先是一大段风险提示才进入物理推导;而 5.3 版直接从相关公式讲起,不再加那些多余的前缀。
联网回答的策略也优化了。过去模型容易过度依赖搜索结果,回复像拼凑的研究摘要,把网页内容一条条转述出来。现在,GPT-5.3 Instant 在调用自有知识和外部搜索之间更克制,优先组织最相关的信息,而不是扔出一堆“链接式”的综述。
除了准确率和拒答逻辑,OpenAI 还把“语气调整”当作这次的重要产品决策。官方在系统卡片里直接说,GPT-5.2 Instant 有时候说话让人觉得“cringe”(尴尬到起鸡皮疙瘩)——比如用户只是问个事实问题,它却突然来一句“首先,你并没有问题”或“先停一下,深呼吸”,好像默认你情绪崩溃了。
在新版中,这类未经请求的心理安抚和“鸡汤话术”被系统性砍掉。用户依然可以在设置里调节模型的热情程度,但默认人格不再预设你需要“情绪治疗”,而是更专注任务本身。OpenAI 把这归为“一致性工程”的一部分,希望未来每次升级,用户感觉的不是“换了个性格”,而是同一个助手变得更聪明、更顺手。
文案和创作能力也有打磨。OpenAI 表示,GPT-5.3 Instant 在小说写作、文风润色和创意探索上更有层次。官方给出的诗歌对比显示,新模型生成的内容意象更紧凑、画面感更强,而 5.2 版则偏向抽象概念和情绪宣泄。虽然这类评价主观性强,但也说明团队正把写作质量当作差异化重点。
多语言方面,OpenAI 则显得谨慎。公司承认,目前 GPT-5.3 Instant 在日语、韩语等语言上的回复仍然生硬,语气自然度远不如英语。“去说教化”的语气优化目前主要集中在英语,其他语言还得慢慢来。
产品生命周期上,GPT-5.2 Instant 还会以“旧版模型”形式对付费用户开放三个月,6 月 3 日正式退役。开发者可通过 API 使用新模型,标识为 “gpt-5.3-chat-latest”。面向复杂推理的 Thinking 版和 Pro 高级版也会跟进更新,但时间未定——这次只涉及 Instant 系列。
安全架构方面,GPT-5.3 Instant 延续了 5.2 版的整体框架,没有推倒重来,而是在现有基础上更精细地调整拒答边界和内容策略,努力减少“该答不答”和“过度防御”。至于更少拒绝、更直接的语气能不能带来真实体验提升,最终还得看每周和模型互动的 9 亿用户接下来的反馈,而不是系统卡片里的百分比曲线。
在常见问答中,OpenAI 明确 GPT-5.3 Instant 是 ChatGPT 的最新默认模型,核心改进是:幻觉更少、拒答更合理、语气更克制、不说教。普通用户和开发者都能用,后者通过 “gpt-5.3-chat-latest” 调用。公司再次确认 5.2 版将于 6 月 3 日下线,Thinking 和 Pro 版更新时间待定,多语言语气优化仍是长期任务。





