ChatGPT的默认模型最近刚做了一次大升级,免费用户也能直接用上新版本了。
今天ChatGPT的默认模型迎来了一次大升级,新版本叫GPT-5.5 Instant,融合了5.5的基础智力和极快的响应速度,免费用户也能直接用。这次的几个关键变化是:幻觉减少了52.5%;新增了“记忆来源”功能,可以展示过去的哪段对话影响了当前的回答;回答更简洁,少了不必要的追问、多余的表情符号和繁复的格式;语气也更自然更舒服。奥特曼特别提到,如果你最近一直在用深度思考模型,不妨回来试试看。
作为默认模型,首先要改进的就是准确率,减少瞎编。跟上一代相比,GPT-5.5 Instant在事实准确性上有了明显提高,尤其是在医疗、法律、金融这些高风险领域,产生的虚假陈述减少了52.5%。在用户之前标记过有事实错误的比较棘手的对话里,错误陈述也减少了37.3%。OpenAI还举了一个代数题的例子:用户上传了一张手写方程式的照片,里面有一个计算错误。上一代模型一开始认同用户的解法,后来发现等式不成立,却错误地得出结论说方程无解。而新的模型起初也认同了用户的计算,但随后发现了对方在重新排列方程时的错误,并正确求解了修正后的二次方程。这个变化放在默认模型上意义更大,因为很多人每天问ChatGPT的问题正是合同、报销、病症解释、代码报错、作业思路这些。在这些场景里,模型一本正经地讲错,比直接说不会更麻烦。基准测试也印证了这一点。在竞争激烈的AIME 2025数学测试中,准确率从65.4%提升到了81.2%;在测试博士水平科学推理能力的GPQA中,从78.5%提升到了85.6%;在解读和推理科学图表的CharXiv测试中,准确率从75.0%提升到了81.6%;在处理文本和图像中专家级问题的MMMU-Pro测试中,从69.2%提升到了76.0%;而在从复杂文档中提取结构化数据的OmniDocBench测试中,错误率从14.6%下降到了12.5%。
除了回答得更准,模型还有一个老问题就是答得太长。这次GPT-5.5 Instant的风格变化,核心就是更短更聚焦,但不丢失关键信息。以前同一个问题,有时候会先来一大段免责声明,再堆三层列表,最后还追问一句“你希望我继续吗”。现在官方的说法是:减少过度格式化,减少不必要的追问,也减少没必要出现的表情符号。在官方给出的例子里,GPT-5.5 Instant使用的单词数减少了30.2%,行数减少了29.2%。语气也把握得恰到好处——非正式、实用又符合职场规范,避免了过度解释,针对不同情况给出可用的方案,而且对事不对人。OpenAI认为,老版本的答案虽然更全面,尤其是“不该做什么”那部分,但对于一个非正式的建议提示来说显得有些过于复杂,结构和润色可能超出了用户的实际需求。
记忆力方面,新模型也更强了。GPT-5.5 Instant更善于利用你已经给过ChatGPT的上下文,包括你连接的邮箱、过去的历史对话、上传过的文件。关键在于,它能判断什么时候这些上下文真的能让回答变好,而不是每次都硬套记忆。这次OpenAI还引入了“记忆来源”功能,会向用户显示哪些记忆影响了这次的回答。如果某条记忆已经过时了,用户还可以直接更正或删除。
从5月5日开始,GPT-5.5 Instant已经逐步向所有ChatGPT用户上线,取代老版本成为默认模型。API里对应的是chat-latest。旧模型不会立刻消失,付费用户还能在模型配置里继续访问老版本三个月,之后再退役。个性化增强功能会先向Plus和Pro用户的网页端推出,移动端随后跟上,Free、Go、Business和Enterprise用户会在后续几周陆续获得。





