OpenAI DevDay期间,首款面向公众发布的6.1系列模型GPT-6.1 Sol正式亮相。尽管旗舰模型GPT-6.1 Astra此前因行为问题被召回重训,但Sol的推出标志着OpenAI在模型迭代上继续推进。
性价比显著:以1/5成本逼近旗舰性能
OpenAI数据显示,GPT-6.1 Sol在“智能”维度迅速逼近Astra,多项指标几乎与旗舰模型持平。在编程、专业问答及文档处理任务中,Sol的表现与Astra不相上下,但成本仅为后者的五分之一左右。在计算机使用、科学研究等评估场景中,Sol要么直接超越前代模型GPT-6 Sol,要么在保持相当性能的同时提升了速度或降低了成本。
准确性提升与安全合规
针对AI模型常见的事实性错误问题,GPT-6.1 Sol将包含事实错误的低质量回复比例从GPT-6 Sol的11.4%降至7.7%,在此方面已能与Astra相媲美。此外,与曾引发争议的Astra不同,Sol在安全评估中未出现任何警示信号,安全性表现稳定。
部署进展与后续计划
目前,GPT-6.1 Sol已开始在OpenAI的ChatGPT Work和Codex计划中上线,但尚未向普通Chat功能用户开放。OpenAI同时预告,将在未来几天内推出GPT-6.1 Sol Ultrafast版本,其Token生成速度有望实现近一个数量级的提升。