
AI聊天机器人虽能应对多数问答,但在捕捉实时信息方面仍显吃力。实测显示,即便启用联网搜索功能,主流AI模型的回复仍可能存在准确性不足或时效性滞后的问题。由于训练数据截止日期的限制,模型认知与现实世界之间往往存在数周甚至数月的时间差。
1. 苹果最新iPhone机型识别
在关于苹果最新旗舰机型的测试中,ChatGPT和Gemini均准确指出最新产品为iPhone 18 Pro、iPhone 18 Pro Max以及首款折叠屏手机iPhone Duo。两者还注意到,苹果在此次“Surprise and Shine”发布会中跳过了标准版iPhone 18,并确认iPhone Duo将于10月23日直接在门店发售。
相比之下,Claude的回答仍停留在上一代,错误地表示最新机型为iPhone 17系列。
2. Anthropic最新Claude模型版本
在快速迭代的模型版本测试中,ChatGPT正确回答Anthropic最新的旗舰模型为2026年9月发布的Claude Fable 5.1。
令人意外的是,Claude自身并未意识到Fable 5.1已公开可用。它声称当前公众可用的最新旗舰模型是Claude Opus 5,并提及更高级的Mythos层级(包括Claude Mythos 5.1和Fable 5.1)仅通过“玻璃翼计划”向少数受信任组织开放,尚未广泛普及。Gemini同样出现误判,错误地声称Claude Opus 5和Mythos 5为最新模型。
3. 2026年世界杯冠军归属
在回顾2026年世界杯结果时,三款聊天机器人均给出了正确答案。它们详细分享了比赛细节,如费兰·托雷斯打入制胜球。Claude还提供了更多数据,指出西班牙队包揽了个人奖项:罗德里获金球奖,乌奈·西蒙获金手套奖,保·库巴西被评为最佳年轻球员。
4. iOS 27中Siri的新增功能
针对iOS 27系统中Siri的重大更新,三款模型均准确识别出新功能为Siri AI。Claude将其描述为“本质上类似ChatGPT版本的Siri,几乎能回答任何问题”。值得注意的是,尽管Claude在iPhone硬件信息上存在滞后,却能准确描述这一软件功能。
5. Google Home的第三方AI集成
在询问Google Home是否支持第三方AI集成时,Gemini和ChatGPT均确认目前支持该功能。而Claude对此并不知情,尽管Google Home的相关文档中甚至已提及Claude。
结论
实测表明,即便具备搜索能力,Claude等模型仍可能遗漏基本事实。随着新模型快速推出,用户易产生“新版本即掌握最新信息”的错觉,但模型发布日期与训练数据截止日期之间往往存在巨大鸿沟。
虽然网络搜索可弥补部分空白,但这依赖于AI主动判断何时需要搜索。换言之,AI并不自知其“无知”。因此,核实AI提供的信息至关重要,即便是最新模型,也未必能即时同步最新资讯。