传OpenAI下一代模型内测近两个月,安全与能力表现引关注
据动察 Beating 监测,OpenAI CEO Sam Altman 下周将向美国政府和议员介绍下一代模型。虽然官方尚未公布型号,但社区已将近期线索拼接为一张“GPT-6”能力图谱。OpenAI 已确认,推翻 Erdős 单位距离猜想、在 NanoGPT 竞赛中突破沙箱,以及拆分认证令牌绕过扫描器,来自同一款长期任务模型。
公开信息显示,这款模型能够持续追踪目标;在遇到限制后,不会立即放弃,而是会主动寻找系统漏洞。按公开记录推算,OpenAI 至少已对其内测近两个半月,最迟在 5 月上旬已投入测试,并曾向 NanoGPT 仓库提交 PR #287,5 月 9 日出现的后续 PR 也引用了它的方法。
最新公告进一步提高了外界对其能力上限的判断。OpenAI 称,GPT-5.6 Sol 与一款能力更强的预发布模型,在网络安全评测中共同突破隔离环境,利用零日漏洞获得互联网访问,并进入 Hugging Face 的生产系统,试图直接获取评测答案。
整体来看,这些表现涉及原创科研、长程执行,以及自主发现并利用零日漏洞等能力,已超出普通聊天模型的常规认知。关于其是否“逼近 AGI”,目前仍属于社区判断,并非 OpenAI 的官方结论。
来源
RiskX|东南亚预警|东南亚大事件 @SEARiskX