← 返回资讯热点
AI热点雷峰网发布时间:2026-09-04 11:07热度 160.0000

打穿 AI 智商测试!GPT-6 Astra 的符号世界模型,是突破还是钞能力刷分?

每题狂烧 360 美元,GPT-6 真的通关 AGI 了? 作者丨高允毅 编辑丨岑 峰 OpenAI 的最强模型 GPT-6 Astra终于亮相,它在电脑操作、科研探究和安全防御上都有惊人的突破。而在众多亮眼成绩中,最引起大众热议的是它在 ARC-AGI-3 测试中,成绩逼近100%。 ARC-AGI-3 是什么?这是目前全球科技圈公认AI “智商”评测榜,你可以把它理解为 AI 界的门萨俱乐部入会考试。 这个测试里全是不断变化的图形规律题,根本没法刷题,AI必须像人类一样去探索环境、推测目标,靠临场反应和推理能力找出规律。这在各类评测中较为高阶,更能测试出 AI 到底只是一个工具,还是真智能。 而 GPT-6 Astra竟然把这个测试打穿了,要知道,上一个模型 GPT-5.6 Sol 的分数还是 38.3%,这实在是一个巨大的飞跃。这种智力甚至碾压人类,在96% 的关卡中,它都比人类的操作效率更高,平均动作步数比人类少 51.7%。 如果一个 AI 在完全陌生的环境下,真正具备了建立逻辑规律并解决问题的能力。我们可以畅想一下,未来,或许它可能在未知的自动驾驶路况中,做出正确的选择,或者在全新的未知病毒爆发时,迅速推演出特效药的分子结构。 为了探究 GPT-6 Astra为什么这么聪明,ARC Prize 官方亲自复盘了它的后台记录,发现它在玩游戏时,会生成高效的“符号世界模型”。 符号世界模型是“世界模型”的高级衍生品。当世界模型像艺术家一样,用画面来预测未来时;即时符号世界模型更像一个数学家,将现实世界抽象为逻辑符号和因果代码。 这个技术被公认为 AI 迈向高级推理的必经之路。 01 符号世界模型是什么? 过去,很多大模型在 ARC-AGI 系列基准测试中拿不到高分一个重要原因,就是它们习惯了“暴力试错”。AI 会把游戏画面切成像素块,先随便点一下,不对就换个方向,靠运气通关。 这种模式下,就算有一些分数的突破,AI也不是真正理解和掌握游戏规则。 符号世界模型之所以能掌控全局,正在于它是对周围环境物理规律、因果关系充分理解后,通过精密计算后做出选择。 在实际测试中,当 GPT-6 Astra进入陌生的图形游戏后,它会开始用自创的 DSL ,一种专属的代数符号系统,对观察到的环境做大量笔记。比如,它会精准记录下游戏潜在的隐性规则、一连串即将执行的指令,甚至将每一个像素的运动轨迹都精确映射到坐标系上。 这种代数的记录方式带来的是唯一确定的世界状态,相较于之前模型用自然语言交互产生的歧义性,这种符号化表述会让准确率带来史诗级飞跃。 然后,它会先在脑海里写出一套 Python 代码逻辑:“如果我按 A,图形就会左转 90 度”。 接着,它会在自己大脑里建一个“虚拟沙盒”,在脑中模拟接下来的计划。确认逻辑闭环、准确无误后,它才会在现实游戏中点下第一步。这就是为什么

来源:雷峰网
说明:本站展示中文整理摘要,便于快速阅读;完整内容和版权归原站所有。