今日凌晨,OpenAI正式向所有订阅用户推送了新一代旗舰模型GPT-6 Astra。一位深度体验者在第一时间进行了多场景实测,并给出高度评价:GPT-6 Astra的综合能力已追平竞争对手Anthropic的Claude Fable 5,OpenAI仿佛回到了三年前的黄金时代。
该体验者表示,自己原以为要到下周一才能用上该模型,没想到推送提前到来。在一下午并行运行多个会话、消耗大量额度后,他形成了初步印象。他认为,GPT-6 Astra的整体能力完全称得上“Fable级”,开发能力与Claude Fable 5相当,但额度政策更为宽松——OpenAI提供100%的额度,而非像Fable 5那样仅占总额度的50%。此外,他实测发现模型速度较上一代GPT-5.6 Sol大幅提升,综合能力更全面,堪称“全方位的水桶级模型”。
在具体体验上,作者首先强调了速度的显著改善。他回忆,GPT-5.6 Sol在后期已慢到难以使用,此前修复一个BUG动辄耗时数小时,而如今大型系统审查和优化仅需约10分钟,操作电脑和浏览器的速度也提升了一倍以上。他认为这主要源于模型层面的优化——思维链更精准、无效思考减少、电脑操作能力大幅增强。不过他也指出,纯粹的速度和交互丝滑度上,GPT-6 Astra仍不及Grok和Gemini。
其次,前端与审美能力获得“史诗级强化”。作者展示了一系列测试案例:用同一Prompt生成月面探测车3D模型网页,GPT-5.6 Sol的产出显得粗糙抽象,而GPT-6 Astra生成的模型在细节、材质和物理效果上令人震撼;家居建筑模型、图片转3D场景、V8发动机模型等案例同样展现出极高的完成度。作者感叹,GPT终于补上了最大的短板,甚至直言“可能这就是AGI”。
代码能力方面,作者认为GPT-6 Astra已追平Claude Fable 5。他提到,此前因账号被封而依赖GPT-5.6 Sol时,深感其在深度上的不足——往往只解决表层问题,难以找到创造性解法。而用同一Prompt对同一项目进行扫描,GPT-6 Astra找出了大量性能问题,并在约2小时内完成全部修复,且能主动留下需要用户确认的关键改动,显得更为稳妥。
此外,GPT-6 Astra还引入了跨窗口笔记这一新机制,允许模型在长任务中检索旧窗口的消息和工具结果。作者分析,这有望减少反复摘要造成的信息损失、降低上下文窗口占用、避免因记忆丢失而重复探索,并改善长任务的连续性。不过该功能目前仍为实验性,需手动开启。他实测发现上下文非常精准,且更省额度。
写作能力同样有所提升。作者用白描手法测试,认为GPT-6 Astra在用词精准度、悬念感和氛围渲染上明显优于GPT-5.6 Sol,开始具备节奏处理能力。续写科普文章时,结构和文风已颇为接近原作。
总体而言,作者认为GPT-6 Astra的发布标志着OpenAI在能力上重回巅峰,与Claude Fable 5并驾齐驱,并在额度政策上更具诚意。不过他也提醒,当前速度优势可能只是初期算力倾斜所致,未来是否持续尚待观察。