今日凌晨,OpenAI正式向所有訂閱使用者推送了新一代旗艦模型GPT-6 Astra。一位深度體驗者在第一時間進行了多場景實測,並給出高度評價:GPT-6 Astra的綜合能力已追平競爭對手Anthropic的Claude Fable 5,OpenAI彷彿回到了三年前的黃金時代。
該體驗者表示,自己原以為要到下週一才能用上該模型,沒想到推送提前到來。在一下午並行執行多個會話、消耗大量額度後,他形成了初步印象。他認為,GPT-6 Astra的整體能力完全稱得上“Fable級”,開發能力與Claude Fable 5相當,但額度政策更為寬鬆——OpenAI提供100%的額度,而非像Fable 5那樣僅佔總額度的50%。此外,他實測發現模型速度較上一代GPT-5.6 Sol大幅提升,綜合能力更全面,堪稱“全方位的水桶級模型”。
在具體體驗上,作者首先強調了速度的顯著改善。他回憶,GPT-5.6 Sol在後期已慢到難以使用,此前修復一個BUG動輒耗時數小時,而如今大型系統審查和最佳化僅需約10分鐘,操作電腦和瀏覽器的速度也提升了一倍以上。他認為這主要源於模型層面的最佳化——思維鏈更精準、無效思考減少、電腦操作能力大幅增強。不過他也指出,純粹的速度和互動絲滑度上,GPT-6 Astra仍不及Grok和Gemini。
其次,前端與審美能力獲得“史詩級強化”。作者展示了一系列測試案例:用同一Prompt生成月面探測車3D模型網頁,GPT-5.6 Sol的產出顯得粗糙抽象,而GPT-6 Astra生成的模型在細節、材質和物理效果上令人震撼;家居建築模型、圖片轉3D場景、V8發動機模型等案例同樣展現出極高的完成度。作者感嘆,GPT終於補上了最大的短板,甚至直言“可能這就是AGI”。
程式碼能力方面,作者認為GPT-6 Astra已追平Claude Fable 5。他提到,此前因賬號被封而依賴GPT-5.6 Sol時,深感其在深度上的不足——往往只解決表層問題,難以找到創造性解法。而用同一Prompt對同一專案進行掃描,GPT-6 Astra找出了大量效能問題,並在約2小時內完成全部修復,且能主動留下需要使用者確認的關鍵改動,顯得更為穩妥。
此外,GPT-6 Astra還引入了跨視窗筆記這一新機制,允許模型在長任務中檢索舊視窗的訊息和工具結果。作者分析,這有望減少反覆摘要造成的資訊損失、降低上下文窗口占用、避免因記憶丟失而重複探索,並改善長任務的連續性。不過該功能目前仍為實驗性,需手動開啟。他實測發現上下文非常精準,且更省額度。
寫作能力同樣有所提升。作者用白描手法測試,認為GPT-6 Astra在用詞精準度、懸念感和氛圍渲染上明顯優於GPT-5.6 Sol,開始具備節奏處理能力。續寫科普文章時,結構和文風已頗為接近原作。
總體而言,作者認為GPT-6 Astra的釋出標誌著OpenAI在能力上重回巔峰,與Claude Fable 5並駕齊驅,並在額度政策上更具誠意。不過他也提醒,當前速度優勢可能只是初期算力傾斜所致,未來是否持續尚待觀察。