新智元報導
前端開發,真要被OpenAI一把端了嗎?
今天,一位開發者@Lentils80意外發現,OpenAI已擴大Astra的內部測試,代號mozaik-alpha-fdm。
最新釋出的兩個結果,全部來自Max effort模式下的零樣本生成。
一個是3D像素風格的城堡,另一個是前端網頁,全部都是一次完成生成。
與此同時,一大批拿到灰度測試資格的開發者們,同一時間放出了Astra的首批測試結果。
真正讓開發者驚訝的,是它一次就管住了大量細節:統一的視覺語言、複雜元素之間的空間關係、頁面層級,以及互動所需的程式碼結構。
有人看完直接宣布,「Frontend is solved」!
大家一致預測,也就是下週四(9月3日)前後,Astra將正式面世,與Fable 5.1正面對決。
總結來說,Astra將具備以下強大的能力——
・前端非常強大,零樣本一次生成
・端到端訓練的多Agent編排,輕鬆駕馭超長週期任務
・「持久」推理模式,還能即時自我修正
一句話生成3D網頁,Astra前端「封神」
要知道,前端一直是大語言模型的老大難問題。
後端邏輯寫得再流暢,一生成UI就露餡,例如臃腫的CSS、刺眼的配色……
而這一次,Astra在零樣本條件下展現出的細節掌控力,確實讓人看到了質變的苗頭。
這個可互動的3D等距(isometric)王國地圖,需要AI同時搞定幾何透視、圖層堆疊、動態互動和視覺一致性。
開啟最大思考程度,Astra可以做到一次成形。
在Max模式下,Astra模型往往比Sol思考得更多,但從下面的輸出可以看出,它對細節的關注度極高。
它生成的一艘太空船,各種細節、構造非常逼真。
另一位開發者MeSun,直接用Astra做了一個帶有物理效果的3D自行車測試網頁(HTML),連車身比例都能隨意調整。
再讓它生成一個3D第一人稱Roguelike遊戲,還要求主打戰鬥爽感。
結果人家同樣「一次搞定」,一次就完成了。
看完一波Astra驚艷的演示,有爆料大咖甚至喊出,這是歷史上第一次,「想法」開始碾壓「執行」。
「你能想到的,AI就能幫你做出來」。
永久智慧體,四大技術核心深度解析
為什麼Astra的前端能力會一夜之間脫胎換骨?
結合目前洩露的特徵與業界預測,mozaik-alpha-fdm版本的核心技術突破可能集中在以下四個面向。
首先,是端到端多智慧體編排。
Astra可能不再是一個單純的「單體程式碼生成器」,而是在底層原生整合了多智慧體架構。
例如讓Codex處理程式設計任務,用另一個子模型處理自然語言查詢,最後由主模型整合結果。
在生成3D網頁時,模型內部實際上同時運行了「UI設計師、前端工程師和程式碼審查員」,從而保證了版面、樣式和邏輯的三位一體。
這跟GPT-5.6中已經以beta形態推出的Multi-agent功能一脈相承,但Astra可能將其內化為「端到端訓練」的原生能力。
第二,超長程任務能力(Ultra Long-horizon Task)。
以往模型在編寫涉及多個組件和複雜CSS/JS聯動的專案時,極易出現「遺忘」和「幻覺」。
Astra展現出的完整度,證明其上下文視窗內的注意力機制得到了革命性優化,足以支撐從零建構複雜工程。
從Astra解決十個數學問題的表現來看,它具備在極長時間跨度內維持推理一致性的能力。
這對程式專案的持續開發、論文級別的研究任務,以及複雜工作流程的自主執行都意義重大。
第三,持久化推理模式(Persistent Reasoning)。
Astra在Max effort下的思考量顯著超過Sol,這指向一種更「持久」的推理機制。
模型不會一次就輸出答案,而是在內部反覆驗證、糾錯、迭代,直到輸出達到滿意水準。
這意味著它能「記住」當前DOM樹的結構,在後續生成中保持設計語言和程式碼規範的絕對一致。
第四,即時自我糾錯。
這是最可怕的一點,Astra可能在生成程式碼的同時,在內部沙盒中完成了「虛擬渲染」或AST語法樹的邏輯運行。
自動發現了前端錯位並完成了重構,最後才將完美的零樣本結果呈現給使用者。
零樣本就能複刻PS5手把這種高細節渲染任務,本身就是自我糾錯能力的間接證據。
9月首週,正面對決Fable 5.1
不過,好戲還在後頭。
就在這一週,Anthropic也被爆料正在加速推進Fable 5.1。
更巧的是,它的發布時間窗口,恰好也卡在Astra前後。
從灰度測試者釋出的回饋來看,Fable 5.1這次升級的重點,幾乎和Astra撞個正著:
・前端程式碼更穩定,複雜組件邏輯可以一次成形
・長思維鏈推理更強,不容易推著推著就「忘了前提」
・工具調用和分步規劃進一步強化,越來越接近一個成熟的AI Agent
也就是說,兩家公司已經殺進了同一塊戰場:程式碼能力要更強,任務要跑得更久,過程中還得盡量少讓人接手。
現在,兩邊甚至已經開始隔空PK。
同樣生成一張「女子自畫像」SVG向量圖,左邊是Astra,右邊是Fable 5.1。
到底誰的細節更穩、結構更乾淨、一次生成的完成度更高,已經可以直接搬上檯面比了。
但真正可能決定勝負的,或許還不只是模型能力。
從爆料來看,Astra除了性能強悍,還可能在性價比上繼續往下壓。
如果OpenAI真能以更低的API呼叫成本,交付一款自帶Max effort、自糾錯能力更強、又不需要複雜工程編排的模型,那麼Fable 5.1面對的,就不只是Benchmark上的壓力。
下週四,巔峰之戰。到底誰能拿下新王寶座,拭目以待。
參考資料:
https://x.com/pankajkumar_dev/status/2093623079192891882
https://x.com/lentils80/status/2093617080327127456
編輯:桃子