GPT-5.6來了,Fable 5慌了?_Sol_Terra_Luna
一個能省錢,一個更聰明。
AIX財經(AIXcaijing)原創
作者 | 雷晶
編輯 | 金玙璠
GPT-5.6終于全量上線了。
早在6月26日,OpenAI以有限預覽的方式發布了GPT-5.6系列:Sol(太陽)主打復雜推理和Agent編碼,Terra(大地)定位日常生產力,Luna(月亮)走低價快速路線。
因美國***要求需分階段放開,首發僅向約20家機構開放。兩周后,GPT-5.6于當地時間7月9日全面上線,覆蓋ChatGPT、ChatGPT Work、Codex及OpenAI API。ChatGPT Plus及以上用戶可使用Sol,在ChatGPT Work和Codex中,免費用戶默認使用Terra,付費用戶可在三檔中切換。
幾乎同一時間,Anthropic的Fable 5也經歷了波折。這款6月9日發布的Fable 5(寓言)模型與未發先火的Mythos 5(神話)模型共享同一底座,因漏洞挖掘的能力太強,發布時在Fable 5多加了一層安全分類器。盡管如此,6月12日Anthropic還是因使用有安全隱患被暫停關閉了所有用戶訪問,直到7月1日才恢復上線。7月8日,官方宣布Fable 5使用期限從原定的7月7日延長至7月12日;此后Fable 5將不再計入訂閱套餐額度,轉為按量付費。
兩款模型都被視作各自公司的最強模型,可以看作是模型賽場上的直接對手。我們從OpenAI公布的評測數據中,選取了Fable 5與GPT-5.6 Sol均有成績的12項基準,制成以下對比圖表。
從成績來看,雙方差距并不大。GPT-5.6 Sol更擅長Agent執行和終端操作;而長上下文和代碼庫級任務仍是Fable 5的強項。價格上,GPT-5.6 Sol每百萬Token輸入5美元、輸出30美元;Fable 5是輸入10美元、輸出50美元,前者幾乎便宜一半。
一個6月底小范圍預覽、7月全面上線;一個6月發布即遭下架、7月才回歸。兩款模型踩著同一個時間窗口完成了各自的波折上新。而OpenAI還同步推進了更大的動作:Codex正式并入ChatGPT桌面應用,ChatGPT Work同步上線,ChatGPT想成為用戶電腦里的常駐入口。
那么問題也就來了,價格更低、野心更大、又把戰線從模型拉到產品,GPT-5.6到底能不能追上Fable 5?
01.三檔模型,各有所長
OpenAI這次把GPT-5.6拆成了三檔:Sol、Terra、Luna。Sol扛大旗,Terra打主力,Luna跑量。但定位歸定位,落到真實任務里,它們各自能打到什么程度?我們挑了幾個場景,逐一驗證。
先來看GPT-5.6 Luna,我們從最輕量的活兒開始,讓它做一個二線城市的單人出游規劃。
它交付的是一份標準的攻略模板。住宿建議、每日行程、預算參考、出行提醒,該有的板塊都有。飲食推薦細化到了“小鍋米線約10-20元”這種具體的價格區間,路線規劃也會考慮不同的興趣偏好。
GPT-5.6 Luna制作的出游規劃
但生成的攻略缺少景區開放時間的提醒和景區門票價格,對實際出行的參考價值打了折扣。對于懶得自己做功課的人來說,GPT-5.6 Luna夠用,但不夠精細。
為了能直觀地看出三個版本的區別,我們在這里也用一樣的指令測一下Terra和Sol。
三個版本的模型選的城市各不一樣。Terra選擇了熱門旅游地長沙,它***用了表格的方式呈現,整體更加整齊。和Luna相同的是,它在推薦美食時也給出了具體的價格區間。不同點則在于,它給出了涵蓋景點預約、天氣、交通、飲食等多方面的提醒。
GPT-5.6 Terra制作的出游規劃
Sol的表現與它全能的屬性相符。Sol選的城市是泉州,它的呈現形式和Luna比較相似,也是按時間線羅列路線,但它貼心的點在于加了一個行程概覽,能夠快速了解行程安排。整體來看,Sol最為貼心。它的游玩行程具體到時間,在推薦美食時除了標出價格區間還附帶了門店推薦。此外,它還給出了景點的開放時間,建議游玩時間和不同愛好的游玩選擇。
GPT-5.6 Sol制作的出游規劃
這樣看來,三檔模型在信息密度上有較大差異,Luna夠用,Terra好用,Sol省心。
接下來,我們繼續看單檔模型的表現。輪到GPT-5.6 Terra,難度往上提一級,我們讓它做一個防曬衣的競品分析。
先說結論,GPT-5.6 Terra的結構性很強,習慣先拆解維度,再逐個填充。但內容深度明顯不夠,每個維度的分析基本都是點到為止,比如提到價格策略,不分析為什么這樣定價或這種策略在市場中的實際效果。
GPT-5.6 Terra制作的競品分析
最后來看GPT-5.6 Sol,既然它主推復雜推理和編程能力,我們就給它上了兩道強度不同的題。
場景一:經典邏輯推理題
我們給了它15個線索,讓它根據提示猜出5座房子中住著的不同國籍的人里,誰養的寵物是魚。
GPT-5.6 Sol***用列表逐條拆解線索,建立變量關系、逐步排除,推導過程完整可回溯,最終鎖定正確答案。
GPT-5.6 Sol的推理過程
場景二:3D網頁游戲開發
這才是能看出差距的地方。我們要求它做一個賽博朋克風格的《打工人求生指南》,包含無限延伸的網格地面、漂浮的發光文字等元素。GPT-5.6 Sol交付的游戲涵蓋了提到的全部要求:藍紫霓虹色調、多邊形風格、動態文字漂浮效果。主角需要接“大餅”獲取“精神值”,同時躲避Boss的攻擊,可玩性和趣味性都在線。
GPT-5.6 Sol制作的游戲
跑完三檔分層,可以得出一個結論:GPT-5.6 Luna適合低成本、高頻率的日常查詢場景;GPT-5.6 Terra是日常主力,能處理有一定結構要求的任務,但需要人工復核;Sol負責復雜推理和創意實現。
這也說明,選模型不再是越強越好的單選題,而是任務難度和成本之間的權衡。OpenAI這次的分檔策略,本質上是在回答一個問題:不同用戶、不同場景,需要用不同能力的模型。
02.GPT-5.6 Sol對打Fable 5,誰更好用?
既然Fable 5是Anthropic的單一旗艦,自然少不了要和GPT-5.6 Sol在一起比較。我們設計了四個場景,讓它們一較高下。
場景一:寫作
我們讓兩款模型分別做了今年高考全國I卷的作文題,談談自己對某一個詞語理解的變化。
GPT-5.6 Sol選了“自由”,走的是純議論路線。從童年把自由當任性寫起,推到自律帶來從容,再落到信息時代要獨立思考。結構比較工整,但全篇幾乎沒有具體事例,主要靠比喻支撐。
GPT-5.6 Sol寫的作文
Fable 5選了“英雄”,以敘事帶議論。開篇寫童年認知中的英雄得有披風鎧甲,轉折處用普通人的具體事例推進,最后落筆到自己身上。從“仰望英雄”到“看見英雄”再到“愿意成為英雄”,層層遞進。
Fable 5寫的作文
GPT-5.6 Sol偏向修辭驅動,結構穩定但素材單薄;Fable 5偏向素材驅動,敘事更具體、層次更豐富。
場景二:設計網頁
我們讓兩款模型分別設計一個簡約風的護膚品網頁。
GPT-5.6 Sol在簡約框架里塞進了更多東西,產品展示圖、護膚方法推薦,信息密度比Fable 5略勝一籌。
←左右滑動查看更多→
Slide for more photos
Fable 5交出來的東西,很“簡單”,交付的頁面只有產品索引、品牌信條、成分原則和消息訂閱四個板塊,信息密度偏低,用戶滑兩下就到頭了,內容缺少吸引力。
←左右滑動查看更多→
Slide for more photos
這局GPT-5.6 Sol對“簡約”理解更準確,Fable 5在這道題上減法做過頭了,簡約不等于簡陋。
場景三:商業分析
我們讓兩款模型為一個三人創業團隊做AI產品的商業分析,要求包含賽道選擇、產品方案、風險預判和Plan B。這道題沒有標準答案,它考的是AI能不能像一個真正的創業合伙人那樣思考。
有意思的是,兩個模型都沒有選通用助手、AI搜索這類大眾賽道,而是各自挑了一個相當垂直的切口。GPT-5.6 Sol選了AI職業試崗平臺,讓用戶投簡歷前先模擬一次真實工作;Fable 5選了備考督學搭子,做人工督學的平替。
GPT-5.6 Sol交付的內容更扎實:每條賽道都有相關數據,還附了一張25分制的評分表;產品方案給出了詳細的執行方向;風險預判部分給了完整的鏈條和清晰的預防方案。整體數據密度高,細節扎實。
←左右滑動查看更多→
Slide for more photos
Fable 5選的賽道更小眾,判斷主要靠推理,缺硬數據撐腰。它認為產品方案的亮點在價格便宜,但也正如它的分析,有可能沒人下載,用的人也留存不住。整體規劃的產品方向商業價值不大。
←左右滑動查看更多→
Slide for more photos
總體來看,這道題GPT-5.6 Sol略勝一籌,勝在數據密度、結構完整度和執行細節。
場景四:編程
最后一場,來看編程能力。我們設了兩道編程題,一道考視覺效果,一道考游戲可玩性。
第一題,我們讓它們實現雨絲觸底煙花爆炸的創意代碼動畫。兩款模型都跑通了,但細節上有差距。Fable 5還自作主張在畫布頂部加了一個標題,影響美觀,但煙花更大更明顯。缺點也是煙花太大,加上速度較快,會影響整體效果。
Fable 5制作的創意代碼動畫
GPT-5.6 Sol沒有多余元素,雨滴的下落角度和煙花爆炸的效果更自然,但不太能看出煙花的效果。
GPT-5.6 Sol制作的創意代碼動畫
第二題,我們讓它們做一個世界杯點球大戰的游戲。兩款模型的玩法相似,但Fable 5在交互細節上更豐富,支持選擇不同國籍和難度等級,GPT-5.6 Sol只能選難度。
Fable 5制作的游戲
不過Fable 5呈現的效果整體更簡單,GPT-5.6 Sol的進球后的慶祝特效更完整,還支持查看回放。這局,Fable 5更會設計玩法,GPT-5.6 Sol更會打磨細節。
GPT-5.6 Sol制作的游戲
四場打完,兩款模型呈現出了很不一樣的性格。GPT-5.6 Sol綜合完成度更高,Fable 5更聰明。GPT-5.6 Sol像個靠譜的乙方,結構清晰、數據扎實;Fable 5更像個聰明的搭檔,在洞察力和表達力上時不時讓你眼前一亮。
03.結語
回到最初的問題,GPT-5.6能不能追上Fable 5?
如果只看單點能力,兩家各有長處。寫作打平,設計、商業分析GPT-5.6略勝一籌,編程各有勝負。
但GPT-5.6的重心,可能從一開始就不是在所有能力上壓過Fable 5。它真正要解決的是另一個問題,當AI模型越來越強、調用越來越頻繁、企業需求越來越碎片化時,OpenAI如何把大模型能力變成一門能規模化運轉的生意。
這也是為什么GPT-5.6要以Sol、Terra、Luna三檔同時出場,GPT-5.6 Sol負責復雜推理和高價值任務;GPT-5.6 Terra用GPT-5.5一半的價格覆蓋日常辦公和輕量分析;GPT-5.6 Luna則以低價爭奪高頻調用市場。過去,所有用戶都擠在同一個最貴的模型上,越多人使用虧得越多。三層定價的本質,是讓不同價值的請求流向不同成本的模型。
分層定價是第一步,產品整合是第二步。
GPT-5.6發布當天,OpenAI同步上線了ChatGPT Work,它是支持連接外部工具的AI智能體。ChatGPT Work可以拆解復雜任務、自主執行數小時,產出成品。同一天,原本獨立運行的編程工具Codex也被正式并入ChatGPT桌面應用,與Chat、Work三欄并列。這套動作的意圖在于,把聊天、辦公、編程三條線收攏到一個入口,讓ChatGPT從問答工具變成“超級應用”。
這背后是OpenAI沉重的財務壓力。6月中旬,獨立博主Ed Zitron獲得的審計文件經《金融時報》獨立核實后曝光,OpenAI 2025年營收130.7億美元,總支出高達340億美元,其中研發支出191.8億美元,經營性虧損209.2億美元。據研究機構Sacra估算,虧損的大頭是推理成本,2025年推理支出84億美元,2026年預計攀升至141億美元。換算下來,OpenAI每天虧掉近6000萬美元。
同為海外“御三家”之一的Anthropic是OpenAI最直接的宿敵。在模型矩陣上,兩家最新旗艦級模型能力不相上下;在產品布局上,又存在智能體、編程、設計等產品的高度相似。此前,Anthropic發布的Fable 5因價格較高,受到一定質疑,6月末它馬上上線了中端模型Claude Sonnet 5,主打更低的價格帶來Opus級別的能力。在GPT-5.6上線的幾乎同一時間,Anthropic宣布將重置5小時和每周使用額度,企圖繼續分流用戶。
在激烈競爭之下,OpenAI除了卷模型,也得開始省錢了。GPT-5.6發布前,OpenAI官宣與博通合作的首顆自研推理芯片Jalape?o,從設計到流片只用了九個月。自研芯片的意義在于降低推理環節對通用GPU的依賴,省下租用算力的錢。
當然,省錢本質上還是為了給IPO鋪路。OpenAI已秘密提交招股書,高盛與摩根士丹利聯合輔導,一級市場估值8520億美元。但時間窗口并不寬裕,Anthropic已率先遞表,SpaceX已經先一步上市。
所以,GPT-5.6的真正任務,一方面是要證明OpenAI有能力把虧損增速放緩;另一方面它要用ChatGPT Work搶辦公場景,用Codex守住開發者,再用三檔定價攔截價格敏感型客戶,找回被Anthropic拿走的主動權。
*題圖由AI生成。
返回搜狐,查看更多








