OpenAI近期正式發布三款全新架構的GPT-5.6系列大模型,並在統一升級的系統生態中上線了多步驟長文本智能體工具「ChatGPT Work」。行業分析人士指出,大模型研發機構正在加速將底層技術優勢轉化為高壁壘的商業垂直應用,而「推理算力投入」與單次調用成本的深度綁定,標誌着企業級AI應用正式步入精細化成本控制時代。
大模型發布數據顯示,本次上線的GPT-5.6系列共包含三款核心模型,分別定名為旗艦版「Sol」、平衡版「Terra」以及快速版「Luna」。在商業權限劃分上,旗艦模型Sol僅面向付費訂閱(Plus、Pro)及企業級用戶開放,不支持免費調用;Terra模型旨在平衡處理速度與計算效能,主要服務於免費群體及基礎付費用戶;Luna模型則完全針對高速響應場景進行了輕量化設計。
針對具體的應用場景重構,OpenAI工程領軍人物蒂博·索蒂奧(Thibault Sottiaux)明確表示,全新推出的ChatGPT Work智能體工具已全面打通桌面端與移動端生態,能夠直接調用掛載的外部應用程序與結構化文件,獨立執行研究檢索、數據分析、文檔編制、演示文稿製作以及網站構建等複雜的長流程工作流。索蒂奧強調,雖然新平台對非代碼開發者提供了更具性價比的辦公替代方案,但針對專業軟件開發者的Codex專屬獨立應用仍將獲得長期技術支持與迭代。
在行業定價及運行成本方面,技術演進正引發深層次的結構性變革。行業投研專家西蒙·威利森(Simon Willison)對GPT-5.6系列及競爭對手Anthropic旗下的核心大模型進行了基準成本測算。數據顯示,在不計入額外計算損耗的背景下,Luna模型每百萬輸入/輸出代幣(Tokens)的價格為1美元/6美元;Terra模型為2.50美元/15美元;旗艦模型Sol則達到5美元/30美元。這一價格水平與Anthropic旗下Claude Opus系列的5美元/25美元以及Claude Fable 5的10美元/50美元形成直接競爭。
威利森指出,隨着大模型全面引入可調節的「推理努力程度(Reasoning Effort)」機制,傳統的每代幣靜態定價模式已無法真實反映企業級用戶的實際資金消耗。在最新的Pelican基準測試中,由於用戶設定的推理思考深度及算力介入程度不同,執行完全相同的提示詞輸入,單次生成的財務賬單成本可從0.71美分暴漲至48.55美分,前後相差接近70倍。
對此,OpenAI官方策略團隊建議,企業及日常個人用戶在部署全新AI工作流時,應當首選具有最低推理設定的適用模型進行初步測試,隨後根據生成質量逐步提升推理算力級別,以此避免在算力瓶頸與調用限額內造成不必要的預算超支。主流科技智庫普遍認為,如何準確評估AI工具在具體應用場景中的「性價比拐點」,將成為下一階段企業實現數字化降本增效的核心痛點。
責任編輯:龍運翔