2026年7月22日02時00分標記本文 IT之家 月 日消息,科技媒體 T D 昨日( 月 日)發布博文,報道稱 GPT-. S 可自主後訓練較小的 L 模型,並在聚合 RSI 指數上比 GPT-....
IT之家 7 月 11 日訊息,科技媒體 The Decoder 昨日(7 月 10 日)釋出博文,報道稱 GPT-5.6 Sol 可自主後訓練較小的 Luna 模型,並在聚合 RSI 指數上比 GPT-5.5 高 16.2 個百分點。
IT之家注:後訓練是指模型完成初始預訓練後,圍繞特定任務、行為或能力繼續調整引數與配置的過程。

研究人員使用部分經過編輯的提示資訊來指導 GPT-5.6 Sol 對 Luna 進行後訓練。這些指令涵蓋了訓練配置、GPU 選擇、指令碼啟動和執行驗證。| 圖片:OpenAI
OpenAI 研究員 Kathy Shi 在演講中指出,後訓練通常情況下由高階研究團隊負責,而 GPT-5.6 Sol 可充當“自動化研究員”的角色,以基於自身後訓練路徑和配置為基礎,為 Luna 模型適配完整的後訓練方案。
OpenAI 稱,為直接衡量此類能力,公司建立了基於真實 AI 研究任務的內部評估套件“聚合 RSI”,任務包括除錯研究系統、最佳化 kernel 和訓練方案、執行機器學習實驗,以及改進另一模型。官方表示相關 GPT-5.5 模型,GPT-5.6 Sol 模型高出 16.2 個百分點。

OpenAI 還稱,研究人員在整個開發週期都會使用 GPT-5.6 Sol,包括除錯、最佳化訓練系統、執行實驗和閱讀結果(OpenAI)。在內部測試中,活躍研究員人均日 token 產出較 GPT-5.5 上一輪峰值翻倍以上,單個研究員的 pull request 和實驗數量也上升。