輕鬆神遊,指尖美景。

OpenAI稱GPT-5.6 Sol可化身研究員,後訓練Luna AI模型_研究人員_配置_實驗


2026年7月22日02時00分 收藏 標記本文 IT之家 月 日消息,科技媒體 T D 昨日( 月 日)發布博文,報道稱 GPT-. S 可自主後訓練較小的 L 模型,並在聚合 RSI 指數上比 GPT-....

- 2026年7月22日02時00分
-

IT之家 7 月 11 日訊息,科技媒體 The Decoder 昨日(7 月 10 日)釋出博文,報道稱 GPT-5.6 Sol 可自主後訓練較小的 Luna 模型,並在聚合 RSI 指數上比 GPT-5.5 高 16.2 個百分點。

IT之家注:後訓練是指模型完成初始預訓練後,圍繞特定任務、行為或能力繼續調整引數與配置的過程。

研究人員使用部分經過編輯的提示資訊來指導 GPT-5.6 Sol 對 Luna 進行後訓練。這些指令涵蓋了訓練配置、GPU 選擇、指令碼啟動和執行驗證。| 圖片:OpenAI

OpenAI 研究員 Kathy Shi 在演講中指出,後訓練通常情況下由高階研究團隊負責,而 GPT-5.6 Sol 可充當“自動化研究員”的角色,以基於自身後訓練路徑和配置為基礎,為 Luna 模型適配完整的後訓練方案。

OpenAI 稱,為直接衡量此類能力,公司建立了基於真實 AI 研究任務的內部評估套件“聚合 RSI”,任務包括除錯研究系統、最佳化 kernel 和訓練方案、執行機器學習實驗,以及改進另一模型。官方表示相關 GPT-5.5 模型,GPT-5.6 Sol 模型高出 16.2 個百分點。



OpenAI 還稱,研究人員在整個開發週期都會使用 GPT-5.6 Sol,包括除錯、最佳化訓練系統、執行實驗和閱讀結果(OpenAI)。在內部測試中,活躍研究員人均日 token 產出較 GPT-5.5 上一輪峰值翻倍以上,單個研究員的 pull request 和實驗數量也上升。


延伸閱讀

大資料創新應用突破行動|海陽市:搭建智慧旅遊平臺

廣東這個海濱城市風光出眾、美食聞名,旅遊熱度不輸

昌都市2021年全市旅遊市場監管執法培訓班順利開

粵港澳大灣區腳踏車聯賽響鑼,打造“騎行+旅遊”新

崇左市政協聯合市文旅局、市大資料局前往貴港、玉林


熱門內容

熱門內容

友善連結