專案檔案
OAT
LLM 線上對齊訓練框架
GitHub Stars
652
方向
模型對齊
形態
訓練框架
- 機構
- Sea AI Lab (SAIL)
- 分組
- 國際企業實驗室
- 類別
- LLM 線上對齊框架
- 狀態
- 活躍維護
- 啟動
- 2024-10
- 語言 / 形態
- Python
- 協議
- Apache-2.0
- GitHub Stars
- 664
- 資訊更新
- 2026-05-04
OAT 是 Sea AI Lab 的 LLM 對齊訓練框架,面向強化學習、偏好學習等後訓練環節。
是什麼
OAT 是 Online Alignment Training 的縮寫。它把 LLM 後訓練裡常見的強化學習、偏好最佳化、線上取樣和評測流程封裝成研究友好的框架。
它不是面向普通使用者的產品,而是給模型研究和訓練團隊使用的工具。
與 AI 的關係
模型能力越來越取決於後訓練。預訓練決定基礎知識,SFT、RLHF、DPO、線上強化學習等流程決定模型是否聽話、穩定、有用。
OAT 的意義在於把這些複雜對齊實驗做成可複用工程框架。
與新加坡的關係
OAT 說明 Sea AI Lab 不只做區域語言模型,也在做模型訓練底層工具。這對新加坡本土科技公司參與基礎模型競爭很重要。
未來可以追蹤它是否被 Sailor 或其他 SAIL 模型訓練管線採用。
關鍵里程碑
- 2024-10OAT 倉庫建立