返回產學研開源生態 LLM 線上對齊框架 活躍維護

專案檔案

OAT

LLM 線上對齊訓練框架

GitHub Stars
652
方向
模型對齊
形態
訓練框架
機構
Sea AI Lab (SAIL)
分組
國際企業實驗室
類別
LLM 線上對齊框架
狀態
活躍維護
啟動
2024-10
語言 / 形態
Python
協議
Apache-2.0
GitHub Stars
664
資訊更新
2026-05-04

OAT 是 Sea AI Lab 的 LLM 對齊訓練框架,面向強化學習、偏好學習等後訓練環節。

是什麼

OAT 是 Online Alignment Training 的縮寫。它把 LLM 後訓練裡常見的強化學習、偏好最佳化、線上取樣和評測流程封裝成研究友好的框架。

它不是面向普通使用者的產品,而是給模型研究和訓練團隊使用的工具。

與 AI 的關係

模型能力越來越取決於後訓練。預訓練決定基礎知識,SFT、RLHF、DPO、線上強化學習等流程決定模型是否聽話、穩定、有用。

OAT 的意義在於把這些複雜對齊實驗做成可複用工程框架。

與新加坡的關係

OAT 說明 Sea AI Lab 不只做區域語言模型,也在做模型訓練底層工具。這對新加坡本土科技公司參與基礎模型競爭很重要。

未來可以追蹤它是否被 Sailor 或其他 SAIL 模型訓練管線採用。

關鍵里程碑

  1. 2024-10
    OAT 倉庫建立

資源入口

更多產學研專案