回首頁 / 🧱 AI 基礎堆疊 / 🤖 Agent 框架/編排

walkinglabs/hands-on-modern-rl

從基本RL概念到LLM對齊的手動實踐教程。

🧱 AI 基礎堆疊 授權未明 ★ 3,322Python

為何上榜

近一日新增 3★(現 3,322★)

商用授權

授權未明NOASSERTION

未標示授權 — 商用前務必確認(預設視為保留所有權利)

Topics

agentagenticagentic-aiagentic-rldpogrpollmllm-alignmentpytorchreinforcemenrlhftutorial
廣告