ツール一覧に戻る

SkyRL

LLM エージェント訓練のためのフルスタック RL ライブラリ。非同期ロールアウトとシングル GPU 対応で効率的な多段ツール対話訓練を実現。

ツールカテゴリ
開発者ツールモデル
ツールリンク

ツール概要

カリフォルニア大学バークレー校 Sky ラボが開発した SkyRL は、VeRL と OpenHands を基盤に、長期ツール使用タスク向けの強化学習パイプラインを提供します。最大の特徴はロールアウトを非同期サービスとして分離し、I/O 処理と GPU 最適化を切り離すことで、訓練速度を 1.55 倍に向上させた点です。これにより、SWE-Bench Verified で Qwen3-32B の Pass@1 が 24.4% から 39.4% に向上し、コストも半分以下になりました。バックエンド非依存設計で SkyRL-train / VeRL / Tinker を切り替え可能で、訓練と推論の共存により単一 GPU での RL 訓練も実現します。一方で、一部の実験では改善が限定的であり、使用者には強化学習とコードエージェント領域の知識が求められます。オープンソースで無償ですが、GPU が必要です。研究目的のエージェント RL に適し、初心者や本番環境には不向きです。

関連ソーシャルコンテンツ