AWS Machine Learning Blog· Nilesh PS·· 5 天前AI 评分38
在 Amazon SageMaker HyperPod 上使用 SkyRL 加速多模态强化学习训练
Accelerate multimodal RL training with SkyRL on Amazon SageMaker HyperPod
AI 导读
在 Amazon SageMaker HyperPod 上利用开源 RL 框架 SkyRL 与 GRPO 算法训练 Qwen3-VL-8B,可将 64 迷宫评估集的解决率从 43.75% 提升至 95% 以上。
来源:AWS Machine Learning Blog · aws.amazon.com