跳到正文
原文
AWS Machine Learning Blog· Nilesh PS·· 5 天前AI 评分38

在 Amazon SageMaker HyperPod 上使用 SkyRL 加速多模态强化学习训练

Accelerate multimodal RL training with SkyRL on Amazon SageMaker HyperPod

AI 导读

在 Amazon SageMaker HyperPod 上利用开源 RL 框架 SkyRL 与 GRPO 算法训练 Qwen3-VL-8B,可将 64 迷宫评估集的解决率从 43.75% 提升至 95% 以上。

来源:AWS Machine Learning Blog · aws.amazon.com