在 Amazon SageMaker HyperPod 上用 SkyRL 加速多模态 RL 训练
这篇教程演示如何用开源 RL 框架 SkyRL 在 Amazon SageMaker HyperPod 上训练 Qwen3-VL-8B 视觉语言模型,通过 GRPO 算法学习导航视觉迷宫。
这篇教程演示如何用开源 RL 框架 SkyRL 在 Amazon SageMaker HyperPod 上训练 Qwen3-VL-8B 视觉语言模型,通过 GRPO 算法学习导航视觉迷宫。
NVIDIA 验证工程师 Sakeena Fiza 负责在量产前发现数据中心系统问题,团队曾见证 Rubin GPU 首次在系统层面成功枚举。验证工作覆盖从托盘到机架再到 AI 工厂的各环节,单板含数万个组件,机架接近 50 万个组件。她在实验室中排查高速信号、散热余量、电源完整性等各类故障,确保问题在客户遇到前被解决。