FlagOS 技术直播预告 | 字节 verl × FlagOS 社区共建:打通多元芯片强化训练链路
这个八月,字节接连扔出了两个“王炸”。
特斯拉中国车机正式上线豆包大模型,这是特斯拉进入中国市场以来,第一次在车机里集成第三方大模型
Seedance 2.5 封神,电影级叙事,把真人的动作神态“贴”到静态角色身上。媒体给出的评价是五个字:断崖式领先。
这些“强”,是从哪来的?
模型能力变强的背后,靠的都不是“把参数堆大”。模型能力提升的主引擎,已经从预训练转向了强化学习后训练(RL Post-Training)。模型不是“造”出来的,是“练”出来的:用 RL 逼着模型在海量任务里反复试错、反复打磨,才有了今天的响应速度、情绪理解、复杂动作编排。
但一个现实问题摆在面前:框架很强,芯片却是多元的。多元 AI 芯片份额已逼近 90%,可是想让 verl 跑在昇腾、寒武纪等多元芯片上,每一家都要啃一遍适配的硬骨头——重复造轮子,谁都很累。
于是有了我们这次要聊的主角:由 FlagOS 团队打造的 verl-hardware-plugin,多芯片插件平台。verl v0.9.0 官方发布了与 FlagOS 社区共建的插件仓库,提供六大芯片平台的参考实现,插件跟随 verl 主仓持续迭代。一句话:字节出框架,FlagOS 出插件,多元芯片是主角。
本次直播,我们深度拆解这套社区共建方案,带你看懂大模型强化学习的多芯片落地之路。
verl-hardware-plugin能做什么
-
给 verl 做硬件扩展,快速接入各类多元 AI 芯片
-
多元芯片完整跑通 GRPO / PPO 强化学习后训练
-
芯片专属性能注入,复用 verl 整套工程能力
-
降低多元芯片做 RL 后训练的门槛
观看直播你将获得:
-
看懂大模型 RL 的来龙去脉:学习如何解锁模型推理能力上限
-
解读字节开源 verl 框架核心架构:理解工业级 RL 后训练的设计思想
-
verl‑hardware‑plugin 插件平台:字节verl × FlagOS 社区共建模式,多芯片插件化设计思路
-
实战落地:基于 FlagOS,在多元芯片上完成 GRPO 训练的实践、踩坑与性能优化
直播时间
2026年8月27日晚 19:00-20:00
直播平台
智源 FlagOpen 视频号、FlagOS 智算系统软件栈CSDN-Devpress、FlagOS 小红书
直播福利
直播期间参与抽奖,将有机会获得 FlagOS 独家定制周边!
欢迎扫描下方二维码,加入【FlagOS 技术交流群】,获取一手 PPT 及学习资料。

豆包能上特斯拉,是因为背后有一整套训练体系;verl 快速适配多元芯片,是因为背后有 verl-hardware-plugin。
verl-hardware-plugin 到底怎么把六大芯片平台“插”进去?
多元芯片上跑通 GRPO,到底还差几步?
直播间,给你答案。
欢迎来到FlagOS开发社区,这里是一个汇聚了AI开发者、数据科学家、机器学习爱好者以及业界专家的活力平台。我们致力于成为业内领先的Triton技术交流与应用分享的殿堂,为推动人工智能技术的普及与深化应用贡献力量。
更多推荐




所有评论(0)