最新活动

实时了解FlagOS智算系统软件栈的直播活动与盛典

状态
2026年
9月24日
已结束
200 万奖池 FlagOS 赛题拆题 × 量化工具一次讲透
200 万奖池 FlagOS 赛题拆题 × 量化工具一次讲透
直播简介 FlagOS 全球开放计算大赛赛季二赛道二的题到底考什么?怎么答才能拿高分? 别猜了,这期直播把答案直接送到你面前 第一样:出题人的 "考点量化" FlagOS 开放计算全球大赛(赛季二)赛道二出题专家亲自下场,拆解赛题设计逻辑:推理吞吐优化的得分点藏在哪些维度?并行策略、显存管理、计算内核、采样算法 —— 哪些是真考点、哪些是送分题?答题技巧一次讲透,让你少走弯路、
2026-09-24 19:00
查看回放
9月10日
已结束
FlagOS算子赏金挑战赛冠军第一视角:算子开发这么玩才能赢
热门 FlagOS算子赏金挑战赛冠军第一视角:算子开发这么玩才能赢
FlagOS算子赏金挑战赛获奖选手分享会 本周四,算子开发大赛获奖选手将空降直播间,带来一场 "干货 + 走心" 的分享:  获奖感言:听冠军讲述从参赛到夺冠的心路历程  参赛经验:复盘比赛关键决策、踩过的坑和避坑方法  开发技巧:冠军们把压箱底的实战技巧一次讲透  互动答疑:观众现场提问,与获奖选手直接交流 无论你是参赛选手、算子开发从业者,还是对高性能计算感兴趣的学
2026-09-10 19:00
查看回放
9月7日
已结束
开放 AI 计算:面向多元异构硬件打造开源软件新生态论坛
开放 AI 计算:面向多元异构硬件打造开源软件新生态论坛
2026 年 9 月 7 日下午,由众智 FlagOS 社区 主办的《开放 AI 计算:面向多元异构硬件打造开源软件新生态》论坛,将在上海 KubeCon + CloudNativeCon + OpenInfra Summit + PyTorch Conference China 大会同场举办。届时,来自北京智源人工智能研究院、上海人工智能实验室、 PyTorch 基金会、SGLang
2026-09-07 13:00
查看回放
9月3日
已结束
“算子岛”争夺战开启:SGLang框架算子多芯性能优化
热门 “算子岛”争夺战开启:SGLang框架算子多芯性能优化
SGLang 跨芯片算子优化赛・赛道一 众智 FlagOS × IEEE 联合主办,SGLang 协办,全球 AI 系统开发者都能参加: 200+ 道真实推理算子题,自由选题、分批开放用 Triton / Triton-TLE 开发,不用重造轮子多款芯片平台统一验证、统一测加速比实时排行榜,提交就能刷新排名,上不封顶「攻克」「攻占」荣誉机制,外加全域攻占奖、攻克突破奖、单题极致性能奖三大奖项 还不
2026-09-03 13:00
查看回放
8月27日
已结束
verl×FlagOS 社区共建:打通多元芯片强化训练链路
热门 verl×FlagOS 社区共建:打通多元芯片强化训练链路
这个八月,字节接连扔出了两个“王炸”。 特斯拉中国车机正式上线豆包大模型,这是特斯拉入华以来,第一次在车机里集成第三方大模型 Seedance 2.5 封神,电影级叙事,把真人的动作神态"贴"到静态角色身上。媒体给出的评价是五个字:断崖式领先。   这些“强”,是从哪来的? 模型能力变强的背后,靠的都不是“把参数堆大”。模型能力提升的主引擎,已经从预训练转向了强化学习
2026-08-27 19:00
查看回放
8月20日
已结束
一套算子跑通多芯片?看KernelGen 如何实现算子调优
一套算子跑通多芯片?看KernelGen 如何实现算子调优
电影《欢迎来龙餐馆》正火爆上映,沈腾饰演的中餐厨师远赴中东,兼容各方来客的内核,用“中国味征服世界胃” 而在 AI 计算的世界里,我们同样期待一位 “大厨”,可以接待不同架构的芯片 “食客”,不用为每一类硬件重复 “从头做菜”。 当 AI 计算平台从单一 GPU 走向 Nvidia、NPU 、GPGPU、DSA、RISC-V、ARM 等多芯片生态,算子开发正面临架构差异大、工具链割裂和调优成本高的
2026-08-20 19:00
查看回放
8月13日
已结束
Torch-FL:终结多元芯片的PyTorch碎片化噩梦
Torch-FL:终结多元芯片的PyTorch碎片化噩梦
大模型产业化落地全速推进,多元AI芯片迎来爆发式增长,各类自主可控算力硬件全面铺开,成为AI科研创新、产业落地的核心支撑。 但繁荣的背面,一个老问题始终横在开发者面前: 每换一块芯片,就要换一套PyTorch插件,重写一遍适配代码。 这不是简单的"换个驱动"那么轻松。 碎片化适配地狱: A厂商的算子接口和B厂商完全不同,同一份模型代码要在N个平台上各跑一遍适配。一个模型,N份代
2026-08-13 19:00
查看回放
8月6日
已结束
别再盲目调优算子!细粒度设备侧 profiling 实战来了
别再盲目调优算子!细粒度设备侧 profiling 实战来了
日常模型开发中,我们依赖的常规 Python 调试手段,仅能覆盖上层代码逻辑,根本无法穿透到设备侧,获取真实、细粒度的运行时数据。 一方面,性能调优无依据:无法精准定位 Kernel 内部各操作的耗时节点,优化只能靠经验、靠猜测,低效且盲目; 另一方面,数值 bug 难溯源:算子计算出现数值异常时,无法追溯中间计算步骤,排查耗时翻倍,问题反复复现。 更棘手的是,各芯片厂商设备接口不统一、功能支持参
2026-08-06 19:00
查看回放
7月23日
已结束
72小时算子挑战赛对决收官!获奖选手复盘制胜秘诀
72小时算子挑战赛对决收官!获奖选手复盘制胜秘诀
72小时算子挑战赛对决收官!获奖选手复盘制胜秘诀
2026-07-23 19:00
查看回放
7月18日
已结束
Star 破 12万!llama.cpp主创拆解项目崛起之路
Star 破 12万!llama.cpp主创拆解项目崛起之路
2023 年,一个仅用 C/C++ 编写的开源项目横空出世,彻底打破了“只有大厂显卡集群才能跑大模型”的垄断。 它就是 llama.cpp。如今,它在 GitHub 上斩获了近 12 万 Star,从个人电脑、手机、开发板甚至浏览器,它成为了全球 Local AI 生态中最坚实的底层推理引擎。 就在今年 2 月,GGML/llama.cpp 创始团队正式加入 Hugging Face,这一重磅信号
2026-07-18 15:30
查看回放