FlagOS X SGLang 算子优化挑战赛来了!200+ 真实推理算子,多芯片同台竞技
大模型推理规模化落地的背后,高性能算子是降低推理时延、提升吞吐、释放异构 AI 芯片算力潜能的核心底座。面对架构各异的多款 AI 芯片,如何写出跨芯片、高性能、可落地的算子,已经成为 AI 系统开发者必须攻克的硬核难题。
现在,FlagOS 开放计算全球大赛(赛季二)正式开赛!赛道一为 SGLang 框架算子在多款芯片的性能优化赛道。本赛道由众智 FlagOS 联合 IEEE 主办、SGLang 协办,联合沐曦股份、超算互联网、昆仑芯等产业伙伴,面向全球开发者发起算子优化攻坚挑战。200+ 道真实 SGLang 推理算子赛题陆续解锁,丰厚奖金、开源荣誉、技术交流机会全部就位,无论你是高校技术极客、企业研发工程师,还是开源社区资深贡献者,这里都有一方属于你的战场。

01 这场挑战赛,究竟有多硬核?
算子高地争夺战!游戏化闯关,直面真实推理场景
本次大赛创新性引入算子高地争夺游戏化机制,把每一道算子赛题化作一座技术高地。平台配备可视化作战地图,所有赛题实时展示“待攻克”、“竞争中”、“评审中”、“已攻占”赛题状态,全局战局一目了然。
200+ 真实产业算子分批次解锁开放挑战,全部赛题取自 SGLang 真实推理业务,覆盖通用算子、融合算子、模型专用算子。每一轮代码提交都可以刷新实时榜单,你可以持续迭代打磨性能,随时实现反超夺旗。首个跨过性能门槛的团队拿下攻克荣誉;在激烈竞争中拿下批次平均加速比第一名,即可斩获攻占荣誉,占领这座算子高地!
大赛统一采用 Triton/Triton‑TLE 作为开发语言,基于 SGLang 推理框架提供的真实算子题库,打造面向多芯片平台的持续挑战赛。

多芯片统一评测,跨平台适配能力大考
你的代码将在多款 AI 芯片上经历统一评测,以多芯片平均加速比作为核心排名指标,榜单实时更新。跨芯片通用代码 [Kernel Name].py 是保证全芯片评测的兜底依据,亦可为特定芯片提交专用优化版本 [Kernel Name]_[gpu].py,自动化评测系统将优先匹配特化版本。
参赛选手提交的代码须通过正确性测试,只有通过正确性测试才能参与性能加速比测试;未通过正确性测试的代码提交判定为无效提交。具体规则请参考比赛官网信息。
三大专项奖项,全方位考察综合实力
赛事设置全域攻占奖、攻克突破奖、极致性能奖三大奖项,分别比拼算子攻占总量、率先攻克能力、单算子极致优化。每一道赛题都设有独立的单题极致性能奖,最高万元现金奖励,配套官方证书、定制周边。优秀算子代码将提交 GitHub 开源仓库,沉淀为社区可复用的生产级算子成果,你的代码将服务于真实大模型推理生态。
全球开放,线上团队参赛
本次比赛不限国籍、学历、年龄,企业、高校、科研院所开发者均可组队参赛,每支队伍最多 5 人,足不出户即可参与多芯片硬核技术竞技。
02 关键赛程

-
报名时间:2026 年 7 月 17 日 - 11 月 13 日
-
报名入口:https://flagos.io/Register?raceId=8q4m2x7p
* 必须通过官网完成报名,方可参与评审评奖;团队名称仅支持英文 + 数字,有品牌字段命名限制,请仔细阅读报名规范。
-
竞赛开发阶段:2026 年 8 月 17 日 - 11 月 13 日。200+ 道赛题分 13 个批次陆续释放,第 1 批为适应小周期,后续每批次标准竞赛周期 7 天。每批次开放周期内可反复迭代提交。
* 提交限制:比赛期间,每个参赛团队每日最多可提交 15 次代码(面向当前批次所有赛题共享);团队开发者资源账号绑定达到要求后可提升至 30次。两次提交间大于 2分钟。具体详情请关注比赛页面的赛制赛规(https://flagos.io/race-detail-season2?id=782kzq4m)
-
专家评审 & GitHub PR 提交:每批次竞赛结束后依次开展评审;拿到「攻占」荣誉的团队需要在规定窗口期将最优算子代码提交至 FlagGems‑sglang GitHub 仓库,签署 CLA 协议,代码一致性将作为评奖必要条件,逾期将取消对应荣誉与评奖资格。
-
最终奖项评审:2026 年 11 月 13 日结束后一个月内完成全部奖项验收与评选。
03 参赛开发与提交要点
1. 开发语言:算子代码必须基于 Triton / Triton‑TLE 实现,任何形式的抄袭、Benchmark 操纵、规避规则、非法提交等行为均将导致资格取消。
2. 提交地址:参赛团队需要到 flagos.io 页面「提交入口」提交算子代码,提交限制请查看"开发规范-迭代提交"。
3. 提交包格式:zip 压缩包,包含跨芯片通用算子 [Kernel Name].py;可选补充芯片特化版本[Kernel Name]_[gpu].py。通用 py 文件为兜底必备文件,缺失将造成部分芯片无法评测。
4. 评分逻辑:先过正确性测试;再校验性能门槛(全部芯片加速比≥0.1);有效提交按照多芯片平均加速比排序;成绩相同时,更早提交的团队排名靠前。
5. 开源 PR 规范:攻占团队需将最优代码提交 PR 至官方仓库,PR 命名格式:[FlagOS Competition‑Track1] Add [Kernel Name] Triton Kernel for sglang,目录结构严格遵循赛事文档要求,代码必须与平台提交版本完全一致。
目前,本次大赛的赛道一已正式开启,可前往大赛官网查看更多内容。
算子是大模型推理的 “微观引擎”,异构多芯也是算力行业的重要趋势。本次比赛希望以真实业务赛题为载体,汇聚全球开发者的力量,沉淀一批可复现、可迁移、可落地的高性能算子。无论你是高校底层方向学生、企业 AI 系统工程师、开源社区 Triton 爱好者,都欢迎组队参与。在这里,你的每一行 Kernel 代码,都将成为开放算力生态的一块基石。
💡如何获取帮助
-
赛事咨询邮箱:contact@flagos.io
-
飞书交流群、Discord 交流群,扫码进群获取赛题答疑、技术交流、官方通知。

-
赛题查阅地址:
https://flagos.io/events?tab=competition
-
GitHub 仓库地址:
https://github.com/flagos‑ai/FlagGems‑sglang/pulls
欢迎来到FlagOS开发社区,这里是一个汇聚了AI开发者、数据科学家、机器学习爱好者以及业界专家的活力平台。我们致力于成为业内领先的Triton技术交流与应用分享的殿堂,为推动人工智能技术的普及与深化应用贡献力量。
更多推荐




所有评论(0)