搜索
FlagOS智算系统软件栈
https://flagos.csdn.net
成员
欢迎来到FlagOS开发社区,这里是一个汇聚了AI开发者、数据科学家、机器学习爱好者以及业界专家的活力平台。我们致力于成为业内领先的Triton技术交流与应用分享的殿堂,为推动人工智能技术的普及与深化应用贡献力量。
开发者学堂
查看更多
Triton-TLE:不烧脑,也能写出高性能 SparseMLA
本期视频围绕「Triton-TLE:不烧脑,也能写出高性能 SparseMLA」展开,聚焦相关技术思路、实践路径与产业价值,带你快速了解 AI 系统与开放计算领域的前沿进展。 ● Website: https://flagos.io ● GitHub: https://github.com/flagos-ai ● GitCode: https://gitcode.com/flagos-ai ● SkillHub: https://skillhub.flagos.io
FlagOS 在 Arm64 CPU 上的使能与性能优化:基于 TritonTLE 的端侧 AI 实践
本期视频围绕「FlagOS 在 Arm64 CPU 上的使能与性能优化:基于 TritonTLE 的端侧 AI 实践」展开,聚焦相关技术思路、实践路径与产业价值,带你快速了解 AI 系统与开放计算领域的前沿进展。
从算子全覆盖到性能突破:FlagOS 如何打通大模型推理优化最后一公里
本期视频围绕「从算子全覆盖到性能突破:FlagOS 如何打通大模型推理优化最后一公里」展开,聚焦相关技术思路、实践路径与产业价值,带你快速了解 AI 系统与开放计算领域的前沿进展。
热门直播
查看更多
回放中
别再盲目调优算子!细粒度设备侧 profiling 实战来了
日常模型开发中,我们依赖的常规 Python 调试手段,仅能覆盖上层代码逻辑,根本无法穿透到设备侧,获取真实、细粒度的运行时数据。 一方面,性能调优无依据:无法精准定位 Kernel 内部各操作的耗时节点,优化只能靠经验、靠猜测,低效且盲目; 另一方面,数值 bug 难溯源:算子计算出现数值异常时,无法追溯中间计算步骤,排查耗时翻倍,问题反复复现。 更棘手的是,各芯片厂商设备接口不统一、功能支持参
回放中
72小时算子挑战赛对决收官!获奖选手复盘制胜秘诀
72小时算子挑战赛对决收官!获奖选手复盘制胜秘诀
回放中
72 小时极限对决!FlagOS算子赏金挑战赛登陆 WAIC
2026 世界人工智能大会(WAIC)举办期间,由众智 FlagOS 社区与智谱联合主办的FlagOS 72 小时算子赏金挑战赛(上海站)正式启动全球招募。赛事聚焦 AI 底层高性能算子工程优化,以真实大模型线上业务场景命题,面向全球 AI 系统、计算优化领域开发者开放线上参赛通道。 FlagOS 赛事专场技术直播将于 2026 年 7 月 16 日(周四)19:00 在智源 FlagOpen 视









