FlagOS 每日动态报告(2026-09-23)
调研窗口:2026-09-22 10:00 ~ 2026-09-23 10:00(约 24 小时;承接 09-22 日报窗口,无空档) 信源:GitHub(org: flagos-ai,54 仓库 pushed_at 全量核查,窗口内 24 个仓库有推送;提交搜索命中 143 条,跨 14 个仓库;Release Info 门户与 community 清单逐页核对)、Google News RSS(中英文 24 组查询词,走代理)、AICC2026 大会官网与报道(光明网 / 新京报 / CBISMB)、2026 云栖大会报道(观点网 / 每日经济新闻 / 东方财富 / 阿里云开发者社区)、龙芯中科发布(IT之家 / 快科技)等(详见附录信源清单)
本期索引
- 今日重点:距 2.2 GA(09-28)5 天——发布清单落库、Release Info 门户重建、Megatron 应用镜像 2.2.0-0.2.3 覆盖 14 个后端行(09-22/09-23)
- 一、开源项目进展(GitHub 动态)
- 1.1 发布工程补充:FlagCX wheel 通道推进至昆仑芯与全部行,deb/rpm 覆盖每个打包组件(09-22/09-23)
- 1.2 FlagQuantum:单窗口 38 笔——云端 QPU 脚手架、三大框架互通、仿真融合加速(09-22)
- 1.3 FlagGems:KernelGen 再补 15 枚 Nvidia 算子;六平台修复与优化密集合入(09-22/09-23)
- 1.4 FlagGems-vllm:昇腾 XCS 新算子合入;摩尔线程 / 海光 / 沐曦三条在审转合入(09-22/09-23)
- 1.5 Torch-FL:11 笔收敛——DCU 与昇腾修复、构建矩阵统一、退役代码清理(09-22/09-23)
- 1.6 其余动态:FlagCX 传输加固、FlagSparse 三后端推进、TransformerEngine-FL NPU 后端、FlagTree PPU CI(09-22/09-23)
- 二、新闻报道与生态
- 2.1 AICC2026 在京举行:FlagOS 两场演讲与「可靠AI」测评体系启动(09-21/09-22)
- 2.2 云栖大会:达摩院玄铁发布真武 V900——FlagOS 支持平台 PPU 迎来新一代硬件(09-22)
- 2.3 国产算力软件栈动态:龙芯加速计算平台首个版本发布;数贸会今日开幕(09-22/09-23)
- 2.4 组件级检索连续第十八个平静窗口(09-22/09-23)
- 三、成员单位深挖
- 3.1 海光:DCU 索引边界修复与 INT8 块状 BMM 合入(09-22/09-23)
- 3.2 摩尔线程:W8A8 变长注意力量化支持合入;AICC2026 演讲与「可靠AI」参与(09-22)
- 3.3 沐曦:融合逆 RoPE 量化算子合入;topk W8A16 优化与 MACA FFT 默认策略(09-22)
- 3.4 昇腾:算子批与测试镜像更新;TransformerEngine-FL NPU 后端实现(09-22/09-23)
- 3.5 天数智芯:Iluvatar wheel 22.04 重建线与容器行登记(09-22/09-23)
- 3.6 燧原:多行镜像登记与 sglang 应用行(09-22/09-23)
- 3.7 清微智能:AICC2026 议程与运行时行(09-22)
- 3.8 达摩院玄铁:真武 V900 与 PPU CI 收口(09-22/09-23)
- 四、总结与趋势观察
- 附录:信源核查表
- 完整信源清单
今日重点:距 2.2 GA(09-28)5 天——发布清单落库、Release Info 门户重建、Megatron 应用镜像覆盖 14 个后端行
日期:2026-09-22 ~ 2026-09-23 来源:community #111、release-2.2.yaml、Release Info 门户、build-infra #1019 至 #1034
按社区 2.2 发布追踪(#47)的官方排期,rc2 稳定期 09-24 截止(之后仅接受 hotfix),GA Go/No-Go 定于 09-28。本窗口恰处收口期,发布工程一日三线推进:
其一,官方发布清单开始落库。09-23 00:11 合入 community #111:新增 release/2.2/release-2.2.yaml——它是 FlagOS 2.2 的官方发布源清单(vcstool 格式,供 vcs import 一次性拉取全部组件源码)。清单首条目为 sglang-plugin-fl v0.2.0(官方标签打在该模块通过最终 rc2 验证的提交上,分支 0.2.0-rc2,HEAD 1c84db7)。文件头注明了版本规范:官方标签一律裸版本号(无 rc/post 后缀),FlagTree 例外、保留上游本地版本格式(如 0.7.0+triton3.6);结构上按 L2「框架适配层」等分层组织,后续组件将逐批补入。
其二,应用镜像登记推进到 14 个后端行。build-infra 本窗口 33 笔提交中,Megatron-LM-FL 应用镜像标签 2.2.0-0.2.3 在 14 个平台行集中登记(nvidia-cuda12.8 / cuda13.3、ascend-cann8.5.0 / cann9.0.0、cambricon-neuware4.4.3 / 4.7.2、enflame-tops1.9.10 / 1.10.6、hygon-dtk26.04、iluvatar-corex4.4.0 / 4.5.0、metax-maca3.8.1.3、mthreads-musa4.3.6 / 5.2.0,对应 #1019 至 #1033);配套修正两笔:构建步骤直接读取锁定的 wheel 版本(#1018)、精确锁定安装版本并补齐两个未构建行(#1017)。同期登记的还有 vLLM 昆仑芯应用镜像 2.2.0-0.3.0rc2.post2(#1012 / #1013,配套授权重建 #1010)。
其三,Release Info 门户重建。09-23 06:38 ~ 06:44,发布信息仓库 gh-pages 分支连续 13 次推送、重建 Hugo 门户(flagos-ai.github.io/release-info)。门户按「厂商 / 基础镜像(base)/ 运行时镜像(runtime)/ 应用镜像(application)」四层组织,覆盖 20 个平台行的 base 与 runtime 镜像,以及 vLLM(0.20.2 / 0.24.0 两套矩阵)、Megatron(training / rl)、sglang 0.5.18 应用镜像;以 Megatron 的 nvidia-cuda12.8 行页面为例,已可见 harbor.baai.ac.cn/flagos-app/megatron_training0.17.1-nvidia-cuda12.8:2.2.0-0.2.3 与 flagos-runtime-nvidia-cuda12.8:2.2.0 的完整拉取说明。镜像登记、门户发布、清单落库三条线在本窗口首次同日对齐,2.2 发布物开始对外可见。
版本分支侧同步推进:FlagTree 0.7.0-rc2-triton3.6(09-23 09:36 推送)、vllm-plugin-FL 0.3.0-rc2(09-22 23:20,#549)、FlagScale 2.1.0-rc2(09-23 08:43,#1301 从 main 摘取)、sglang-plugin-FL 0.2.0-rc2(v0.2.0 已打标签)。
一、开源项目进展(GitHub 动态)
窗口总览:org 内 54 个仓库中 24 个在窗口有推送;提交搜索命中 143 条(跨 14 个仓库),另有 release-info(gh-pages)、FlagScale、vllm-plugin-FL、FlagTree、docs、sglang-plugin-FL 等分支侧推送未计入搜索。分布为:FlagQuantum 38、build-infra 33、FlagGems 28、Torch-FL 11、FlagSparse 10、FlagGems-vllm 6、FlagFFT 4、FlagCX 3、FlagTree 2、FlagAttention 2、FlagBLAS 2、whisper-triton 2、community 1、FlagGems-Experimental 1。
本窗口形态 = 「2.2 发布收口」+「量子栈大爆发」+「多平台修复密集」:发布工程详见「今日重点」;FlagQuantum 以 38 笔成为单仓最活跃项目;FlagGems / FlagGems-vllm / Torch-FL 三仓同时进入「修复 + 调优」节奏。
1.1 发布工程补充:FlagCX wheel 通道推进至昆仑芯与全部行,deb/rpm 覆盖每个打包组件(09-22/09-23)
日期:2026-09-22 ~ 2026-09-23 来源:build-infra #1000、#1002、#1007、#1008、#1014
- FlagCX wheel 分发线:昆仑芯 wheel 落地(#1000,承接昨日报「在审」条目);wheel 通道在其余八行全部开启(#1002);各行 pin 从 ref 自动推导(#1007)、每次下发必须带 wheel ref(#1006)、按行记录已发布 pin 与「wheel 与 torch 的绑定关系」文档(#1005 / #1016);发布容器继承节点代理(#1015)。逐后端预编译 wheel 的分发形态从「试点行」扩到「全行 + 流水线固化」。
- 原生包覆盖:每个打包组件获得进入仓库的路径(#1001),deb 与 rpm 覆盖率补齐(#1008)——与 FEP-0019(统一打包集成,Wave 1 已含 FlagCX / FlagTree / FlagSparse / FlagAttention 四仓合入)的验收线一致。
- FlagTree Iluvatar wheel 在 Ubuntu 22.04 上重建并发布构建器(#1014,天数线)。
- 另有两笔文档清理:撤销跨编译器
flag_gemsConfigCache 污染的说法(#1034)、退役 metax 的 flagtree 降级依据(#1020)。
1.2 FlagQuantum:单窗口 38 笔——云端 QPU 脚手架、三大框架互通、仿真融合加速(09-22)
日期:2026-09-22 来源:FlagQuantum #135、#154、#138、#168、#167
FlagQuantum(FlagOS 生态的 PyTorch 优先量子 AI 框架)单窗口 38 笔,四条线并行:
- 云端 QPU 执行:新增 Azure Quantum QPU 执行脚手架(#168)——继上月 Braket / CUDA-Q 之后的又一条云后端线。
- 跨框架互通:Amazon Braket 电路适配器实现(#154,配套契约 #147)、Cirq 电路转换(#135)与符号参数契约(#166 / #170)、CUDA-Q 内核导出(#138,修复有限角 IR 校验 #145)、跨框架能力差距跟踪(#164)、跨框架电路语义认证测试(#160)。
- 仿真性能:CPU 态矢量门加速(#142)、尾部双比特门加速(#143)、跨线对角区域融合(#146)、双线对角匹配融合(#153)、单线门层融合(#157 / #159 / #165)、混合宽度区域融合(#169),以及可选开关的矢量化轨迹行采样器(#132)与路径分解 CPU 泳道 + 差分内核网基准(#128)。
- 验证线(regional twin):电路套件校验(#123)、留出集验证(#141)、历史与评估持久化(#137 / #144 / #152 / #163)、漂移对齐(#155)、以留出证据为门禁(#162)、发布通过验证的候选(#167)。
- CI:跨可选 SDK 版本复用 runner(#158)、braket 覆盖泳道(#161)、CPU 测试并行化(#149)、去重复套件(#150 / #156)、队列瓶颈清理(#148)。
1.3 FlagGems:KernelGen 再补 15 枚 Nvidia 算子;六平台修复与优化密集合入(09-22/09-23)
日期:2026-09-22 ~ 2026-09-23 来源:FlagGems #5245、#5845、#6531、#6339、#5063
- KernelGen(Nvidia)15 枚:orgqr(#5845)、trapz(#5927)、matrix_power(#5735)、matmul_backward(#5639)、_pad_packed_sequence(#5245)、_scaled_dot_product_attention_math_for_mps(#5259)、_nested_tensor_softmax_with_shape(#5693)、_nested_tensor_from_mask(#5691)、_sample_dirichlet(#5946)、_ctc_loss(#5489)、_batch_norm_with_update(#5828)、_cudnn_rnn(#5823)、_transform_bias_rescale_qkv(#6141)、_spdiags(#6102)、vander(#5945)——自动生成管线继续批量补充长尾算子。
- NVIDIA 质量线:恢复 scaled MM 的原生 FP8 WGMMA(#6531)。
- 海光:修复
index_reduce_在昇腾 / 天数 / 沐曦三平台的问题(#5063,SiliconFlow 贡献)。 - 沐曦:合入并优化
topk_w8a16_fp8算子(#6339)。 - 昇腾:cat/concat 派发与实现改进(#6548)、
rrelu_with_noise实现(#6534,KMCompiler 线)、nonzero_static基准改用算子模式(#6571)、910B 周测镜像更新(#6590)。 - 量化与通用:动态 W4A8 矩阵乘与可移植 4 位打包验证(#6494)、block diag 合入(#6555)、
vector_norm负阶有限值掩码修复(#5883)。
1.4 FlagGems-vllm:昇腾 XCS 新算子合入;摩尔线程 / 海光 / 沐曦三条在审转合入(09-22/09-23)
日期:2026-09-22 ~ 2026-09-23 来源:FlagGems-vllm #817、#823、#803、#826
- 昇腾 XCS:KV 池状态压缩(kpool)Triton 算子合入(#817,09-23 09:22),延续 XCS 算子批的推进节奏。
- 三条在审转合入:摩尔线程变长注意力 W8A8 FP8(#823)、海光 INT8 块状 BMM 与 INT8 einsum 收缩(#803)、沐曦融合逆 RoPE FP8 量化(#826)——三条均为此前日报「在审池」条目,本窗口集中落地。
- 工程修复:TLE 路径按所需能力门控(#833)、测试依赖不再升级既有 numpy(#832)。
1.5 Torch-FL:11 笔收敛——DCU 与昇腾修复、构建矩阵统一、退役代码清理(09-22/09-23)
日期:2026-09-22 ~ 2026-09-23 来源:Torch-FL #395、#393、#392、#387、#372
PyTorch 适配层(Torch-FL / PyTorch-Plugin-FL)本窗口 11 笔,工程面集中收口:
- 设备修复:DCU 越界索引值直接拒绝(#395)、昇腾内核改在操作数所在设备执行(#392)、PPU 恢复 CPU torch wheel 的 CUDA 元数据(#370)、SDPA 注意力在派发模式下保持 autograd 图(#390)。
- 构建与配置:平台 / 构建矩阵收敛到单一表格(#387)、未识别或未检出的 GEMS_VENDOR 直接报错(#388)、新增 ruff 配置并移除 black/isort(#386)、codegen
--check门禁与注册一致性测试(#382)。 - 清理与性能:移除全局
Tensor.__getitem__补丁(#372)、清退 MetaX 原生树等退役代码(#393)、qwen-image 全有效提示掩码省略(#371)。
1.6 其余动态:FlagCX 传输加固、FlagSparse 三后端推进、TransformerEngine-FL NPU 后端、FlagTree PPU CI(09-22/09-23)
日期:2026-09-22 ~ 2026-09-23 来源:FlagCX #594、TransformerEngine-FL #113、FlagTree #1259、FlagSparse #80
- FlagCX:异构传输加固并对齐加速器 CI(#594)、p2p engine rpc serve 扩展与 barex 传输升级(#611)、打包仅在打包变更时构建(#616)。
- FlagSparse:NCIC-AlphaSparse 协作分支连合两批(#79 / #80)——DCU SpMM COO 优化、MACA SpMM 结果、昇腾 CI 与输出、MTX 测试进入 CI。
- TransformerEngine-FL:新增 NPU 后端 LayerNorm 实现(#114)与多张量 Adam 的 NPU 后端实现(#113)。
- Megatron-LM-FL:稳定厂商后端兼容性与 CI 集成(#174)。
- FlagTree:主分支 PPU CI 增加
pid.txt校验(#1259,09-23 10:05 合入)、GEMS 复用工作流纳入 CORE 变更检测(#1265)、新内置函数文档更新(#1120)。 - FlagAttention:测试与基准更新(#69)、pytest 增加
--record/--output(#70)。 - FlagBLAS:昇腾 L2 性能优化合入(#123——SPR / SPR2 / HPR / HPR2),外部贡献者打包线(#1,版本对齐 0.3.0 发布线)。
- FlagFFT:MACA「1d single」测量策略转默认、HCU / 昇腾 CANN9 环境文档补齐。
- FlagGems-Experimental:KernelGen 新增
dim算子(#702)。 - whisper-triton:同步科达讯飞 Codeup 补丁基线(#6)。
二、新闻报道与生态
2.1 AICC2026 在京举行:FlagOS 两场演讲与「可靠AI」测评体系启动(09-21/09-22)
日期:2026-09-21(会期)/ 2026-09-22(报道集中发布) 来源:光明网、新京报、CBISMB、AICC 官网议程
第七届人工智能计算大会(AICC2026)于 09-21 在北京中关村国际创新中心举行,09-22 起集中见报。与 FlagOS 直接相关的两项:主论坛 09:50 档,北京智源人工智能研究院副院长兼总工程师林咏华作「从架构创新到可用算力:FlagOS 驱动 AI 计算的软硬协同新范式」报告,指出「AI 负载不会收敛,计算架构也不会只剩一种;硬件创新要转化为可用算力,需要共享的软件生态支撑——众智 FlagOS 通过统一编译器、算子、通信和训推框架等能力,降低多元芯片的重复适配成本」;另据大会议程,智源研究院研究员赵帅在专题论坛作「众智 FlagOS:以开放软件栈释放多元 AI 算力价值」报告。会上同步举行「可靠AI」评测工作组启动仪式(工信部电子五所,10:10 档),并在产业成果环节正式发布面向 Agent 时代的「可靠AI」测评体系——由工信部电子五所联合北京智源研究院、浪潮信息、摩尔线程、沐曦股份、北京开源芯片研究院、百度智能云、阿里云等 20 多家产业链单位共同发布,覆盖芯片、整机与互联、框架与系统、模型、数据、应用全环节,从可靠性、安全性、稳定性维度开展全链路评测。同期 IDC 与浪潮信息联合发布《2026 年中国人工智能计算力发展评估报告》:预计 2026 年中国智能算力规模达 2576.5 EFLOPS、同比增长 87.9%。成员单位在议程上的密度(摩尔线程、清微智能、智源 FlagOS 两场)说明本栈已是国内开放算力生态的常驻议题。
2.2 云栖大会:达摩院玄铁发布真武 V900——FlagOS 支持平台 PPU 迎来新一代硬件(09-22)
日期:2026-09-22 来源:观点网、每日经济新闻、东方财富、阿里云开发者社区
2026 云栖大会(09-22,杭州)上,阿里巴巴旗下达摩院玄铁(T-Head)发布新一代训推一体 AI 芯片真武 V900:216GB 显存、片间互联带宽 1200GB/s,原生支持 FP8 / FP4 低精度计算,单芯片性能为上代真武 M890 的 3 倍,将于 2027 年第一季度量产;会上同时预告下一代真武 J900(2028 年 3 月)与倚天 720 / 730 两代服务器 CPU(2027 年),并披露真武 V900 超节点具备内存统一编址能力、可组成千卡全带宽互联。真武系列即阿里自研 PPU(Parallel Processing Unit),而 PPU 已是 FlagOS 统一插件与编译器的支持平台之一(FlagGems-vllm PPU 算子、FlagTree PPU CI、FlagDNN PPU 架构)——新一代硬件的发布意味着本栈 PPU 后端有了明确的代际升级目标。
2.3 国产算力软件栈动态:龙芯加速计算平台首个版本发布;数贸会今日开幕(09-22/09-23)
日期:2026-09-22 ~ 2026-09-23 来源:IT之家、快科技、数贸会 AI 展区预览
- 龙芯中科 09-22 发布「龙芯加速计算平台」首个软件版本:基于龙芯 2K3000 / 9A1000 集成的 LG200 系列通用 GPU,覆盖驱动、编译器、运行时、算子库(BLAS / DNN)、推理引擎、调试与性能分析工具,支持 OpenCL 3.0 与 CUDA 两类编程模型,可低成本迁移 CUDA 应用,并规划随 9A2000 / 9A3000 演进实现代际软件兼容。国产算力「全栈软件平台」的又一例,与本栈「统一软件栈降低适配成本」的路线互为参照。
- 第五届全球数字贸易博览会 09-23 在杭州开幕(至 09-27):首设「数贸·芯场景」集成电路应用生态板块,沐曦等企业进入「芯片 + 材料 + 算力」协同展陈;算力企业参展 117 家。成员单位的产业露出由会议季承接。
2.4 组件级检索连续第十八个平静窗口(09-22/09-23)
日期:2026-09-22 ~ 2026-09-23 来源:Google News RSS(中英文 24 组查询词,走代理)
以 FlagOS / FlagGems / FlagScale / FlagTree / FlagPerf / FlagCX / KernelGen 等组件名做中英文检索(when:7d 与 when:14d),24 小时窗口组件级命中为零,构成连续第十八个平静窗口(上一窗口为第十七个)。与会展侧形成反差:本窗口对外信息面由 AICC2026 与云栖大会的成员/生态动态承接(见 2.1—2.3)。HN Algolia 对 FlagOS / FlagGems 等词无相关命中;智源社区检索未见 FlagOS 相关新稿。
三、成员单位深挖
3.1 海光:DCU 索引边界修复与 INT8 块状 BMM 合入(09-22/09-23)
日期:2026-09-22 ~ 2026-09-23 来源:Torch-FL #395、FlagGems-vllm #803
- Torch-FL #395:DCU 上越界索引值改为直接拒绝(防止静默错误结果)。
- FlagGems-vllm #803(在审转合入):INT8 块状 BMM 内核与 INT8 einsum 收缩(bhr,hdr→bhd)——推理侧低精度矩阵乘补充海光实现。
- 镜像行:megatron_training-hygon-dtk26.04 登记 2.2.0-0.2.3;runtime hygon-dtk26.04 已在门户发布。
3.2 摩尔线程:W8A8 变长注意力量化支持合入;AICC2026 演讲与「可靠AI」参与(09-22)
日期:2026-09-22 来源:FlagGems-vllm #823、AICC 官网议程、CBISMB
- FlagGems-vllm #823(在审转合入):变长注意力(varlen)的 W8A8 FP8 支持——MUSA 平台的量化路径打通。
- AICC2026:摩尔线程解决方案部副总经理任燕萍在专题论坛演讲;并作为联合发布单位参与「可靠AI」测评体系。
- 镜像行:megatron_training-mthreads-musa4.3.6 / musa5.2.0 两行登记 2.2.0-0.2.3。
3.3 沐曦:融合逆 RoPE 量化算子合入;topk W8A16 优化与 MACA FFT 默认策略(09-22)
日期:2026-09-22 来源:FlagGems-vllm #826、FlagGems #6339、FlagFFT 提交
- FlagGems-vllm #826(在审转合入):融合逆 RoPE 与 FP8 量化算子新增并优化 MetaX 实现。
- FlagGems #6339:
topk_w8a16_fp8算子新增与优化(metaX)。 - FlagFFT:MACA「1d single」测量策略转为默认(测量驱动调参从实验转正)。
- Torch-FL #393:清退 MetaX 原生树等退役代码——适配层向插件化收敛。
- 镜像行:megatron_training-metax-maca3.8.1.3 登记 2.2.0-0.2.3。
3.4 昇腾:算子批与测试镜像更新;TransformerEngine-FL NPU 后端实现(09-22/09-23)
日期:2026-09-22 ~ 2026-09-23 来源:FlagGems #6548、#6590、FlagGems-vllm #817、TransformerEngine-FL #113
- FlagGems:cat/concat 派发与实现改进(#6548)、
rrelu_with_noise(#6534)、nonzero_static基准修正(#6571)、910B 周测镜像更新(#6590)。 - FlagGems-vllm #817:XCS 线新增 KV 池状态压缩(kpool)算子(09-23 上午合入)。
- TransformerEngine-FL #113 / #114:多张量 Adam 与 LayerNorm 的 NPU 后端实现——训练侧框架的昇腾后端补齐。
- Torch-FL #392:昇腾内核改在操作数所在设备执行,修复跨设备派发。
- 镜像行:ascend-cann8.5.0 / cann9.0.0 及 910c 变体多行登记与门户发布。
3.5 天数智芯:Iluvatar wheel 22.04 重建线与容器行登记(09-22/09-23)
日期:2026-09-22 ~ 2026-09-23 来源:build-infra #1014、Release Info 门户
- build-infra #1014:Iluvatar wheel 改在 Ubuntu 22.04 上重建,并发布其构建器镜像——wheel 分发线从天数行补齐。
- 镜像行:iluvatar-corex4.4.0 / corex4.5.0 两行登记 megatron 镜像 2.2.0-0.2.3;base / runtime 行在门户发布。
- FlagGems #5063 修复
index_reduce_在天数平台的实现(SiliconFlow 贡献)。
3.6 燧原:多行镜像登记与 sglang 应用行(09-22/09-23)
日期:2026-09-22 ~ 2026-09-23 来源:Release Info 门户
- 镜像登记:megatron_training-enflame-tops1.9.10 / tops1.10.6 两行登记 2.2.0-0.2.3;sglang 应用镜像含 enflame-tops 两行;base / runtime 行随门户重建更新。
3.7 清微智能:AICC2026 议程与运行时行(09-22)
日期:2026-09-22 来源:AICC 官网议程、Release Info 门户
- AICC2026 议程:清微智能软件副总裁李彬作「3D 芯片,开源新章:Open3D-PIMC 重构算力软件底座」报告——可重构计算厂商在开放软件栈侧的公开动作。
- 镜像行:tsingmicro-tsm260610 的 base / runtime 行随门户重建更新;vllm-plugin-FL 0.3.0-rc2 分支包含 tsingmicro txda 的 0.24.0 适配(此前后台合入,随版本分支收口)。
3.8 达摩院玄铁:真武 V900 与 PPU CI 收口(09-22/09-23)
日期:2026-09-22 ~ 2026-09-23 来源:FlagTree #1259、Torch-FL #370、观点网
- 硬件侧:真武 V900(PPU 新一代)发布,2027 Q1 量产(详见 2.2)。
- 软件侧:FlagTree PPU CI 增加
pid.txt校验(#1259,09-23 10:05 合入)——PPU 编译链路的 CI 完整性收口;Torch-FL 恢复 PPU 路径下 CPU torch wheel 的 CUDA 元数据(#370)。
四、总结与趋势观察
- 2.2 进入 GA 前最后一周,发布物开始「可见」:官方发布清单首条目落库(sglang-plugin-fl v0.2.0)、Release Info 门户同日重建、Megatron 应用镜像 2.2.0-0.2.3 覆盖 14 行。rc2 稳定期 09-24 截止、GA 定 09-28——接下来一周的观察点是清单逐批补齐与各组件 rc2/post 标签的收口顺序。
- 分发形态继续加宽:FlagCX wheel 从试点行扩到全部行 + 昆仑芯落地、deb/rpm 覆盖到每个打包组件、FlagTree Iluvatar wheel 重建——与 FEP-0019(统一打包集成)的 Wave 1 验收线吻合,「镜像之外」的原生包通道成为 2.2 的标准交付面。
- 量子栈是本日单仓吞吐之最:FlagQuantum 38 笔同时推进云后端(Azure Quantum / Braket / CUDA-Q / Cirq 四线互通)、仿真融合加速与候选验证门禁——从一个「跟随组件」走向框架化开发节奏。
- 三仓同时进入修复/调优节奏:FlagGems(15 枚 KernelGen + 六平台修复)、FlagGems-vllm(三条在审转合入)、Torch-FL(11 笔工程收口,含移除全局补丁与退役代码)——特性冻结后的「验收、修复、调优」窗口形态与排期一致。
- 对外信息面由会议季承接:组件级检索第十八个平静窗口 vs AICC2026 两场 FlagOS 演讲与「可靠AI」启动、云栖真武 V900 发布、龙芯全栈 GPU 软件平台——产业侧对「统一软件栈 / 多元算力」的关注度在会议季集中释放,与代码侧收口互为印证。
- 待观察:2.2 清单后续条目(FlagTree 0.7.0+triton3.6、vllm-plugin-FL 0.3.0、FlagScale 2.1.0 等版本分支已在推进);PPU 新硬件的软件适配跟进(V900 量产在 2027 Q1);FlagSparse / FlagAttention 打包线(FEP-0019 Wave 1)在 GA 前的落地。
附录:信源核查表
| 类别 | 信源 | 核查方式 | 结果 |
|---|---|---|---|
| GitHub | org: flagos-ai repos API | 54 仓库 pushed_at 全量核查 | 24 仓窗口内活跃 |
| GitHub | 提交搜索 + 逐仓核对 | 窗口内逐条核验 | 143 条(14 仓库)+ 分支侧推送(release-info / FlagScale / vllm-plugin-FL / FlagTree / docs) |
| GitHub | releases 逐仓扫描 | 13 仓 releases API | 窗口内无新 release(2.2 走清单 / 镜像登记 / 门户发布) |
| 发布工程 | community 清单 + Release Info 门户 + build-infra | 原文抓取逐页核对 | release-2.2.yaml 首条目;门户 20 平台行重建;Megatron 镜像 2.2.0-0.2.3 覆盖 14 行 |
| 新闻 | Google News RSS(中英文 24 组查询词,走代理) | 24 小时窗口过滤 + 逐条剔除 | 组件词零命中(第 18 个平静窗口);生态侧保留 AICC2026 / 云栖 / 龙芯等条目 |
| 媒体 | 光明网 / 新京报 / CBISMB / 观点网 / 每日经济新闻 / 东方财富 / IT之家 | 原文抓取复核 | AICC2026、真武 V900、龙芯平台 |
| 社区 | HN Algolia / 智源社区 | 检索复核 | 无 FlagOS 相关新稿 |
| 项目文档 | community // schedule.md、flagos-ai.github.io/release-info | 原文抓取 | 2.2 排期(rc2 至 09-24、GA 09-28)与镜像矩阵核对 |
完整信源清单
- [1] 今日重点 / 1.1 community 与发布清单 — https://github.com/flagos-ai/community/pull/111 · https://github.com/flagos-ai/community/blob/main/release/2.2/release-2.2.yaml · 排期 https://github.com/flagos-ai/community/blob/main/release/2.2/schedule.md · 追踪 https://github.com/flagos-ai/community/issues/47
- [2] 今日重点 / 1.1 build-infra — #1000 — https://github.com/flagos-ai/build-infra/pull/1000 · #1002 — https://github.com/flagos-ai/build-infra/pull/1002 · #1008 — https://github.com/flagos-ai/build-infra/pull/1008 · #1014 — https://github.com/flagos-ai/build-infra/pull/1014 · #1017 — https://github.com/flagos-ai/build-infra/pull/1017 · #1019 至 #1033(Megatron 行登记)— https://github.com/flagos-ai/build-infra/pulls
- [3] 今日重点 / 1.1 Release Info 门户 — https://flagos-ai.github.io/release-info/ · Megatron 行示例 — https://flagos-ai.github.io/release-info/zh-cn/application/megatron_training-nvidia-cuda12.8/
- [4] 1.2 FlagQuantum — #135 — https://github.com/flagos-ai/FlagQuantum/pull/135 · #138 — https://github.com/flagos-ai/FlagQuantum/pull/138 · #154 — https://github.com/flagos-ai/FlagQuantum/pull/154 · #167 / #168 — https://github.com/flagos-ai/FlagQuantum/pulls
- [5] 1.3 FlagGems — KernelGen #5245 — https://github.com/flagos-ai/FlagGems/pull/5245 · #5845 — https://github.com/flagos-ai/FlagGems/pull/5845 · FP8 WGMMA #6531 — https://github.com/flagos-ai/FlagGems/pull/6531 · MetaX #6339 — https://github.com/flagos-ai/FlagGems/pull/6339 · SiliconFlow #5063 — https://github.com/flagos-ai/FlagGems/pull/5063 · 昇腾 #6548 — https://github.com/flagos-ai/FlagGems/pull/6548
- [6] 1.4 FlagGems-vllm — #817 — https://github.com/flagos-ai/FlagGems-vllm/pull/817 · #823 — https://github.com/flagos-ai/FlagGems-vllm/pull/823 · #803 — https://github.com/flagos-ai/FlagGems-vllm/pull/803 · #826 — https://github.com/flagos-ai/FlagGems-vllm/pull/826
- [7] 1.5 Torch-FL — #395 — https://github.com/flagos-ai/Torch-FL/pull/395 · #393 — https://github.com/flagos-ai/Torch-FL/pull/393 · #392 — https://github.com/flagos-ai/Torch-FL/pull/392 · #387 — https://github.com/flagos-ai/Torch-FL/pull/387 · #372 — https://github.com/flagos-ai/Torch-FL/pull/372 · #370 — https://github.com/flagos-ai/Torch-FL/pull/370
- [8] 1.6 FlagCX — #594 — https://github.com/flagos-ai/FlagCX/pull/594 · #611 — https://github.com/flagos-ai/FlagCX/pull/611 · #616 — https://github.com/flagos-ai/FlagCX/pull/616
- [9] 1.6 FlagSparse — #79 / #80 — https://github.com/flagos-ai/FlagSparse/pulls · FlagAttention — https://github.com/flagos-ai/FlagAttention/pulls · FlagBLAS — https://github.com/flagos-ai/FlagBLAS/pulls
- [10] 1.6 TransformerEngine-FL — #113 — https://github.com/flagos-ai/TransformerEngine-FL/pull/113 · #114 — https://github.com/flagos-ai/TransformerEngine-FL/pull/114 · Megatron-LM-FL #174 — https://github.com/flagos-ai/Megatron-LM-FL/pull/174 · FlagTree #1259 — https://github.com/flagos-ai/FlagTree/pull/1259
- [11] 2.1 AICC2026 — 光明网 — https://tech.gmw.cn/2026-09/22/content_39015304.htm · 新京报 — https://www.bjnews.com.cn/detail/1790063742129693.html · CBISMB — https://www.cbismb.com/ai-infra/62409 · 议程 — https://www.aicconf.net/
- [12] 2.2 真武 V900 — 观点网 — https://www.guandian.cn/article/20260922/605518.html · 每日经济新闻 — https://www.nbd.com.cn/articles/2026-09-22/4588418.html · 东方财富 — https://finance.eastmoney.com/a/202609223881224838.html · 阿里云开发者社区 — https://developer.aliyun.com/article/1765525
- [13] 2.3 龙芯加速计算平台 — IT之家 — https://www.ithome.com/1/005/595.htm · 快科技 — https://news.mydrivers.com/1/1153/1153027.htm · 数贸会 AI 展区预览 — https://zdh.xwboo.com/news/262226.html
- [14] 3.5 天数智芯 — build-infra #1014 — https://github.com/flagos-ai/build-infra/pull/1014 · Release Info 门户(iluvatar 行)— https://flagos-ai.github.io/release-info/
- [15] 3.7 清微智能 — AICC 议程 — https://www.aicconf.net/ · Release Info 门户(tsingmicro 行)— https://flagos-ai.github.io/release-info/