openFuyao 社区 2026年6月-7月 运作报告

openFuyao2026-08-10

概述

2026年6月至7月,openFuyao社区技术不断突破,贡献稳步积累,各项运营与技术活动有序推进。

技术演进方面,openFuyao v26.06版本发布,NPU DRA适配910、310等更多设备,InferNex AI推理加速性能再突破,TTFT降低55%;新增、合入近10项技术提案,涵盖NPU DRA、NPU软切分能力、AI推理资源优化等多方面。

生态进展方面,中科弘云科技 (北京) 有限公司加入社区共建多样化算力互联调度能力。openFuyao参与共创的鲲鹏超节点生成式推荐广告方案入选《超节点定义与实践白皮书》应用场景案例,并在2026 WAIC重磅发布。

社区动态方面,亮相LEAP East 2026国际科技与信息技术展,与亚太、中东等企业开展技术交流。开展v26.06版本技术直播,解读升级特性。社区启动满意度调研,收集、优化开发者体验。

社区活力

数据看板

技术演进

版本进展

openFuyao v26.06 版本发布

AI推理加速场景: InferNex 性能再突破,TTFT降低55%,新增权重分发组件,大幅缩短模型冷启动耗时。

资源调度层: 基于KubeVirt实现鲲鹏的虚拟机与容器共管能力,并整合众核调度编排,提升安全混部密度。

多样化算力接入层: 进一步强化NPU DRA能力,支持910、310等更丰富的设备类型;另外引入声明式组件升级架构,内置自动化合规扫描工具,实现运维效率和安全性双提升。

立即体验openFuyao v26.06版本

技术提案

新增提案:

DRA拓扑亲和调度

基于Kubernetes动态资源分配(DRA)机制,实现NPU设备的拓扑感知亲和调度。通过在ResourceSlice中上报拓扑关系属性,并利用ResourceClaim的属性约束能力,优化多卡AI训练/推理任务的设备分配策略,提升训练/推理性能。

npu-dra-plugin支持软切分

对npu-dra-plugin进行扩展,新增昇腾NPU软切分能力,支持显存和AICore独立细粒度配额配置,实现整卡、硬切分、软切分三种分配模式在同一节点上混合调度,解决硬切分模板固化、资源粒度粗糙的问题,以提升NPU资源利用率。

InferNex端到端分布式追踪系统设计方案

为InferNex构建基于OpenTelemetry的端到端分布式追踪能力,实现推理请求全链路追踪和关键业务数据采集,提升AI推理场景的性能分析与故障诊断能力。

AI推理资源优化框架

设计SACS算法,该算法根据推理服务的TTFT, ITL, 成功率等SLO目标,结合离线压测画像与在线观测数据,估算单副本安全容量,并自动推荐合理的副本数量,以实现资源分配与服务质量的最佳平衡。

合入提案:

社区发行版自动化测试体系

本提案在实现自动化测试框架的基础上,推动开发者功能测试与测试团队集成测试的自动化改造,并将测试任务与社区基础设施流水线进行集成。该体系能够提升测试效率、降低人力需求,从而为 openFuyao 各版本及各特性提供可靠的质量保证。

cache-indexer重构增强

cache-indexer 基于事件订阅与轮询机制,构建包含L1推理引擎显存缓存和L3内存/SSD缓存的双层独立索引,对外统一提供KVCache 双层级命中率查询接口,以支持推理系统优化推理请求调度,提高全局KVCache复用率。

……(更多提案略)

技术博客

InferNex AI推理加速套件解读: 从痛点驱动的核心特征、技术竞争优势、未来竞争力空间、快速部署流程等方面解读

InferNex:云原生分布式 LLM 推理加速套件——从生产痛点到算力的极致释放

InferNex是openFuyao社区首个面向昇腾NPU +灵衢总线的云原生分布式LLM推理加速平台,以智能路由、计算-显存解耦、分布式多级缓存、近实时可观测四大引擎直击痛点——在前缀一致率70%场景下实现TTFT降低43%、吞吐提升50%、故障零损耗切流 <10s,在昇腾硬件感知调度和灵衢总线零拷贝直访上构建了llm-d、NVIDIA Dynamo均未覆盖的技术优势。

InferNex AI推理加速套件

超节点接入与使能特性解读: 从K8s生态对超节点支持存在的GAP、openFuyao灵衢超节点使能方案两方面解读

openFuyao使能灵衢超节点:让容器业务丝滑释放超节点能力

openFuyao在K8s体系内构建了面向超节点的系统级使能能力,涵盖设备接入、网络通信、存储与共享内存抽象,以及基于总线拓扑的调度增强等关键组件;通过扩展Device Plugin、CNI、CSI及调度框架,引入超节点资源建模与运行时适配机制,使容器业务能够极简、无缝地使用共享内存、内存借用与高速通信能力。

灵衢超节点使能

生态进展

中科弘云加入社区

中科弘云科技 (北京) 有限公司(简称:中科弘云)由中科计算技术西部研究院孵化的企业级智算云平台软件和服务提供商,拥有涵盖异构算力调度、全流程算法开发工具链和企业级智能体平台的全栈智算云平台解决方案,已服务制造、能源、电力、交通等关键行业的超百家头部客户。

中科弘云将与openFuyao共同打造多样化算力互联调度能力,实现集群的算力极致释放与安全可靠能力,共建开源生态。

社区参与共创的超节点案例入选《超节点定义与实践白皮书》

openFuyao参与共创的鲲鹏超节点生成式推荐广告方案入选《超节点定义与实践白皮书》应用场景案例,并在2026 WAIC重磅发布。

该方案相较传统架构实现全链路时延优化8%,openFuyao作为AI Infra底座,为AI Native场景提供标准化算力支撑。

社区动态

亮相LEAP East 2026国际科技与信息技术展

[香港,2026年07月08-10日] openFuyao亮相LEAP East 2026国际科技与信息技术展,展示InferNex AI推理加速套件,与亚太、中东等全球高校及企业开展深度技术交流。

LEAP East 2026

技术直播解读v26.06版本

社区架构师姚晓忠深度解读openFuyao v26.06社区发行版升级特性与能力,为开发者带来干货满满的技术分享,吸引超过200位开发者观看与交流。

下一期「“yao”你解码」技术直播将于 8月13日 开启,聚焦openFuyao InferNex AI推理加速套件,解读性能优化背后的技术实践与思考,欢迎预约。

技术直播解读v26.06

社区启动满意度调研

为提升社区使用体验,openFuyao 社区启动满意度调研,收集安装部署、贡献开发、官网文档等方面的体验反馈。