2026 世界人工智能大会上,阿里平头哥正式开源自研全栈 AI 软件 T-Head SAIL。
这套支撑真武系列 AI 芯片落地的底层核心软件,完整开放源码、驱动、全套工具链与配套文档;截至 4 月,搭载该软件栈的真武芯片出货量已达 56 万片,服务 20 余个行业、400 余家企业,历经双 11 超大流量场景验证。在国产硬件逐步成熟的当下,平头选择开放核心软件底座,成为补齐国内 AI 软件生态、降低开发者迁移门槛的关键一步。
一、AI 算力真正护城河在软件栈,SAIL 打破黑盒壁垒
AI 芯片硬件如同发动机,软件栈则是整套传动调度系统,缺少完善软件,硬件算力无法充分释放。
长期以来英伟达依靠 CUDA 构建起深厚生态壁垒,国内芯片普遍存在软件工具封闭、底层逻辑不透明的痛点。传统厂商仅交付二进制工具包,开发者遇到性能、兼容故障只能等待厂商排障,模型迁移动辄耗时数周。
T-Head SAIL 开源后彻底转为 “白盒体系”,开发者可直接阅读底层源码,自主定位、修复 BUG,还能结合自身业务负载深度定制优化,彻底摆脱对厂商工单的依赖,大幅缩短模型适配、性能调优周期,解决国产芯片长期存在的软件生态短板。
二、五层全栈架构,实现三大零迁移优势
SAIL 是一套经过大规模生产验证的五层完整技术体系,覆盖驱动、编程语言、编译器、高性能算子库、运维分析工具全链路:
- 底层驱动运行层:分为用户态与内核驱动,负责芯片设备、内存、队列调度,支撑千卡集群稳定运行;
- 编程语言层:兼容 C/C++、Python,无需开发者更换开发范式;
- 编译调试层:端到端模型编译,开放中间表示,可视化定位优化节点;
- 高性能算子库:集成线性代数、FFT、深度学习、多卡通信等全套专用加速库,全部针对真武架构深度调优;
- 运维分析工具层:单卡算子级、集群系统级双维度性能剖析工具,覆盖设备监控、集群调度。 整套软件实现三大核心优势:无需重写代码,兼容 260 + 主流训练推理框架;无需长期等待,新模型平均适配周期小于 7 天;无需厂商绑定,全技术栈开放,开发者自由选择技术路线。
三、平头哥完整算力矩阵,为开源奠定硬件基础
此次开源并非单一动作,是平头哥八年全栈芯片布局的阶段性成果,现已建成算力、网力、存力三位一体自研硬件版图:算力:倚天 710 通用服务器 CPU、真武 810/M890 训推一体 AI 芯片,新一代 M890 性能达前代 3 倍,原生支持 FP32 至 FP4 全精度训练推理;
网力:ICN Switch 互联芯片、磐脉智能网卡,实现 64 卡全带宽高速互联;
存力:镇岳系列 SSD 存储主控,适配 AI 训练低延迟存储需求。
硬件出货规模与真实业务场景验证,让 SAIL 具备成熟落地能力,开源后开发者可直接对接经过海量业务打磨的算力底座。
四、开源的产业价值:共建国产 AI 算力生态
国内 AI 产业长期存在硬件追赶快、软件生态积累薄弱的问题,单一厂商难以独自完善全场景工具链。
平头哥开源 SAIL,核心目标是开放底层底座,联合全球开发者、科研机构、产业伙伴协同共建算子与工具生态。对于企业与科研团队,开源大幅降低国产芯片试用门槛,不用受封闭工具链限制;对于整个行业,打破单厂商技术围墙,整合全行业力量完善国产算力配套。
SAIL 全称 Seed of AI Library,寓意每一行代码都是 AI 生态种子,依托成熟真武硬件底座,通过开放吸引产业共建,缩小与海外 CUDA 生态的差距,推动国产算力从硬件量产走向软硬件协同规模化落地。