真武AI芯片 T-Head SAIL® 软件栈正式开源开放!

简介: 今天,真武AI芯片软件栈 T-Head SAIL® 正式开源,向全球开发者开放高效、开放的AI算力基础设施核心能力。

今天,真武AI芯片软件栈 T-Head SAIL® 正式开源,向全球开发者开放高效、开放的AI算力基础设施核心能力。


作为自主算力新标杆,真武AI芯片凭借卓越算力与数据中心系统级全栈协同生态,高效助力将AI算力落地为生产力,为千行百业智能化进程注入澎湃动能T-Head SAIL 是平头哥为真武系列 AI 芯片打造的软件栈,拥有自主知识产权、全面兼容主流 AI 生态。软件栈覆盖 OS 层、SDK 层与接口层的完整链路——向下释放真武硬件算力,向上承接上层应用需求。


截至今年4月,真武 AI 芯片已累计出货56万片,服务20多个行业400多家客户。真武 AI 芯片及 T-Head SAIL 软件栈已在阿里云及多家头部客户的真实生产环境中历经深度打磨,扛过大规模流量、复杂场景以及严苛 SLA 的多重考验。


今天,这套经过严苛生产验证的 T-Head SAIL 软件栈方案将面向整个开发者社区开放。


T-Head SAIL 软件栈 - 真武AI芯片开发完整基座



从底层驱动到上层工具,T-Head SAIL软件栈由五层完整的技术栈组成,致力为开发者提供完整、可靠、开箱即用的开发体验。

  • Driver与Runtime层:PPU Driver分为内核态的KMD与用户态的UMD,配合PPU Runtime提供统一的设备管理和内存管理接口;
  • 编程语言层: 完整支持C/C++与Python,开发者无需学习新的语言或编程范式,支持现有代码资产平滑迁移;
  • 编译器层: 包含Compiler与Debugger两大组件,构建完整的开发闭环;
  • 高性能库层: 全面覆盖主流计算需求,为各类计算场景提供对应的高性能实现
  • 计算库涵盖acBLAS、acDNN、acFFT、acRAND、acSOLVER、acSPARSE六大核心数学库,为大模型训练与推理提供支撑
  • 编解码库覆盖HGDEC、HGENC、HGJPEG与HGPP,满足多模态数据处理的高吞吐需求
  • 集合通信库包含PCCL与sailSHMEM,专为多卡、多机分布式训练设计,助力突破通信瓶颈
  • 此外配备acext扩展库与HGML机器学习库,拓展丰富功能边界
  • 开发者工具层:丰富相应配套工具,赋能从单卡调试到千卡运维的全链路掌控
  • Asight Compute支持算子级精细性能分析,帮助定位微观瓶颈;
  • Asight Systems面向系统级全栈Profiling,提供宏观视角;
  • PPU-SMI实现设备实时监控与管理;
  • PPU-DCGM支撑集群级别的资源智能调度

面向开发者体验的软件栈


从第一行代码的创建开始,T-Head SAIL的建设始终秉持“以开发者体验为中心”的核心理念。通过零代码修改迁移、同频生态适配与全量框架覆盖三大核心能力,T-Head SAIL助力开发者实现三大“无需妥协”,致力于将开发过程中的效率提升与成本节约转化为可量化、可感知的业务增长。


  • 无需重写代码,让既有资产无缝延续

T-Head SAIL兼容主流AI生态,主流模型即开即用,算子库完整对标,主流编程模型高度兼容。开发者过去积累的经验、代码、调优技巧,在 T-Head SAIL上都能直接复用,业务迁移仅需极少量代码适配修改、平滑顺畅。


  • 无需等待适配,与前沿生态同频演进

AI技术迭代日新月异,平头哥自研推理引擎提供开箱即用的生产级性能,同时T-Head SAIL已完善建立与主流社区同频的响应机制,框架跟进、新模型适配速度迅捷极速。目前主流AI推理框架,T-Head SAIL平均适配时间<7天,开发者无需额外适配和调优,即可使用前沿最新的算子、特性与优化手段。


  • 无需绑定框架平台,为开发提供灵活选择

T-Head SAIL 已全面适配PyTorch、TensorFlow、vLLM、SGLang等260余个主流训练与推理框架,开发者获取源码后即可直接编译运行,无需额外适配。T-Head SAIL支持按需灵活选用工具链,不绑定任何特定技术路线,保障技术选型的自主与开放。

智算无界,共行致远


平头哥开发者社区网站现已上线,汇聚 T-Head SAIL 全栈技术文档,提供 SDK 软件包、内核驱动、性能分析和调试工具下载,为开发者提供一站式服务。 社区地址:https://developer.t-head.cn/home


在即将推进的二期建设中,通信库相关软件、v2.2版本Docker与PIP源将开源开放,同时开发者社区网站将上线开发者论坛板块,搭建起真武与社区、开发者与开发者之间的常态化交流平台;三期将进一步开源计算加速库和推理引擎软件,并开放v2.3版本Docker与PIP源。未来,还将有更多更新与社区活动上线,敬请关注。

相关文章
|
2月前
|
数据采集 人工智能 JSON
基于浏览器请求录制与AI代码生成的E2E接口自动化测试实践
以阿里云DataWorks为例,介绍如何通过浏览器录制插件捕获真实请求数据,结合AI编程工具自动生成接口封装与测试用例,解决复杂平台产品自动化测试中接口多、参数杂、数据流深的核心难题。
|
2月前
|
人工智能 API 开发者
阿里云发布为Agent而生的全新AI产品官网“千问云”,模型服务全面Skill、CLI化
5月20日,阿里云发布“千问云”(www.qianwenai.com)——专为Agent时代打造的AI模型服务平台,集成150+主流模型API,首创Skills与CLI工具链,支持模型选型、调用、用量管理等全链路自动化,助力开发者与Agent高效构建AI应用。
2161 32
|
5月前
|
机器学习/深度学习 存储 人工智能
业务逻辑的“坍塌”:当应用层只剩下胶水代码,在 AI Agent 时代,我们该构建什么
作者通过亲手编写代码、研究底层原理和对比传统架构,系统地梳理了从“怀疑 AI”到“理解并驾驭 AI”的心路历程。
689 148
业务逻辑的“坍塌”:当应用层只剩下胶水代码,在 AI Agent 时代,我们该构建什么
|
2月前
|
人工智能 运维 Prometheus
从 API 到 AI Agent:阿里云云监控 CLI + Agent Skill 实战
阿里云推出云监控CLI与Agent Skill,将运维能力转化为AI可执行工作流。用户通过自然语言指令,即可由Agent自动完成资源接入、告警管理及数据查询等任务,实现可控、可审计的智能化运维自动化。
655 127
|
5月前
|
弹性计算 人工智能 前端开发
Agent/Skills/Teams 架构演进过程及技术选型之道
本文系统梳理Agent架构演进路径:Single Agent→Multi-Agent→Agent Skills→Agent Teams,剖析其本质是大模型“领域知识注入”与“长期记忆管理”能力不足的工程补偿。结合阿里云实践及Google、Anthropic最新研究,提出“由简入繁、按需升级”的科学选型方法论,强调架构复杂度须匹配问题复杂度。
1199 4
Agent/Skills/Teams 架构演进过程及技术选型之道
|
3月前
|
人工智能 芯片 开发者
倒计时2天!直击2026阿里云峰会:从底层芯片到Agentic OS,揭秘AI全栈新范式
2026阿里云峰会将于5月20–21日在杭州西子宾馆举办,聚焦“Agentic Cloud”,全景展示芯片、大模型到推理平台的全栈升级,深度探讨智能体(Agent)时代新范式,为开发者提供前瞻技术洞察与实践机遇。
|
7月前
|
存储 人工智能 安全
一文详解Kimi的AI Agent如何跑在阿里云上
Kimi携手阿里云,基于ACK与ACS Agent Sandbox构建端到端Agent基础设施:实现秒级沙箱启动、万级并发弹性调度、会话级状态保持及强安全隔离,支撑“深度研究”“OK Computer”等智能体产品稳定高效运行。(239字)
1378 1
一文详解Kimi的AI Agent如何跑在阿里云上
|
2月前
|
人工智能 Java 数据库连接
都是 AI Coding,为什么 Java 体验差了一个量级?五条方法论帮你构建自己的 Harness 环境
本文探讨Java微服务项目AI编码体验差的根源——本地无法运行导致AI无法自主验证。提出三大改造原则:接口抽象+Profile隔离实现零侵入本地化;CLI优先让AI可调用工具;最小可运行子集替代外部依赖。实践后,Bug修复从30分钟缩短至2分钟内闭环。