Alibaba Cloud Linux 4 Agentic Edition(ANOLISA)——是阿里云Agent-first操作系统,专为AI Agent设计

简介: ANOLISA是阿里云推出的全球首个Agent优先操作系统,基于Alibaba Cloud Linux 4深度打造,集成cosh自然语言Shell、OS Skills技能体系、AgentSecCore安全内核等核心组件,专为AI Agent提供安全、高效、低Token消耗的原生运行环境。Alibaba Cloud Linux官网:https://t.aliyun.com/U/KReVDn

ANOLISA是阿里云基于自研的操作系统Alibaba Cloud Linux为Agent设计的衍生操作系统,它提供Agent最佳的运行环境,提升阿里云客户使用Agent的体验。ANOLISA完全兼容 Alinux4 所有能力(内核优化、云原生支持等),围绕 Agent 的认知方式和工作模式,构建全新的OS架构。详细参考Alibaba Cloud Linux官网:https://www.aliyun.com/product/alinux

Alibaba Cloud Linux 4 Agentic Edition(ANOLISA)

封装交互层

  • cosh:替代默认 Shell,原生托管 bash/zsh,并在同一终端接收自然语言任务。
  • OS Skills:内置技能包机制,Agent 通过 Skill 说明书与运行时层、基础系统层交互获得部署、运维、诊断、可观测等"动手能力"。

运行时层

  • AgentSecCore:AgentSecCore 是专门为 AI Agent 打造的安全产品,聚焦Prompt注入、动态代码执行、Skill安全、意图偏离、系统环境风险等Agent生命周期的核心威胁,构建“感知-决策-阻断-溯源” 的OS 侧多维度、纵深、闭环防御机制,支持无侵入式集成到Cosh、OPENCLAW 等 Agent 框架。

  • AgentSight:一款基于eBPF技术的 AI Agent 可观测性工具,能够在无侵入、零修改前提下,对运行在 Linux 系统上的 AI Agent 进行实时监控,捕获其LLM API 调用、Token 消耗及进程行为。

  • Tokenless:从上下文压缩和命令过滤两个维度降低 Agent 与 LLM 交互的 Token 消耗。通过插件和 Hook 机制自动介入,支持 cosh、OpenClaw、Hermes、Claude Code、Codex、Qoder、Qwen Code 等多个 Agent 框架。

  • AgentMemory:文件形态的 Agent 记忆 MCP 服务器,为 AI Agent 提供持久化、可搜索、受沙箱保护的记忆空间。通过文件系统语义读写记忆,结合 BM25/向量混合检索与自动捕获召回机制,实现跨会话上下文延续。

  • ws-ckpt:AI Agent 工作区快照与回滚工具,用户可在关键操作前手动创建快照,或开启每轮问答结束自动快照,支持一键回退至任意历史状态,保障执行过程的可回退性

  • SkillFS:Agent Skill 的按需挂载文件系统,基于 FUSE 仅向 Agent 暴露当前所需的 Skill 子集,其余 Skill 按需发现,读取时按目标发行版即时编译 SKILL.md,并可依据安全决策隐藏 Skill 或回退至可信快照

基础系统层

  • Alinux4:兼容 Alinux4 所有能力(内核优化、云原生支持等)

适用范围

ANOLISA适用范围说明:

  • 适用于多种实例规格族,包括弹性裸金属服务器。更多信息,请参见实例规格族

    • 仅支持X86的CPU架构

    • 支持实例内存建议>=2GB

  • 适用于各种 Agent 场景工作负载,包括 OpenClaw、qwenpaw、Claude Code 等主流 Agent 框架

费用

ANOLISA是免费的操作系统镜像,但使用镜像时,需要支付其他资源产生的费用,如大模型调用,vCPU、内存、存储、公网带宽和快照等。

稳定性与兼容性

ANOLISA 基于 Alibaba Cloud Linux 4 标准版的基础系统层构建,与标准版共享相同的 alnx4 内核。Agentic Edition 在此基础上新增 AI Agent 相关组件(包括 cosh、AgentSecCore、AgentSight、OS Skills 等),不影响原有系统功能的稳定性。

标准 Linux 操作(如 yum/dnf 包管理、systemctl 服务管理、bash shell 等)在 Agentic Edition 上的行为与标准版一致,确保了向后兼容性,已有的运维脚本与使用习惯可以延续。

ANOLISA 内置诊断工具,可通过 anolisa doctor 诊断组件问题,anolisa status 查看组件健康状态;AgentSight 提供基于 eBPF 的 AI Agent 可观测性,帮助排查 Linux 常见性能及稳定性问题。

核心优势

  • 极致Token经济型
    将复杂的OS专家知识封装为标准化 Skill ,大幅减少执行环境理解以及试错探索的Token开销,实现从意图到执行的零延迟闭环。

  • 自然语言重新定义人机交互
    首次将 cosh 作为默认交互入口,用户通过自然语言即可驱动操作系统完成环境部署、工具安装等日常运维操作,告别复杂命令行记忆,带来操作方式上的根本性变革。

  • Skill 全链路安全加密,构筑内生安全防线
    对每个 Skill 实施数字签名与加密保护,调用前强制身份鉴权与完整性校验,结合硬件级安全沙箱隔离异常行为,从 OS 内核层面确保 Agent 在受控、可审计、最小权限的环境中安全运行。

核心组件简介

Alibaba Cloud Linux 4 Agentic Edition(ANOLISA)包含如下核心组件:Cosh、AgentSecCore、AgentSight、OS Skills、Tokenless、ws-ckpt、AgentMemory,目前均已开源,开源链接https://github.com/alibaba/anolisa

Cosh

cosh 是 Alibaba Cloud Linux 4 Agentic Edition(ANOLISA) 的默认交互式 Shell,替代 bash 作为系统登录后的第一入口。

cosh的核心设计理念是「原生 Shell 宿主 + Agent 增强」。它直接托管一个真实的 bash 或 zsh 会话,Shell 命令按原生语义执行,无需前缀,也无需回退到独立的 bash 环境;需要排查或处理较大任务时,用户直接用中文或英文描述意图,Agent 携带最近的终端上下文接手执行;行首的斜杠命令则用于控制会话自身。三类输入在同一个提示符下自动分流,全程无需切换环境。

在保留完整 bash/zsh 兼容性的基础上,cosh 增加了自然语言理解、Skill 调用、MCP 工具集成和多级审批控制等能力,并进一步将系统运维操作沉淀为跨发行版的结构化命令接口 cosh-cli,将 Agent 运行时开放为无界面集成接口 cosh-core。cosh 将复杂的系统级能力抽象为自然语言交互,又集成了OS Skills 说明书,降低了操作系统的使用门槛,使人类用户和 Agent 智能体都能以简单的方式驱动操作系统完成任务。

cosh 主要提供以下能力:

能力 说明
原生 Shell 体验 直接托管 bash/zsh 会话,交互式程序、管道、重定向、作业控制、用户配置文件与 Ctrl+C 均按原生语义工作
自然语言任务 用中文或英文描述排查或运维目标,Agent 自动携带最近的终端证据执行,并在终端中流式返回结果
主动分析 命令失败或产生诊断输出时,评估是否值得介入并给出下一步建议,支持 smart、auto、manual 三档
多级审批 工具调用前按 recommend、auto、trust 模式决定自动执行或展示审批卡片,重启、关机等不可恢复操作强制人工确认
Skill 与 MCP 按工作区、用户、扩展、系统四级优先级加载 Skill,并接入 MCP 服务提供的外部工具
会话恢复 会话按工作区隔离持久化,支持列出、恢复与压缩,便于延续长时间排查
结构化 OS 操作 cosh-cli 以统一 JSON 契约提供软件包、系统服务、工作区快照与安全审计操作,屏蔽发行版差异
无界面集成 cosh-core 以 JSONL 协议对外提供 Agent 运行时,供其他前端与自动化流程集成

OS Skills

OS Skills是ANOLISA 为 AI Agent 编写的操作系统使用手册。

传统操作系统文档面向人类用户,依赖自然语言描述、截图示例和行业潜在共识。Agent 在阅读这类文档时,需要消耗大量 Token 进行理解。OS Skills 说明书将操作系统知识重新组织为 Agent 可直接理解和执行的结构化格式——SKILL,Agent 不再需要「读懂文档再操作」,而是「读到即能做」。

OS Skills 说明书已覆盖两大领域:

说明书领域 对应知识域 覆盖内容
system-admin 系统管理 用户与权限管理、系统服务管理、内核升级等基础系统管理操作
security 系统安全 系统安全基线检查、漏洞扫描与修复等
system-ops 系统运维 提供Linux常见性能以及稳定性问题的诊断能力

Agent 在接收到用户意图后,自动匹配对应的 Skill 并执行,无需人工指定调用路径。

AgentSecCore

AgentSecCore是面向 AI Agent 运行平台的操作系统级安全内核。在 AI Agent 逐步获得操作系统级别的执行能力(包括文件读写、网络访问、进程管理等)的背景下,传统应用安全边界已不再适用。AgentSecCore 从 OS 层面为 Agent 构建纵深防御体系,确保 Agent 在受控、可审计、最小权限的环境中安全运行。

AgentSecCore 围绕"意图安全"和"系统级兜底"两大支柱,构建了三层纵深防御体系——即使前一层被突破,后续层仍能兜住。架构自下而上为:

层级 防护能力 技术实现
第一层:执行前画边界(预防) Prompt Scanner Code Scanner Skill Ledger 提示注入与越狱检测引擎(规则+ML+向量检索三层递进) 代码执行前安全拦截器(28条检测规则,支持Shell/Python) Skill 完整性防篡改引擎(快照签名 + 只追加版本链 + 四阶段安全扫描)
第二层:执行中做感知(检测) 安全可观测 覆盖沙箱隔离、系统加固、资产完整性三域,结构化安全事件持久化,按需生成安全汇总报告
第三层:底层做兜底(遏制) 安全基线巡检 OS级隔离与监控 OS级安全加固规则库自动扫描,检测Agent对系统安全水位的破坏,生成偏离报告和修复建议 依托Linux内核安全原语(Namespace/Cgroup/seccomp/Capability),提供进程级沙箱隔离、系统调用监控与拦截、细粒度权限控制

AgentSight

AgentSight 是面向 AI Agent 运行平台的操作系统级可观测组件,解决 Agent 运行中 Token 消耗远超预期、用户缺乏感知与追溯手段的问题。它在零侵入业务逻辑的前提下,实现对 Agent 运行全链路的细粒度数据采集与关联分析。

AgentSight 主要提供以下三项能力:

  • Token消耗分析:对 Agent 运行过程中的 Token 消耗进行全方位度量与归因。支持按时间段或最近 N 小时灵活查询,支持按智能体、任务、角色等多维度拆分消耗来源,分析粒度可精确至单次 LLM 调用。

  • 行为审计:全链路记录 Agent 的 LLM 调用与进程执行行为。完整留存每次调用的提供商、模型版本等元数据,同步捕获进程命令行参数,支持按时间、会话等多维度进行筛选与可视化汇总统计。

  • Dashboard 可视化:提供 Web 可视化界面,支持远程部署后通过本地浏览器直接访问。可实时查看 Token 消耗趋势、监控 Agent 进程状态并提供异常重启能力,同时支持逐层深入查看每次 Session 的完整 Trace 链路,包括用户输入、模型提示词、推理过程及每一步 Token 消耗分布。

ws-ckpt

ws-ckpt 是ANOLISA 面向 AI Agent 工作区的文件级快照与回滚工具(AI Agent Workspace Checkpoint)。

AI Agent 在执行任务时会对工作区文件进行大量修改,一旦操作失误或结果不符预期,用户往往面临难以恢复的困境。ws-ckpt 快照机制为工作区提供轻量级的快照管理能力,用户可在关键操作前手动创建快照,或开启每轮问答结束自动快照,需要回退时一键恢复至任意历史状态,让 Agent 的操作可撤回、可追溯。

ws-ckpt 的核心设计理念是给「 Agent 的工作上保险」。用户在执行危险操作前通过自然语言或 CLI 手动创建快照,或进行文件频繁修改任务时开启每轮问答结束自动快照,首次创建快照时系统自动完成初始化,无需额外配置。

ws-ckpt 主要提供以下能力:

能力 说明
手动快照 用户在关键操作前通过自然语言或 CLI 命令手动创建工作区快照
自动快照 用户在进行文件频繁修改任务时开启每轮问答结束自动快照开关(目前已支持 OpenCalw 和 Hermes )
一键回滚 支持回退至任意历史快照,恢复工作区文件到指定时间点的完整状态
快照管理 提供快照列表查看与删除能力,支持用户自定义快照标识与描述
双模交互 同时支持自然语言交互(通过 Agent 对话)与 CLI 命令两种操作模式

Tokenless

Tokenless 是 ANOLISA 的 Token 优化组件,从上下文压缩和命令过滤两个维度降低 Agent 与 LLM 交互的 Token 消耗。

随着 Agent 承接的任务日益复杂,工具定义的膨胀、结构化响应的冗余、以及命令输出的噪音会快速填满上下文窗口,既推高推理成本,也挤占有效信息的传达空间。Tokenless

在 Agent 与 LLM 之间构建一条智能优化管线:在前端,自动精简工具定义的描述信息,识别并过滤响应中的低价值字段;在中段,对结构化数据进行紧凑编码,进一步压缩体积;在后端,智能过滤命令执行输出中的干扰内容。三者协同工作,在不改变 Agent 行为语义的前提下显著降低 Token 开销。

Tokenless 旨在让 Agent 用更少的 Token 完成相同的任务。整个优化过程通过插件和 Hook 机制自动介入,对上游 Agent 框架完全透明,无需修改业务代码。所有压缩效果均有量化记录,为评估优化收益提供数据支撑。

Tokenless 支持 cosh、OpenClaw、Hermes Agent、Claude Code、Codex、Qoder CLI、Qwen Code 七个 Agent 框架。其中 cosh 默认集成,rpm 安装后自动生效,无需额外配置;其余框架通过各 adapter 目录下的 scripts/install.sh 一键完成插件注册。

Tokenless 主要提供以下能力:

能力 说明
上下文压缩 精简 Function Calling工具定义、过滤 CLI 命令响应中的干扰信息、紧凑编码压缩结构化数据
统计追踪 自动记录压缩前后对比,按类型汇总节省量
透明集成 通过插件和 Hook 自动介入,对 Agent 框架零侵入

AgentMemory

Agent-Memory 是 ANOLISA 的文件形态记忆 MCP 服务器,为 AI Agent 提供持久化、可搜索、受沙箱保护的记忆空间。

Agent 在执行跨会话任务时面临记忆断裂问题:每次新对话从零开始,无法复用之前的分析结果、决策记录和用户偏好。Agent-Memory 以文件系统为记忆模型,在 Agent 与记忆仓之间构建一条标准化的存取管线:在存储侧,Agent 像操作文件一样读写记忆内容,支持命名空间隔离与路径沙箱;在检索侧,通过 BM25 与稠密向量混合检索,按语义召回相关记忆片段;在治理侧,提供 git 版本控制与快照备份,确保记忆可追溯、可回滚。三者协同工作,让 Agent 的记忆跨越会话边界,实现上下文延续。

Agent-Memory 旨在让 Agent 用更少的 Token 完成跨会话任务。整个服务通过 MCP 协议暴露 37 个标准工具,支持 Claude Code、Cursor、Continue 等任意 stdio MCP 客户端,对上游 Agent 框架完全透明,无需修改业务代码。内核级安全沙箱(openat2)保护记忆仓不被路径穿越或符号链接逃逸,提示注入检测与转义包装确保注入 LLM 记忆内容安全可控。

Agent-Memory 主要提供以下能力:

能力 说明
文件形态记忆 以文件系统语义读写记忆,支持命名空间隔离和路径沙箱,提供读写、追加、编辑、搜索、删除等 11 个文件操作工具
混合语义搜索 BM25 + 稠密向量 + RRF 融合检索,支持 OpenAI 与 Ollama embedding provider,搭载中文友好的 trigram 分词
透明集成 通过 MCP 协议提供 37 个标准工具,OpenClaw 通过 scripts/install.sh 一键安装插件,对 Agent 框架零侵入

更多关于Alibaba Cloud Linux 4 Agentic Edition(ANOLISA)的介绍,请移步到Alibaba Cloud Linux官网:https://www.aliyun.com/product/alinux 查看。

相关文章
人工智能 缓存 前端开发
12230 67
人工智能 自然语言处理 安全
1172 0
Web App开发 人工智能 API
1470 1
人工智能 JavaScript 开发工具
4847 17
人工智能 Java BI
1546 1
人工智能 JavaScript 测试技术
2479 2
开发工具 Swift git
1989 6
人工智能 JavaScript 测试技术
1220 4