绷不住了,Agent 每次从零烧 token?6.6k Star OpenSpace 把 Skill 变成会进化的资产

简介: OpenSpace 是一个围绕 Skill 自我进化的开源项目,目标是让 AI Agent 从真实任务中学习、修复、沉淀和共享经验。

嗨,我是小华同学,专注解锁高效工作与前沿AI工具!每日精选开源技术、实战技巧,助你省时50%、领先他人一步。👉免费订阅,与10万+技术人共享升级秘籍!

OpenSpace 最值得看的,不是又多了一个 Agent 框架,而是它在解决一个更扎心的问题:Agent 做完任务后,经验到底有没有留下来?

如果你用过 Claude Code、Codex、Cursor、OpenClaw 或 MCP 工具链,大概率见过这种情况:同一个坑,今天踩一次,明天换个会话继续踩。

这篇先用 3 分钟讲清:OpenSpace 想怎么让 Agent 越做越会、越做越省,以及它适不适合放进你的项目里。

场景创作封面:OpenSpace 技能进化工厂

这个项目为什么值得看

OpenSpace 是 HKUDS 开源的一个 Agent 技能进化项目。我今天抓到的数据是:6,660 Star、822 Fork、Python、MIT 协议

README 里的定位非常直接:

让 Agent 更聪明、更低成本、自我进化。

它不是单纯让 Agent 多接几个工具,而是围绕 Skill 做一套生命周期:执行、记录、监控、分析、修复、派生、沉淀、共享。

说人话就是:

不要让 Agent 每次都从零开干,而是把成功经验变成下一次能复用的 Skill。

README 图:OpenSpace Benchmark 核心指标


它解决的不是“会不会调用工具”

现在很多 Agent 已经能调用工具、写代码、查资料、跑脚本。

但真正做复杂任务时,问题往往不是“没有工具”,而是:

常见痛点 真实表现 OpenSpace 的方向
token 白烧 每次都重新推理、重新试错 复用成功流程,减少重复探索
技能会过期 API、页面、依赖一变,旧 Skill 静默失效 监控质量,触发修复
经验困在单个 Agent 一个 Agent 学会了,另一个还要重来 通过 Skill 社区共享演化结果
复杂任务难稳定 工具链很长,中间一步错就崩 把可靠执行模式沉淀成 Skill

这就是 OpenSpace 的切入点:Agent 不该只是一次性执行器,而应该有经验积累。

白板手绘创作图:OpenSpace 技能进化层定位

三个关键词:FIX、DERIVED、CAPTURED

OpenSpace 里最容易被技术读者记住的,是三种 Skill 演化模式。

FIX:修坏掉的 Skill。

当工具、依赖、接口变化导致原来的 Skill 不稳定时,它不是简单报错结束,而是尝试定位问题并修复。

DERIVED:从旧 Skill 派生更强版本。

如果一个任务场景需要更细分的能力,它可以从已有 Skill 演化出更适合的新 Skill,而不是把所有能力都塞进一个大而全文件。

CAPTURED:把成功经验捕获成新 Skill。

如果某次执行里出现了可复用的工作流,它可以被沉淀出来,下次类似任务就不用重新摸索。

这三个词放在一起,OpenSpace 的思路就清楚了:

让 Skill 不再是静态说明书,而是会被真实任务不断打磨的工程资产。

README 图:OpenSpace 框架


README 里最硬的数字

OpenSpace 的 README 里给了一组很适合传播的 benchmark 数字。

它在 GDPVal 上做评估:这个数据集包含真实世界专业任务,覆盖多个职业场景。README 里写到,OpenSpace 使用和 ClawWork 基线相同的骨干 LLM:Qwen 3.5-Plus。

关键数字包括:

  • 50 个专业任务
  • 收入提升 4.2 倍
  • Phase 2 token 用量约为 Phase 1 的 45.9%
  • 50 个 Phase 1 任务中自主进化出 165 项 Skill

我不会把这些数字理解成“所有场景都能 4.2 倍”。更合理的理解是:

当任务有重复模式、工具链较长、交付质量需要验证时,Skill 演化才更容易释放价值。

这也是为什么它对文档生成、合规表单、表格、工程项目、多文件工作流这类任务更有想象力。

工作流可以这样理解

OpenSpace 的接入方式有两条线:

  1. 作为 Agent 的 Skill / MCP 能力接入,比如给 Claude Code、Codex、OpenClaw、nanobot 等使用。
  2. 直接把 OpenSpace 当成 AI co-worker,用它执行编码、搜索、工具调用等任务。

但从产品逻辑看,真正重要的是这条闭环:

任务执行不是终点,执行记录会反过来喂给 Skill 演化系统。

白板板书图:OpenSpace 工作流

这就像给 Agent 加了一个“复盘系统”。

不是今天做完就散,而是把过程、问题、修复、成功路径都变成下一次能用的东西。

程序员为什么该关注

如果你正在做 Agent 产品、自动化工具、MCP 服务、内部研发助手,这个项目值得先收藏。

你的场景 可能获得的启发
做 Agent 平台 Skill 生命周期不能只靠人工维护
做企业自动化 成功流程可以沉淀成可审计、可复用资产
做 Coding Agent 修复工具链、验证输出、复用工作流很关键
做知识/工作流系统 经验共享比单次问答更有长期价值
研究成本优化 降 token 不一定只靠模型路由,也可以靠少重复试错

我最看重的一点是:

OpenSpace 把“Agent 经验如何沉淀”这个问题,从玄学变成了可设计的工程系统。

但它不是万能药

这类项目很容易被标题吹过头,所以边界也要说清楚。

OpenSpace 不是装上就让所有 Agent 自动封神。它更适合有复杂任务、长期使用、重复流程、Skill 维护成本的场景。

如果你的任务本来就是一次性问答,或者流程很短、几乎没有复用价值,那 Skill 演化的收益就没那么明显。

另外,Skill 共享也一定要考虑安全边界:权限、凭证、提示注入、危险操作、团队可见性,都不能靠热情解决。

Agent 越会学习,越需要治理。

我的判断

OpenSpace 的价值,不是告诉我们“Agent 又强了”,而是提醒我们:

下一阶段的 Agent 工程化,可能不只是拼模型、拼工具,而是拼 经验复用能力

模型负责思考,工具负责执行,而 Skill 负责把成功经验留下来。

这篇先作为项目速览。后面如果大家感兴趣,我会继续把它的 MCP 接入方式、host_skills 设计、Skill 演化源码、以及 GDPVal benchmark 怎么看的问题拆开讲。

如果你也关注 AI Agent、MCP、开源项目和 LLM 工程化,可以继续关注我的后续更新。

项目地址

https://github.com/HKUDS/OpenSpace

相关文章
|
3天前
|
存储 弹性计算 缓存
阿里云服务器租赁费用:新版租赁收费标准及活动报价参考
本文更新了2026年阿里云全系列云服务器租赁活动报价,所有特惠资源均可前往阿里云活动中心选购,整体覆盖从个人入门到企业级高性能场景的全梯度需求。其中轻量应用服务器主打极致性价比,2核2G峰值200M带宽配置每日10点、15点限时抢购价仅38元/年,2核4G配置379元/年起;高性价比的经济型e实例、通用算力型u2i实例覆盖2核4G至4核32G全档位,适配开发测试与中小型企业业务;搭载英特尔至强6处理器的第九代c9i企业级实例算力较上代提升20%,支撑高并发生产环境,不同实例规格价差清晰,用户可根据自身业务负载与预算灵活选型。
1445 109
|
10天前
|
云安全 人工智能 运维
阿里云联动百位企业安全专家,共识Agent防御最佳实践
当Agent成为新员工,你的安全边界在哪里?
1934 8
阿里云联动百位企业安全专家,共识Agent防御最佳实践
|
4天前
|
编解码 人工智能 安全
2核4G/4核8G/8核16G阿里云服务器如何选择实例?经济型e、通用算力型u2i与计算型c9i选哪个?
本文介绍了阿里云2核4G、4核8G、8核16G三档主流配置下经济型e、通用算力型u2i和计算型c9i三种实例的最新活动价格与适用场景。同配置下三者价差显著,以2核4G为例,经济型e低至599.93元/年,计算型c9i则高达1742.08元/年。文章详细解析了各实例的性能定位:经济型e适合轻负载入门场景,u2i兼顾稳定算力与性价比,c9i凭借第9代至强处理器与芯片级安全能力支撑高性能业务。同时提示用户可叠加满减优惠券享受折上折,建议根据业务负载与预算综合决策。
513 112
|
4天前
|
人工智能 程序员 API
Codex 接入 DeepSeek-V4-Flash:还能补上识图,提供两套方案
Codex 接入 DeepSeek-V4-Flash 怎么配?本文覆盖 CLI 与桌面端,再用 qwen3-vl-flash 补识图,两套方案可直接照做
|
8天前
|
存储 人工智能 关系型数据库
阿里云AI产品与云产品最新组合套餐:Token Plan、AI coding及云服务器和建站等组合优惠价
阿里云推出全新“算力+模型+应用”一站式云与AI组合套餐活动,覆盖从个人开发者到中大型企业的全场景需求。核心亮点为分三档定价的Token Plan订阅服务,支持Qwen3.8-Max-Preview大模型调用,错峰时段最低可享0.2折优惠。活动同步推出AI Coding、智能体部署、云电脑托管、0代码建站等十余类场景化组合,搭配99元/年的普惠云服务器、88元/年的入门数据库等经典特惠产品,还为企业提供1V1定制化AI转型方案,大幅降低了不同用户群体拥抱AI的技术门槛与采购成本。
700 111
|
18天前
|
人工智能 JSON 安全
Fastjson远程代码执行漏洞,阿里云AI安全为您保驾护航
阿里云AI安全产品联动防御Fastjson攻击
2617 13
Fastjson远程代码执行漏洞,阿里云AI安全为您保驾护航
|
16天前
|
人工智能 前端开发 Linux
Codex 桌面版安装 + CC Switch 接入第三方 API 完整教程(2026 最新)
2026最新教程:手把手教你安装Codex桌面版,通过CC Switch v3.17.0一键接入Fenno等国产API(兼容OpenAI Responses格式),跳过账号登录,完整启用代码审查、多步任务与上下文感知功能。零基础友好,全程图文实操。(239字)
2232 3
|
5天前
Qoder 一周年 × Qwen3.8-Max 正式上线,多重好礼限时领
8月3日,Qwen3.8-Max 正式上线Qoder,迎来Qoder一周年。新老用户可领800次免费调用,下单再赠2000次;夜间(22:00–08:00)调用5折;邀请好友双方得积分与调用额度。
349 0
|
18天前
|
人工智能 自然语言处理 数据挖掘
Qwen3.8-Max-Preview深度全解析:2.4万亿参数旗舰MoE模型+Token Plan限时优惠完整落地指南
2026年7月,全新旗舰级混合专家大模型Qwen3.8-Max-Preview正式开放抢先体验,作为通义千问Qwen3系列规格最高、综合推理能力顶尖的新一代模型,该模型总参数量达到2.4万亿(2.4T),是当前线上可调用的原生多模态旗舰模型,综合推理水准对标海外顶级Fable 5模型,在复杂工程开发、长文档深度分析、多步骤智能体自治、跨境多语言创作、海量数据挖掘五大高难度业务场景实现跨越式性能提升。
1532 3

热门文章

最新文章