字节开源 DeerFlow 2.0:让 AI 不止于聊天

简介: 字节开源 DeerFlow 2.0 超智能 Agent 框架,MIT 协议开源,主打复杂长任务处理。依托子智能体、技能流程、沙盒代码执行与跨会话记忆,可自主拆解任务、存文件、定时自动化,适合开发者搭建 AI 工作系统,突破传统单轮对话 AI 局限。

不只是聊天框

最近翻 GitHub,看到字节开源的 DeerFlow 2.0,第一反应是:这东西不像又一个“AI 聊天壳子”。

它更像是在认真回答一个问题:AI Agent 到底怎么才能从“回答得不错”,变成“真的能把事做完”?

这个问题挺现实的。

现在很多大模型,单轮问答确实很强。让它解释代码、总结文章、写个文案,基本都能给你整出点东西。但只要任务稍微长一点,比如做调研、写报告、查资料、生成文件、跑脚本、反复修改,它就容易开始迷路。

前面说过什么忘了,任务做到哪一步忘了,甚至自己刚刚生成的文件放哪了也忘了。说人话就是:聪明,但不太会收拾桌子。

DeerFlow 想解决什么

DeerFlow 全称是 Deep Exploration and Efficient Research Flow。早期它更偏 Deep Research 框架,但 2.0 已经彻底重写,定位也变成了一个 open-source super agent harness。

这个词听起来有点硬。简单说,它不是单独做一个模型,也不是只做一个网页聊天框,而是把模型、工具、记忆、沙盒、子 Agent、文件系统这些东西组织起来,让 Agent 能围绕一个目标持续干活。

截至目前,DeerFlow 在 GitHub 上已经有 7.7 万多 star,MIT 协议开源。项目在 2026 年 2 月 28 日 DeerFlow 2 发布后,还冲到过 GitHub Trending 第一。开发者爱不爱一个东西,嘴上可能会客气,star 一般比较诚实。

长任务才是重点

DeerFlow 2.0 最值得看的地方,是它把“长任务”当成了核心场景。

比如你让它做一份行业调研,它不是只靠模型憋一篇文章出来,而是可以把任务拆成多个 sub-agents:有的负责搜资料,有的负责看竞品,有的负责整理结构,有的负责生成最终报告。最后再把结果合起来。

这就比较接近真实工作了。

我们平时做事也不是一口气写完所有内容。先查资料,开几个文档,跑点脚本,整理中间结果,发现不对再返工。AI 要想真干活,也绕不开这些步骤。

给 Agent 装上工作流

DeerFlow 里有一个很关键的设计:Skills。

你可以把 Skills 理解成 Agent 的“技能说明书”。一个 skill 通常是一套结构化流程,告诉 Agent 遇到某类任务该怎么做、用什么工具、参考哪些资源。这样它就不完全靠临场发挥了。

这点很重要。模型临场发挥有时很惊艳,有时也很像一个刚入职但特别自信的实习生。Skills 至少能让它按流程来。

不只会说,还能动手

DeerFlow 不只是让 Agent 在对话框里打字,它可以在受控环境里执行代码、操作文件、保存中间结果。

对数据处理、代码生成、网页生成、报告生成这些任务来说,这不是加分项,而是基本盘。

它还会做上下文管理。长任务最怕上下文爆掉,DeerFlow 会做摘要压缩,把中间结果落到文件系统里,也会总结子任务进度。

换句话说,它知道不能什么都塞进模型脑子里。人脑都扛不住,模型也别硬扛。

记住你怎么工作

DeerFlow 支持跨 session 的 memory,可以逐步记住你的偏好、技术栈、写作风格和常用工作流。

这个方向挺有意思,因为真正有用的 AI 助手,不应该每次见你都像第一次相亲。

DeerFlow 还内置了 scheduled tasks,可以做一次性任务,也可以跑 cron。比如定期生成日报、监控信息、整理资料,这类事情本来就很适合交给 Agent。

人类不应该把生命浪费在每天复制粘贴同一套流程上。

适合谁用

当然,DeerFlow 不是那种点开网页就能立刻爽用的消费级工具。

它更适合开发者、AI 应用团队、自动化工作流团队,或者想搭内部 Agent 平台的人。你需要配置模型、搜索工具和运行环境,还要认真看安全说明。

毕竟它能执行命令、操作文件、调用工具,权限不小。部署到公网还裸奔,那就不是技术探索,是给自己加戏。

AI Agent 的下一步

我觉得 DeerFlow 2.0 有意思的地方,不是它又做了一个 AI 助手,而是它把 Agent 往“工作台”方向推了一步。

过去我们问 AI:“你能不能回答这个问题?”

现在更实际的问题是:“我给你一个目标,你能不能自己拆步骤、调工具、存结果、遇到问题继续推进,最后把东西交出来?”

这才是 AI Agent 真正难的地方。

DeerFlow 2.0 还不一定是最终答案,但它是一个很值得看的开源样本。因为未来的 AI 应用,大概率不会只是一个个聊天窗口,而是一套套能持续执行任务的系统。

聊天很重要。

但能把活干完,才是真的香。

相关文章
|
5天前
|
人工智能 安全 测试技术
|
7天前
|
云安全 人工智能 安全
阿里云 Agentic SOC 位居 IDC MarketScape安全运营智能体2026领导者类别
以 Agentic AI 重构安全运营闭环,阿里云云安全在产品能力与市场份额
1199 3
|
8天前
|
缓存 UED 开发者
Codex109天重置23次,明天还要再送一次
Codex近109天完成23次额度重置,7月14日将迎来第24次。Tibo高频响应用户反馈:优化GPT-5.6高消耗问题、补发失效福利、调整重置时间——形成“反馈→回应→修复→补偿”正向闭环,彰显以用户为中心的产品哲学。(239字)
762 12
|
1天前
|
人工智能 运维 数据挖掘
最新版通义千问(Qwen3.8-Max-Preview)功能介绍
2026年7月,阿里云通义千问正式对外开放**Qwen3.8-Max-Preview旗舰预览模型**,作为目前千问系列规格最高、综合性能最强的新一代万亿级AI模型,该模型搭载2.4T超大参数架构,是阿里云首款突破万亿参数的原生多模态旗舰模型,全面覆盖文本、图像、视频、文档多维度处理能力。相较于前代热门Qwen3.7-Max版本,本次预览版实现全方位跨越式升级,在真实工程开发、多智能体长周期任务、全链路办公自动化、海量数据分析等高阶场景中,综合能力已达到全球顶尖模型水准。现阶段该模型已正式开放抢先体验通道,依托阿里云百炼Token Plan、Qoder编码平台、QoderWork办公终端三大专属
1455 0
|
7天前
|
数据采集 机器学习/深度学习 人工智能
田间杂草定位与检测4200张YOLO智慧农业数据集分享
本数据集含4200张真实农田图像,YOLO格式,单类别(杂草)高质量标注,覆盖多作物、多光照、多生长阶段等复杂场景,专为智慧农业杂草检测与智能除草设备研发设计,支持YOLOv5/v8/v10等主流模型训练。
378 94
|
11天前
|
存储 人工智能 JSON
Qwen 本地部署搭配 ComfyUI 生成 AI 漫剧完整实操指南(小白零基础可落地,零成本无限生成+角色一致性天花板)
2026全网最优本地漫剧流水线:零成本、离线运行、角色统一、低配(8G显卡)可跑。融合Qwen本地大模型+ComfyUI双引擎,实现剧本生成→分镜绘图→动态成片全自动,隐私安全、无审核限流,新手30分钟上手,日更无忧。(239字)
|
2天前
|
人工智能
Qwen3.8抢先体验!正式版即将发布并开源!
千问Qwen3.8即将开源,参数达2.4T,进化速度以“天”计,实力媲美Fable 5。预览版Qwen3.8-Max已上线阿里Token Plan等平台,限时优惠:日间Credits低至1折,夜间更优,个人/团队版月付仅35元起!
398 15
|
5天前
|
Web App开发 数据采集 人工智能
|
6天前
|
人工智能 自然语言处理 云计算
2026阿里云大使招募:抢占AI先机,轻松赚取最高30%返佣,享官方全程陪跑支持!
阿里云2026云大使计划全新升级!无门槛加入,覆盖个人与企业。推广400+款产品(含热门MAAS产品,如秒悟、百炼等),享高额返佣+长周期收益。官方提供培训、方案落地、客户陪跑全链路支持,助你成为AI时代超级连接者。会分享,就能赚!