自动查文献+写代码+跑数据+出报告!港大开源 Auto Deep Research 搞定科研全流程

简介: Auto-Deep-Research 是一款由香港大学开源的个人 AI 助理,基于模块化多 Agent 架构,专注于深度研究任务,兼容多种大语言模型,并提供一键启动和文件解析等强大功能。

❤️ 如果你也关注 AI 的发展现状,且对 AI 应用开发感兴趣,我会每日分享大模型与 AI 领域的开源项目和应用,提供运行实例和实用教程,帮助你快速上手AI技术!

🥦 AI 在线答疑 -> 智能检索历史文章和开源项目 -> 尽在微信公众号 -> 搜一搜:蚝油菜花 🥦


🧠 "实验室经费在燃烧?这个开源项目如何用三个AI分身搞定科研全流程!"

大家好,我是蚝油菜花。当你还在:

  • 🔧 手动整理上百篇文献摘要到凌晨3点
  • 💸 为GPT-4的API账单心惊肉跳
  • 🤯 在Python脚本和Excel表格间反复横跳...

Auto-Deep-Research 带来了变革性解决方案!这个由港大黄超教授团队开源的多Agent系统,集成了:

  • ✅ 文献蜘蛛:自动抓取最新研究成果并生成综述
  • ✅ 代码医师:debug数据分析脚本+自动优化可视化
  • ✅ 报告管家:按期刊模板一键生成完整论文

依托 模块化调度器 ,这些AI分身能:

  • 🔄 自主协商任务分配(比如先爬数据再建模)
  • 💡 支持4大类LLM随时切换(Anthropic/OpenAI/Mistral/HF)
  • 📦 容器化部署避免环境依赖噩梦

现在,让我们一起揭开这个开源科研利器 Auto-Deep-Research 的技术面纱!

🚀 快速阅读

Auto-Deep-Research 是一个专注于复杂任务自动化的开源 AI 助理。

  1. 核心功能:支持深度研究、多格式文件解析、网络搜索与编程实现。
  2. 技术原理:采用模块化多 Agent 架构,协同完成互联网信息搜索、编程调试与文件处理任务。

Auto-Deep-Research 是什么

Auto-Deep-Research

Auto-Deep-Research 是香港大学黄超教授实验室开源的一款全自动个人 AI 助理,旨在成为 OpenAI Deep Research 的开源替代方案。它基于 AutoAgent 框架开发,采用模块化的多 Agent 架构设计,包含 Web Agent(互联网信息搜索)、Coding Agent(编程实现与调试)和 Local File Agent(文件解析与理解)。这些 Agent 通过核心调度器(Orchestrator Agent)协同工作,为用户提供高效的任务自动化处理能力。

该项目专注于复杂任务的自动化处理,如文件解析、数据分析与可视化,并能够生成详细的报告。Auto-Deep-Research 兼容多种大语言模型(LLM),包括 Anthropic、OpenAI、Mistral 和 Hugging Face 等,同时支持导入浏览器 Cookies,以更好地访问特定网站。

此外,Auto-Deep-Research 以其高性价比著称,仅基于 Claude-3.5-Sonnet 构建,大幅降低了使用成本,是研究人员、教育工作者和企业用户的理想选择。

Auto-Deep-Research 的主要功能

  • 深度研究功能:专注于复杂任务的自动化处理,如文件解析、网络搜索、数据分析与可视化,生成高质量的研究报告。
  • 多语言模型支持:兼容多种大语言模型(LLM),包括 Anthropic、OpenAI、Mistral、Hugging Face 等。
  • 高性价比:基于 Claude-3.5-Sonnet 构建,显著降低使用成本。
  • 社区驱动改进:根据社区反馈增加了如一键启动和增强的 LLM 兼容性等功能。
  • 易于部署:支持通过 Conda 环境或 Docker 安装,提供详细的启动配置选项。

Auto-Deep-Research 的技术原理

  • 多 Agent 架构:包含 Web Agent(互联网信息搜索)、Coding Agent(编程实现与调试)和 Local File Agent(文件解析与理解),通过核心调度器(Orchestrator Agent)协同工作。
  • Web Agent:专注于互联网信息的无障碍访问和深度搜索。
  • Coding Agent:负责编程实现和调试,具备严密的逻辑分析能力。
  • Local File Agent:致力于多格式文件的解析和内容理解。

如何运行 Auto-Deep-Research

下面将指导你如何安装 Docker、配置 API 密钥以及启动 Auto-Deep-Research。同时将展示如何通过不同 LLM 提供商运行 Auto-Deep-Research,并提供一些实用技巧。

1. Docker 安装

Auto-Deep-Research 使用 Docker 来容器化交互环境,因此请先安装Docker。你无需手动拉取预构建的镜像,因为 Auto-Deep-Research 会根据你的机器架构自动拉取对应的镜像。

2. API 密钥设置

创建一个环境变量文件(例如 .env),并在其中设置你计划使用的 LLM 的 API 密钥。并非所有 LLM 的 API 密钥都是必需的,根据你的需求进行设置即可。

示例 .env 文件内容:

ANTHROPIC_API_KEY=your_anthropic_api_key
OPENAI_API_KEY=your_openai_api_key

3. 启动 Auto-Deep-Research

命令选项

运行 auto deep-research 命令以启动 Auto-Deep-Research。以下是一些常用配置选项:

  1. --container_name:指定 Docker 容器的名称(默认值:deepresearch)。
  2. --port:指定容器使用的端口(默认值:12346)。
  3. COMPLETION_MODEL:指定要使用的 LLM 模型,需遵循Litellm的命名规范(默认值:claude-3-5-sonnet-20241022)。
  4. DEBUG:启用调试模式以获取详细日志(默认值:False)。
  5. API_BASE_URL:指定 LLM 提供商的 API 基础 URL(默认值:None)。
  6. FN_CALL:启用函数调用功能(默认值:None)。大多数情况下可以忽略此选项,因为我们已经根据模型名称设置了默认值。

使用不同 LLM 提供商启动 Auto-Deep-Research

Anthropic

设置 API 密钥

.env 文件中设置 ANTHROPIC_API_KEY

ANTHROPIC_API_KEY=your_anthropic_api_key

启动命令

运行以下命令启动 Auto-Deep-Research:

auto deep-research

默认模型为 claude-3-5-sonnet-20241022

OpenAI

设置 API 密钥

.env 文件中设置 OPENAI_API_KEY

OPENAI_API_KEY=your_openai_api_key

启动命令

运行以下命令启动 Auto-Deep-Research:

COMPLETION_MODEL=gpt-4o auto deep-research

Mistral

设置 API 密钥

.env 文件中设置 MISTRAL_API_KEY

MISTRAL_API_KEY=your_mistral_api_key

启动命令

运行以下命令启动 Auto-Deep-Research:

COMPLETION_MODEL=mistral/mistral-large-2407 auto deep-research

Gemini - Google AI Studio

设置 API 密钥

.env 文件中设置 GEMINI_API_KEY

GEMINI_API_KEY=your_gemini_api_key

启动命令

运行以下命令启动 Auto-Deep-Research:

COMPLETION_MODEL=gemini/gemini-2.0-flash auto deep-research

Huggingface

设置 API 密钥

.env 文件中设置 HUGGINGFACE_API_KEY

HUGGINGFACE_API_KEY=your_huggingface_api_key

启动命令

运行以下命令启动 Auto-Deep-Research:

COMPLETION_MODEL=huggingface/meta-llama/Llama-3.3-70B-Instruct auto deep-research

Groq

设置 API 密钥

.env 文件中设置 GROQ_API_KEY

GROQ_API_KEY=your_groq_api_key

启动命令

运行以下命令启动 Auto-Deep-Research:

COMPLETION_MODEL=groq/deepseek-r1-distill-llama-70b auto deep-research

OpenAI-Compatible Endpoints(例如 Grok)

设置 API 密钥

.env 文件中设置 OPENAI_API_KEY

OPENAI_API_KEY=your_api_key_for_openai_compatible_endpoints

启动命令

运行以下命令启动 Auto-Deep-Research:

COMPLETION_MODEL=openai/grok-2-latest API_BASE_URL=https://api.x.ai/v1 auto deep-research

OpenRouter(例如 DeepSeek-R1)

我们建议暂时使用 OpenRouter 作为 DeepSeek-R1 的 LLM 提供商,因为官方 API 的效率较低。

设置 API 密钥

.env 文件中设置 OPENROUTER_API_KEY

OPENROUTER_API_KEY=your_openrouter_api_key

启动命令

运行以下命令启动 Auto-Deep-Research:

COMPLETION_MODEL=openrouter/deepseek/deepseek-r1 auto deep-research

DeepSeek

设置 API 密钥

.env 文件中设置 DEEPSEEK_API_KEY

DEEPSEEK_API_KEY=your_deepseek_api_key

启动命令

运行以下命令启动 Auto-Deep-Research:

COMPLETION_MODEL=deepseek/deepseek-chat auto deep-research

资源


❤️ 如果你也关注 AI 的发展现状,且对 AI 应用开发感兴趣,我会每日分享大模型与 AI 领域的开源项目和应用,提供运行实例和实用教程,帮助你快速上手AI技术!

🥦 AI 在线答疑 -> 智能检索历史文章和开源项目 -> 尽在微信公众号 -> 搜一搜:蚝油菜花 🥦

相关文章
|
6天前
|
存储 弹性计算 缓存
阿里云服务器租赁费用:新版租赁收费标准及活动报价参考
本文更新了2026年阿里云全系列云服务器租赁活动报价,所有特惠资源均可前往阿里云活动中心选购,整体覆盖从个人入门到企业级高性能场景的全梯度需求。其中轻量应用服务器主打极致性价比,2核2G峰值200M带宽配置每日10点、15点限时抢购价仅38元/年,2核4G配置379元/年起;高性价比的经济型e实例、通用算力型u2i实例覆盖2核4G至4核32G全档位,适配开发测试与中小型企业业务;搭载英特尔至强6处理器的第九代c9i企业级实例算力较上代提升20%,支撑高并发生产环境,不同实例规格价差清晰,用户可根据自身业务负载与预算灵活选型。
1620 116
|
7天前
|
人工智能 程序员 API
Codex 接入 DeepSeek-V4-Flash:还能补上识图,提供两套方案
Codex 接入 DeepSeek-V4-Flash 怎么配?本文覆盖 CLI 与桌面端,再用 qwen3-vl-flash 补识图,两套方案可直接照做
1101 5
|
13天前
|
云安全 人工智能 运维
阿里云联动百位企业安全专家,共识Agent防御最佳实践
当Agent成为新员工,你的安全边界在哪里?
1954 9
阿里云联动百位企业安全专家,共识Agent防御最佳实践
|
7天前
|
编解码 人工智能 安全
2核4G/4核8G/8核16G阿里云服务器如何选择实例?经济型e、通用算力型u2i与计算型c9i选哪个?
本文介绍了阿里云2核4G、4核8G、8核16G三档主流配置下经济型e、通用算力型u2i和计算型c9i三种实例的最新活动价格与适用场景。同配置下三者价差显著,以2核4G为例,经济型e低至599.93元/年,计算型c9i则高达1742.08元/年。文章详细解析了各实例的性能定位:经济型e适合轻负载入门场景,u2i兼顾稳定算力与性价比,c9i凭借第9代至强处理器与芯片级安全能力支撑高性能业务。同时提示用户可叠加满减优惠券享受折上折,建议根据业务负载与预算综合决策。
538 112
|
19天前
|
人工智能 前端开发 Linux
Codex 桌面版安装 + CC Switch 接入第三方 API 完整教程(2026 最新)
2026最新教程:手把手教你安装Codex桌面版,通过CC Switch v3.17.0一键接入Fenno等国产API(兼容OpenAI Responses格式),跳过账号登录,完整启用代码审查、多步任务与上下文感知功能。零基础友好,全程图文实操。(239字)
2747 4
|
11天前
|
存储 人工智能 关系型数据库
阿里云AI产品与云产品最新组合套餐:Token Plan、AI coding及云服务器和建站等组合优惠价
阿里云推出全新“算力+模型+应用”一站式云与AI组合套餐活动,覆盖从个人开发者到中大型企业的全场景需求。核心亮点为分三档定价的Token Plan订阅服务,支持Qwen3.8-Max-Preview大模型调用,错峰时段最低可享0.2折优惠。活动同步推出AI Coding、智能体部署、云电脑托管、0代码建站等十余类场景化组合,搭配99元/年的普惠云服务器、88元/年的入门数据库等经典特惠产品,还为企业提供1V1定制化AI转型方案,大幅降低了不同用户群体拥抱AI的技术门槛与采购成本。
730 111
|
21天前
|
人工智能 JSON 安全
Fastjson远程代码执行漏洞,阿里云AI安全为您保驾护航
阿里云AI安全产品联动防御Fastjson攻击
2652 13
Fastjson远程代码执行漏洞,阿里云AI安全为您保驾护航
|
7天前
|
人工智能 JSON Shell
2026AI漫剧本地全开源方案(附各个软件模型链接),8G显卡也能流畅运行
这是一套完全本地化部署的AI漫剧生成技术链路:涵盖LLM剧本分镜生成、FLUX文生图(IP-Adapter人脸锁定)、StoryDiffusion时序连贯控制、LTX-2.3唇形同步视频生成,及ComfyUI全流程调度。零云端费用,仅耗硬件算力,单集2–4小时可产出竖屏短视频,适配抖音/B站分发。
|
5天前
|
人工智能 API 开发工具
2026 零基础本地 AI 漫剧完整实操教程(8G 笔记本显卡可用|附可直接复制命令与代码)
本方案提供完全离线、本地运行的漫剧全自动制作流程:RTX3060/4050 8G显卡即可驱动,涵盖Qwen写分镜→ComfyUI统一角色绘图→LTX2.3图生微动画→Qwen3-TTS本地配音→FFmpeg自动合成,全程无水印、免API、不限次。专为低显存优化,解决变脸、闪烁、爆内存三大痛点。(239字)

热门文章

最新文章