【2025云栖大会】阿里云AI搜索年度发布:开启Agent时代,重构搜索新范式

简介: 2025云栖大会阿里云AI搜索专场上,发布了年度AI搜索技术与产品升级成果,推出Agentic Search架构创新与云原生引擎技术突破,实现从“信息匹配”到“智能问题解决”的跨越,支持多模态检索、百亿向量处理,助力企业降本增效,推动搜索迈向主动服务新时代。

演讲主题:AI搜索年度发布——Agentic Search创新、云原生搜索引擎进化、AI搜索产品融合升级

年初大模型技术的爆发式发展,使得传统用户搜索场景被颠覆,据某权威研究机构数据显示,超58%的美国用户使用 Google 时不再点击搜索结果,传统搜索流量逐渐转向AI驱动工具,这一转变背后将重构用户搜索的交互逻辑、数据形态与技术架构。

9月26日杭州举行的云栖大会AI搜索专场上,阿里云智能集团计算平台事业部AI搜索负责人——邢少敏与产品负责人——汤祯捷重磅发布年度AI搜索技术与产品升级成果。阿里云搜索技术通过Agentic Search 架构创新、云原生引擎底层技术变革,从传统“信息匹配”迈向“智能问题解决”的全新时代,成为信息交互的核心范式,助力金山办公在文档协作领域低成本实现百亿向量检索能力,货拉拉在物流调度的洪峰压力下保持核心业务极低延迟,实现了客户业务性能突破与成本优化的双赢。



一、AI搜索:颠覆传统,重塑信息交互范式

如今,三大核心趋势正在重塑搜索边界:

  1. 用户交互升级:用户需求从“找到链接”转向“解决问题”,搜索普惠化加速;
  2. 数据模态进化:文本、图像、视频、代码等多模态混合搜索成为刚需;
  3. 主动智能跃迁:以大模型为核心、Agent 为引擎的协同架构,实现跨工具、跨数据源的深度推理。

阿里云AI搜索通过技术架构与产品生态的全面革新,正推动搜索从“检索工具”升维为“智能 AI 助手”。


二、Agentic Search:AI搜索迈入自主协作时代

演讲中邢少敏详细阐释了阿里云AI搜索的核心突破——Agentic Search 架构创新。该架构通过多 Agent 协同、多模态数据处理与任务自主规划,构建了从“问题提出”到“方案自主生成”的智能闭环。

其技术优势体现在:

  • 多模态数据处理:支持文档、图像、代码、视频等内容的解析、实体抽取与向量化,覆盖向量引擎、数据库、知识图谱等多引擎协同;
  • 自主任务规划:依托 Qwen3 大模型与短期/长期记忆能力,主 Agent 可动态调用 Code Agent、Browser Agent 等工具,实现复杂问答与多跳推理;
  • 权威测试领先:在 OpenAI 的 BrowseComp 、红杉中国Xbench-DeepSearch以及Deep Research  Bench评测集中,Agentic Search 评测指标均超越 Gemini、OpenAI 等国际主流方案,排名第一。

此外,阿里云构建了覆盖文档解析、多模态向量化、NL2SQL、重排序的全链路 AI 搜索专属大模型体系,并开放 Qwen3、DeepSeek 等大模型,为企业提供定制化智能搜索基座。


三、云原生引擎突破:性能倍增,成本优化

为支撑 AI 搜索的高并发与复杂计算需求,阿里云发布面向多场景检索的云原生引擎技术升级,实现性能与成本的双重突破:

Elasticsearch 高性能检索引擎:通过 CPU 批次执行、消除流水线阻塞和SIMD/向量化计算等优化、以及存算分离架构,复杂查询性能最高可提升6倍,存储成本降低50%,支持文本、日志、向量、时序等混合检索场景;

向量检索进化:向量检索 GPU 加速,基于 GPU 卡的索引构建性能提升13倍,资源成本下降5倍;结合 BBQ 量化技术,内存占用降低95%,节省20倍机器资源;基于DiskANN技术,低成本支持百亿规模向量检索;

全模态数据治理:从文档、数据库到湖仓的多源数据,通过文档结构抽取、实体关系建模,实现非结构化数据到向量数据、知识图谱的转化,为多模态搜索提供实时索引能力。


四、产品矩阵融合升级:AI搜索产品的'一横三纵'

Agentic Search 创新,再到基于云原生引擎突破向量引擎全面升级AI搜索全模态数据治理等技术能力深耕,在此次年度产品发布中,汤祯捷从产品角度分享了三个主题-融合,加速,开箱即用, 将诸多核心领先 AI 搜索能力融合于在 AI 搜索多产品内的落地规划。打造业内领先的面向 Agentic Search 新时代的'一横三纵'的 AI 搜索产品矩阵。

  1. AI搜索开放平台 - 面向人和 Agent 的 Agentic Search 基础设施。平台方式支撑多个 AI 搜索产品的 AI 原子能力。此为'一横'。
  • 提供多模态解析、视频解析、向量化等全链路AI搜索服务,支持API调用与按量计费。
  • 全链路搜索开发基础能力,覆盖模型微调-模型部署-编排。
  • 搜索链路效果测评:内置 Qwen3 大模型与测评工具,助力企业快速构建 Agentic Search等应用。


  1. 检索分析服务Elasticsearch - 开源企业级AI搜索平台。此为'一纵'。Elasticsearch 企业版在多类查询场景下的性能提升效果显著,其中文本检索方面,Terms/DateHist 聚合提升 2.59 倍、Query+Sort 查询提升 3 倍、MultiTerms 聚合提升 6.83 倍;向量检索方面,普通向量查询提升 1.7 倍、带过滤条件的向量查询提升 4 倍,全面体现了云原生架构对检索效率的显著增强。
  1. 场景增强:支持全文、语义、日志、向量、时序分析等多场景检索分析能力。
  2. 引擎加速:NativeES 引擎支持检索性能提升2倍至6倍;检索存算分离降本50%;向量检索内存优化20倍。
  3. 发布“企业专属 Agent 知识库”,提供一键 Agentic Search 解决方案,帮助用户构建安全独享的专属知识库。
  4. Elasticsearch Serverless 版实现秒级弹性伸缩,保障安全与稳定性。
  1. 智能检索服务OpenSearch - 深度接入AI原生能力的自研AI Native搜索服务此为'二纵'。
  1. LLM智能问答版,集成 DeepSearch/DeepResearch Agent,其 AI+ 专业搜索能力效果领先,支持“答案直出”。
  2. 行业算法版 为电商,互联网等行业领域提供高精度定制AI检索能力,全面对接AI搜索平台。
  3. 向量检索版,支持多模态数据湖,向量引擎多算法加强(GPU 加速/ RabitQ 量化/ DiskANN 算法),文搜视频/文搜图。
  1. 现在起,OpenSearch 不仅是自研搜索服务,更是 AI 原生多模态数据湖搜索。
  2. 向量检索服务Milvus版 - AI向量检索的利器。此为'三纵'。
  • 全托管服务兼容开源 Milvus,新增秒级弹性伸缩、数据分层存储功能;

内核性能提升100%,支持百亿级数据湖检索,集成 Milvus Agent 实现智能化交互。



五、客户实践:AI搜索从工具到智能助手,助力用户实现业务增长

阿里云AI搜索技术落地成效已在头部客户场景中率先验证:

金山办公通过 ES 内核级优化实现百亿级文档秒级响应,攻克高并发检索瓶颈,并构建冷热数据自动流转的"无感运维"体系;

货拉拉依托 ES 重构智能调度系统,成功支撑300+业务应用并发访问的千万级 QPS 洪峰压力,核心业务响应延迟稳定在10ms RT,运维效率提升50%。

两大案例揭示了阿里云 AI 搜索技术演进的新逻辑:当技术架构深度适配业务特征,搜索系统正在从"支撑业务"进化为"驱动增长"的核心引擎。

“AI 搜索不仅是在信息获取领域的技术升级,更是用户检索分析体验的跃迁。”

阿里云 AI 搜索通过 Agentic 架构的智能化、云原生引擎的高性能与产品生态的开放融合与加速,正推动搜索从“被动响应”走向“主动服务”。未来,随着大模型、Agent 与云原生技术的深度协同,AI 搜索将进化为每个人的贴身智能助手,引领人类进入信息无界、交互自然的新纪元。

了解更多:

【阿里云 AI 搜索开放平台 官网】:https://www.aliyun.com/activity/bigdata/opensearch/platform

【阿里云 智能开放搜索OpenSearch 官网】:https://www.aliyun.com/product/opensearch

【阿里云 检索分析服务Elacticsearch 官网】:https://www.aliyun.com/product/bigdata/elasticsearch

【阿里云 Elacticsearch Serverless 官网】:https://www.aliyun.com/product/es/es-serverless

【阿里云 向量检索服务 Milvus 版 官网】:https://www.aliyun.com/product/milvus

相关文章
|
5天前
|
存储 弹性计算 缓存
阿里云服务器租赁费用:新版租赁收费标准及活动报价参考
本文更新了2026年阿里云全系列云服务器租赁活动报价,所有特惠资源均可前往阿里云活动中心选购,整体覆盖从个人入门到企业级高性能场景的全梯度需求。其中轻量应用服务器主打极致性价比,2核2G峰值200M带宽配置每日10点、15点限时抢购价仅38元/年,2核4G配置379元/年起;高性价比的经济型e实例、通用算力型u2i实例覆盖2核4G至4核32G全档位,适配开发测试与中小型企业业务;搭载英特尔至强6处理器的第九代c9i企业级实例算力较上代提升20%,支撑高并发生产环境,不同实例规格价差清晰,用户可根据自身业务负载与预算灵活选型。
1574 112
|
12天前
|
云安全 人工智能 运维
阿里云联动百位企业安全专家,共识Agent防御最佳实践
当Agent成为新员工,你的安全边界在哪里?
1941 8
阿里云联动百位企业安全专家,共识Agent防御最佳实践
|
6天前
|
人工智能 程序员 API
Codex 接入 DeepSeek-V4-Flash:还能补上识图,提供两套方案
Codex 接入 DeepSeek-V4-Flash 怎么配?本文覆盖 CLI 与桌面端,再用 qwen3-vl-flash 补识图,两套方案可直接照做
|
6天前
|
编解码 人工智能 安全
2核4G/4核8G/8核16G阿里云服务器如何选择实例?经济型e、通用算力型u2i与计算型c9i选哪个?
本文介绍了阿里云2核4G、4核8G、8核16G三档主流配置下经济型e、通用算力型u2i和计算型c9i三种实例的最新活动价格与适用场景。同配置下三者价差显著,以2核4G为例,经济型e低至599.93元/年,计算型c9i则高达1742.08元/年。文章详细解析了各实例的性能定位:经济型e适合轻负载入门场景,u2i兼顾稳定算力与性价比,c9i凭借第9代至强处理器与芯片级安全能力支撑高性能业务。同时提示用户可叠加满减优惠券享受折上折,建议根据业务负载与预算综合决策。
528 112
|
18天前
|
人工智能 前端开发 Linux
Codex 桌面版安装 + CC Switch 接入第三方 API 完整教程(2026 最新)
2026最新教程:手把手教你安装Codex桌面版,通过CC Switch v3.17.0一键接入Fenno等国产API(兼容OpenAI Responses格式),跳过账号登录,完整启用代码审查、多步任务与上下文感知功能。零基础友好,全程图文实操。(239字)
2567 4
|
10天前
|
存储 人工智能 关系型数据库
阿里云AI产品与云产品最新组合套餐:Token Plan、AI coding及云服务器和建站等组合优惠价
阿里云推出全新“算力+模型+应用”一站式云与AI组合套餐活动,覆盖从个人开发者到中大型企业的全场景需求。核心亮点为分三档定价的Token Plan订阅服务,支持Qwen3.8-Max-Preview大模型调用,错峰时段最低可享0.2折优惠。活动同步推出AI Coding、智能体部署、云电脑托管、0代码建站等十余类场景化组合,搭配99元/年的普惠云服务器、88元/年的入门数据库等经典特惠产品,还为企业提供1V1定制化AI转型方案,大幅降低了不同用户群体拥抱AI的技术门槛与采购成本。
721 111
|
20天前
|
人工智能 JSON 安全
Fastjson远程代码执行漏洞,阿里云AI安全为您保驾护航
阿里云AI安全产品联动防御Fastjson攻击
2636 13
Fastjson远程代码执行漏洞,阿里云AI安全为您保驾护航
|
6天前
|
人工智能 JSON Shell
2026AI漫剧本地全开源方案(附各个软件模型链接),8G显卡也能流畅运行
这是一套完全本地化部署的AI漫剧生成技术链路:涵盖LLM剧本分镜生成、FLUX文生图(IP-Adapter人脸锁定)、StoryDiffusion时序连贯控制、LTX-2.3唇形同步视频生成,及ComfyUI全流程调度。零云端费用,仅耗硬件算力,单集2–4小时可产出竖屏短视频,适配抖音/B站分发。
|
7天前
Qoder 一周年 × Qwen3.8-Max 正式上线,多重好礼限时领
8月3日,Qwen3.8-Max 正式上线Qoder,迎来Qoder一周年。新老用户可领800次免费调用,下单再赠2000次;夜间(22:00–08:00)调用5折;邀请好友双方得积分与调用额度。
448 1

热门文章

最新文章