下一个"过半"的,会是数据分析吗?——2029 年 Data Agent 预测

简介: 最晚到 2029 年,企业中由 Data Agent 发起并完成的数据任务量,将超过员工直接通过传统 BI 产品发起并完成的数据任务量。

2026 年 7 月,Cloudflare 发布了一份关于 Agentic Internet 的报告,其中有一个值得记录的数字:

超过 50% 的互联网流量,已经不是人类产生。

这些流量并不全来自 AI,还包括传统搜索爬虫、监控程序和其他自动化工具。但变化正在加速:截至 2026 年 6 月,Cloudflare 识别出的爬虫请求中,52% 已用于 AI 训练,而 2025 年春季这一比例还是 22%。

互联网仍然在满足人的需求,但越来越多检索、比较和处理信息的动作,已经由算法完成。

在证券股票交易市场,高频交易兴起时,争议一直没有停止。

更快的网络和更复杂的算法,是否会带来不公平优势?大量程序在毫秒之间相互影响,会不会放大市场波动?

2010 年的"闪电崩盘",让这些担忧集中爆发。但就在同一年,美国证券交易委员会披露,高频交易已经占美国股票市场交易量的 50% 以上,一些机构每天可以产生超过 100 万笔交易。

市场还在讨论它是否安全、应该如何监管,它已经在数量上成为了主要力量。

程序化广告也经历过类似的阶段。

早期,行业甚至没有完全统一"程序化广告"的定义。交易链条不透明、虚假流量、广告欺诈和品牌安全,都是长期争议。

但算法可以同时处理大量广告位、受众、价格和效果数据,并在一次页面加载的时间里完成竞价。

2014 年,美国程序化广告收入达到 101 亿美元,占展示相关广告收入的 52%,第一次超过非程序化广告。

程序化广告没有等到市场完全透明、行业标准全部建立之后,才成为主流。

AI Coding 最初更像一个聪明的代码补全工具:补一段函数,解释一段代码,或者帮助开发者寻找错误。

真正明显的变化,发生在 2025 年第四季度以后。

Coding Agent 开始接收一个完整任务:读取代码库、修改代码、运行测试,再提交一个等待审查的 Pull Request。

衡量 AI Coding 的单位,也开始从"采纳了多少行建议",变成"完成了多少个可以提交和验收的软件任务"。

2026 年 7 月,微软披露,GitHub Copilot 用户数已经达到 5000 万;GitHub 上每三个 Pull Request 中,已经有一个涉及 Agent。Copilot Code Review 在一年内完成了超过 6000 万次代码审查,占 GitHub 代码审查量的五分之一以上。

GitHub 随后把 Agent 创建、合并和审查的 Pull Request,正式纳入企业、组织乃至代码仓库级别的统计指标。

这件事本身就是一个信号:Agent 产生的软件工作,已经多到需要像人工产出一样被单独度量。

AI Coding 还没有全面"过半",但工作方式已经改变了。软件行业接下来面对的问题是如何审查、测试和治理不断增长的 Agent 产出。

互联网流量、高频交易、程序化广告和 AI Coding,呈现出一种相似的变化:

  • 一开始,能力有限、问题很多,信号也很微弱。
  • 然后,越来越多真实任务开始通过新的方式完成。
  • 比例从可以忽略,进入 10%、30%,最终快速接近或超过一半。

现在 Data Agent 也开始出现了一些微弱信号。因此,我们在 Data Agent 仍处于起点的时候,大胆做出一个预测:

最晚到 2029 年,企业中由 Data Agent 发起并完成的数据任务量,将超过员工直接通过传统 BI 产品发起并完成的数据任务量。

这里说的数据任务量,包括查询、监控、归因、诊断、报告生成、决策支持和其他 Data Agent 可以完成的任务总和。

过去 3 年的经历告诉我们,很有可能,我们在这个时刻,任何看似不可能完成的数字,在事后看来,都会是缺乏想象力的表现。

数据与参考来源

  1. Cloudflare:《Content Independence Day, one year on - building the business model for the agentic Internet》 报告称,2026 年非人类流量首次超过互联网流量的 50%;AI 训练爬虫请求占比从 2025 年春季的 22% 上升至 2026 年 6 月的 52%。
  2. 美国证券交易委员会:2010 年美国股票市场结构证词 SEC 披露,高频交易公司每天可产生超过 100 万笔交易,并占美国股票市场交易量的 50% 以上。
  3. IAB/PwC:《Programmatic Revenue Report 2014》 2014 年美国程序化广告收入为 101 亿美元,占展示相关广告收入约 52%。
  4. 微软 2026 财年第四季度财报电话会GitHub Copilot 用户达到 5000 万,GitHub 上约三分之一的 Pull Request 已涉及 Agent。
  5. GitHub:《60 million Copilot code reviews and counting》 Copilot Code Review 上线约一年完成超过 6000 万次代码审查,占 GitHub 代码审查量的五分之一以上。
  6. GitHub Copilot Usage Metrics 更新GitHub 已支持从企业、组织和代码仓库层面统计 Copilot Coding Agent 创建、合并和审查的 Pull Request。
相关文章
|
8天前
|
存储 弹性计算 缓存
阿里云服务器租赁费用:新版租赁收费标准及活动报价参考
本文更新了2026年阿里云全系列云服务器租赁活动报价,所有特惠资源均可前往阿里云活动中心选购,整体覆盖从个人入门到企业级高性能场景的全梯度需求。其中轻量应用服务器主打极致性价比,2核2G峰值200M带宽配置每日10点、15点限时抢购价仅38元/年,2核4G配置379元/年起;高性价比的经济型e实例、通用算力型u2i实例覆盖2核4G至4核32G全档位,适配开发测试与中小型企业业务;搭载英特尔至强6处理器的第九代c9i企业级实例算力较上代提升20%,支撑高并发生产环境,不同实例规格价差清晰,用户可根据自身业务负载与预算灵活选型。
1799 118
阿里云服务器租赁费用:新版租赁收费标准及活动报价参考
|
9天前
|
人工智能 程序员 API
Codex 接入 DeepSeek-V4-Flash:还能补上识图,提供两套方案
Codex 接入 DeepSeek-V4-Flash 怎么配?本文覆盖 CLI 与桌面端,再用 qwen3-vl-flash 补识图,两套方案可直接照做
1356 11
|
15天前
|
云安全 人工智能 运维
阿里云联动百位企业安全专家,共识Agent防御最佳实践
当Agent成为新员工,你的安全边界在哪里?
1962 9
阿里云联动百位企业安全专家,共识Agent防御最佳实践
|
9天前
|
编解码 人工智能 安全
2核4G/4核8G/8核16G阿里云服务器如何选择实例?经济型e、通用算力型u2i与计算型c9i选哪个?
本文介绍了阿里云2核4G、4核8G、8核16G三档主流配置下经济型e、通用算力型u2i和计算型c9i三种实例的最新活动价格与适用场景。同配置下三者价差显著,以2核4G为例,经济型e低至599.93元/年,计算型c9i则高达1742.08元/年。文章详细解析了各实例的性能定位:经济型e适合轻负载入门场景,u2i兼顾稳定算力与性价比,c9i凭借第9代至强处理器与芯片级安全能力支撑高性能业务。同时提示用户可叠加满减优惠券享受折上折,建议根据业务负载与预算综合决策。
547 113
|
6天前
|
编解码 弹性计算 云计算
MiniMax-H3 视频生成模型 — 一键部署与使用指南
MiniMax-H3是MiniMax开源的33B全模态视频生成模型,支持文生视频、图生视频、参考生视频三种模式,原生输出2K/15秒带立体声音频视频,已原生适配ComfyUI,并可通过阿里云计算巢一键部署。(239字)
|
21天前
|
人工智能 前端开发 Linux
Codex 桌面版安装 + CC Switch 接入第三方 API 完整教程(2026 最新)
2026最新教程:手把手教你安装Codex桌面版,通过CC Switch v3.17.0一键接入Fenno等国产API(兼容OpenAI Responses格式),跳过账号登录,完整启用代码审查、多步任务与上下文感知功能。零基础友好,全程图文实操。(239字)
3168 4
|
9天前
|
人工智能 JSON Shell
2026AI漫剧本地全开源方案(附各个软件模型链接),8G显卡也能流畅运行
这是一套完全本地化部署的AI漫剧生成技术链路:涵盖LLM剧本分镜生成、FLUX文生图(IP-Adapter人脸锁定)、StoryDiffusion时序连贯控制、LTX-2.3唇形同步视频生成,及ComfyUI全流程调度。零云端费用,仅耗硬件算力,单集2–4小时可产出竖屏短视频,适配抖音/B站分发。
|
7天前
|
人工智能 API 开发工具
2026 零基础本地 AI 漫剧完整实操教程(8G 笔记本显卡可用|附可直接复制命令与代码)
本方案提供完全离线、本地运行的漫剧全自动制作流程:RTX3060/4050 8G显卡即可驱动,涵盖Qwen写分镜→ComfyUI统一角色绘图→LTX2.3图生微动画→Qwen3-TTS本地配音→FFmpeg自动合成,全程无水印、免API、不限次。专为低显存优化,解决变脸、闪烁、爆内存三大痛点。(239字)