DataWorks AI助理:一句话,帮你搞定研发周报!

简介: 本文介绍如何用一句指令让DataWorks AI助理自动生成研发周报并推送至钉钉文档。涵盖三大核心步骤:构建工作空间知识库以理解业务语义、授权钉钉文档API、创建自定义SKILL固化流程。全程约1–2分钟,大幅提升周报效率。

本文介绍如何用一句指令让DataWorks AI助理自动生成研发周报并推送至钉钉文档。涵盖三大核心步骤:构建工作空间知识库以理解业务语义、授权钉钉文档操作权限、创建自定义SKILL固化流程。全程约1–2分钟,大幅提升周报效率。

若您还未创建DataWorksAI助理,您可以参考以下实践了解DataWorks AI助理如何创建与如何对接钉钉应用:https://developer.aliyun.com/article/1746586


场景与效果

研发团队每周需要整理研发数据并生成周报。传统方式下,数据散落在不同的系统中:您需要翻阅代码查看发布记录,进入调度系统查询任务运行状态和耗时,再手动将数据拼凑到文档中,并补充业务上下文。整个过程耗时且容易遗漏,往往需要耗费数小时才能完成一份周报。

DataWorks AI助理支持您通过一句自然语言指令,自动完成上述繁琐工作。AI助理会自动获取研发数据、补全业务上下文、生成结构化周报,并输出为钉钉文档。

本实践效果:您在钉钉中发送指令"读取我本周提交的任务代码,输出一份研发周报,更新到钉钉文档",AI助理会自动完成数据获取、语义补全、周报生成和文档写入,整个过程约1-2分钟。

  1. 发送指令
  1. 授权钉钉文档

3 写入钉钉文档

image.png

image.png

image.png


工作原理

DataWorks AI助理生成研发周报的过程分为三个阶段:

  1. 获取研发数据:AI助理通过DataWorks开放API,实时拉取调度任务运行状态、实例执行结果、基线完成情况等数据。
  2. 补全业务上下文:AI助理通过数据语义层(知识库),将节点的物理名解析为业务含义(所属域、负责人、关联指标等)。
  3. 整合输出周报:AI助理将运行数据与业务上下文合并,按需生成钉钉文档或HTML报告。


环境规划

在开始使用前,您需要完成以下环境配置:

环境

说明

DataWorks工作空间

需要统计周报数据的工作空间。

DataWorks AI助理服务实例

用于执行数据获取和周报生成。

钉钉应用

与DataWorks AI助理交互的入口。

若您还未创建DataWorksAI助理,您可以参考以下实践了解DataWorks AI助理如何创建与如何对接钉钉应用:https://developer.aliyun.com/article/1746586


准备工作:生成语义文件

DataWorks AI助理获取到的研发数据只包含节点的物理名(如 dwd_order_detailjob_sync_xxx),无法准确理解这些节点的业务含义。您需要预先在DataWorks管控台生成工作空间的语义文件(知识库),DataWorks AI助理才能将物理名解析为业务上下文。

知识库的数据来源是预先扫描生成的资产元数据,包含表描述、字段语义、命名规范、同义词映射等信息。生成完成后,您可以在DataWorks管控台的知识库列表中看到DataWorks工作空间的语义文件,此时DataWorks AI助理已具备理解节点业务含义的能力。


基础:生成周报并写入钉钉文档

1. 发送指令

在钉钉对话框中向DataWorks AI助理发送周报生成指令,明确时间范围、输出格式和数据类型。DataWorks AI助理会自动执行数据获取、语义补全、周报生成和文档写入。

参考指令:读取我本周提交的任务代码,输出一份研发周报,更新到钉钉文档。

  1. 发送指令
  1. 授权钉钉文档

3 写入钉钉文档

image.png

image.png

image.png

2. 授权钉钉文档

钉钉文档API要求OAuth 2.0授权,未授权时DataWorks AI助理无法代您操作文档。DataWorks AI助理会发送授权链接,您点击完成授权后,将页面上的MCP服务地址(以 https://mcp-gw.dingtalk.com/server/...\ 开头)粘贴发送给DataWorks AI助理。

授权完成后,DataWorks AI助理后台会接收MCP服务地址(含您的身份凭证),将钉钉文档MCP工具(创建文档、读取内容、编辑写入)注册到DataWorks AI助理的MCP Server。您需要发送指令重启Gateway使工具生效。授权成功后,DataWorks AI助理即可将周报写入钉钉文档。

授权流程:用户授权 → 获得MCP服务地址 → 粘贴给DataWorks AI助理 → DataWorks AI助理后台注册钉钉文档工具 → 重启Gateway → 工具生效。


3. 确认周报格式与内容

DataWorks AI助理生成周报后,会在对话窗口推送预览和钉钉文档链接。您点击链接查看完整内容,确认信息,如:

  • 研发数据是否准确(任务运行状态、成功/失败数、耗时趋势)
  • 业务上下文是否完整(节点所属域、关键表、负责人)
  • 文档格式是否规范(图表、表格、文字说明)

确认无误后直接分享链接即可。如需调整,发送修改指令(如"把失败任务单独列出来"),DataWorks AI助理会自动更新文档。


进阶:将周报流程沉淀为Skill

Skill 是把"一次性的探索过程"沉淀为"可复用的确定性流程。首次使用DataWorks AI助理生成周报时,DataWorks AI助理需要探索API参数、理解MCP工具调用方式,整个过程涉及多轮试错与交互。您可以将周报数据获取和写入过程复盘并整理为Skill,后续执行效率将显著提升。

参考指令:将周报数据获取和写入过程复盘整理为一个写周报的skill

创建自定义SKILL

DataWorks AI助理界面查看SKILL

image.png

image.png

若AI助理界面无法看到SKILL,您可以发送指令如“创建skill后需要自动同步到页面”,要求DataWorks AI助理创建SKILL后自动同步至页面。


首次执行与使用Skill的对比

对比维度

首次执行(探索+试错)

使用Skill(固化流程)

执行过程

读取Skill文档、探索API参数、试错MCP工具参数、多轮交互整合报告

读取Skill、直接运行预设脚本(采集、生成、写入),线性执行

工具调用

约15轮

约4轮

试错次数

3-4次

0次

用户交互

需要中间确认

基本无需打断


沉淀为Skill的核心优势

  1. 试错成本归零:Skill将已验证的正确参数和流程固化在脚本中,DataWorks AI助理无需再次猜测API或MCP工具参数。
  2. 探索成本归零:Skill将决策路径编码为固定流程,DataWorks AI助理无需重新读取文档或查找API列表。
  3. Token消耗大幅降低:Skill的脚本执行只返回最终结果,避免了试错过程产生的大量上下文Token消耗。

整理为Skill后,您只需发送"写周报"指令,DataWorks AI助理将按固定流程线性执行,全程零试错,基本无需打断。


加入官方交流群

钉钉群号: 149605034971

钉钉群二维码:

image.png

相关实践学习
基于Hologres轻量实时的高性能OLAP分析
本教程基于GitHub Archive公开数据集,通过DataWorks将GitHub中的项⽬、行为等20多种事件类型数据实时采集至Hologres进行分析,同时使用DataV内置模板,快速搭建实时可视化数据大屏,从开发者、项⽬、编程语⾔等多个维度了解GitHub实时数据变化情况。
目录
相关文章
|
域名解析 人工智能 运维
DataWorks AI助理:在钉钉让AI助理帮你盯任务、修问题
DataWorks AI助理支持定时巡检监控规则告警及指定任务异常,可对接钉钉等IM端实时推送、诊断并自动修复问题。用户在移动端即可完成告警接收、分析、确认与修复全流程,无需切换PC端,大幅提升运维效率。
329 0
|
数据采集 SQL 存储
DataWorks数据质量介绍及实践 | 《一站式大数据开发治理DataWorks使用宝典》
数据质量问题虽然从数据工程师的角度来看是个简单问题,但是从业务的角度来看是个很严重的问题。所以数据质量是数据开发和治理全生命周期中,非常重要的一个环节。在DataWorks产品版图里,数据质量也是非常重要的模块之一。
5271 0
DataWorks数据质量介绍及实践 | 《一站式大数据开发治理DataWorks使用宝典》
|
4月前
|
SQL 人工智能 运维
DataWorks Data Agent:一句话搞定数据开发,让周期从天级到分钟级
DataWorks Data Agent 是阿里云推出的AI原生数据开发智能体,覆盖集成、开发、运维、治理、分析全链路。它深度适配业务逻辑与开发规范,支持自然语言一键生成可信SQL及全流程交付。淘宝闪购实测:指标开发从6–8小时缩短至5–10分钟,真正实现“一句话交付”。
|
5月前
|
SQL 人工智能 分布式计算
OpenClaw + ClaudeCode 在企业数据仓库开发中的实践
本文介绍团队如何用OpenClaw+ClaudeCode构建数仓标签开发自动化工作流:基于ODS-CDM-ADM三层架构,提炼“六步法”(需求分析→数据源调研→方案设计→代码生成→AI审查→测试上线),配合脚本工具与人机协作规范,在保障数据准确前提下,将单个标签开发耗时从6-8小时压缩至1.5–2小时。
1750 5
OpenClaw + ClaudeCode 在企业数据仓库开发中的实践
|
7月前
|
SQL 存储 分布式计算
Hologres Dynamic Table在淘天价格力的业务实践
淘天价格力团队依托Hologres Dynamic Table,实现亿级商品数据的高效治理。通过增量刷新与全量刷新机制,支持秒级圈选、分钟级报表更新,满足大促场景下高时效、多维度分析需求,显著提升数据灵活性与决策效率。
|
9月前
|
缓存 Shell API
解决mac电脑brew update很慢的问题
Homebrew 大部分都是 API 优先模式,切换国内源需配置 API 镜像而非仅修改 git 仓库。核心是设置 `HOMEBREW_API_DOMAIN` 指向国内镜像(如清华源),并更新 brew 主仓库地址,最后执行 `brew update` 生效。旧方法已不适用新版本。
1600 5
|
存储 SQL 人工智能
Hologres 4.0全新发布:AI时代的一站式多模态分析平台
2025年云栖大会,Hologres发布全新4.0版本升级,以“AI时代的一站式多模态分析平台”为核心理念,全面展示了Hologres在结构化、半结构化与非结构化数据分析能力上的重大突破,特别是在OLAP分析、点查、向量检索、全文检索、湖仓协同及AI Function集成等方面的领先优势,刷新ClickBench、JSONBench、VectorDBBench等多项榜单,登顶第一。
|
数据采集 机器学习/深度学习 数据挖掘
利用Beautiful Soup和Pandas进行网页数据抓取与清洗处理实战
本文通过一个实战案例,介绍如何使用Python中的Beautiful Soup库抓取网页数据,并用Pandas进行清洗和处理。首先,确保安装了requests、beautifulsoup4和pandas库。接着,通过requests获取HTML内容,使用Beautiful Soup解析并提取新闻标题、发布时间和正文。然后,利用Pandas对数据进行清洗,包括去除多余空格、替换特殊字符、删除无效数据等。最后,根据需求进行数据处理(如过滤关键词)并保存为CSV或Excel文件。这个案例适合初学者和有一定经验的用户,帮助快速掌握这两个强大的工具。
676 3
|
数据采集 人工智能 DataWorks
限时优惠体验!DataWorks数据治理中心全新升级为数据资产治理
DataWorks进行全面升级,从数据治理中心转型为数据资产治理,强调业务视角下的数据分类与管理,引入Data+AI全链路数据血缘追踪,提升数据质量和安全性,促进跨部门协作。同时,提供限时优惠活动,助力企业高效利用数据资产。
1511 2
|
存储 安全 API
使用Ollama和Open WebUI管理本地开源大模型
Open WebUI 是一个功能丰富且用户友好的自托管 Web 用户界面(WebUI),它被设计用于与大型语言模型(LLMs)进行交互,特别是那些由 Ollama 或与 OpenAI API 兼容的服务所支持的模型。Open WebUI 提供了完全离线运行的能力,这意味着用户可以在没有互联网连接的情况下与模型进行对话,这对于数据隐私和安全敏感的应用场景尤为重要。