官方博客-第9页-阿里云开发者社区

米基

2024-05-15

3790

大模型推理优化实践：KV cache复用与投机采样

在本文中，我们将详细介绍两种在业务中实践的优化策略：多轮对话间的 KV cache 复用技术和投机采样方法。我们会细致探讨这些策略的应用场景、框架实现，并分享一些实现时的关键技巧。

米基

3,790

唐殊

2024-11-01

1909

探索LLM推理全阶段的JSON格式输出限制方法

文章详细讨论了如何确保大型语言模型（LLMs）输出结构化的JSON格式，这对于提高数据处理的自动化程度和系统的互操作性至关重要。

唐殊

1,909

孙玉梅

2025-04-01

379

从 DeepSeek 敏感信息泄露谈可观测系统的数据安全预防

探讨了 SLS 中增强数据安全的几种方式：权限精细化管控有效减少了潜在安全风险；接入层脱敏技术阻止敏感数据落库，提升了隐私保护；StoreView 字段集控制通过限制查询数据范围，降低数据泄露损害。智能监控系统提供实时监测，快速识别并阻断异常拖库行为，为企业提供了迅速响应和抵御威胁的能力。

孙玉梅

379

大模型服务小助手

2025-07-01

1164

Excel数据治理新思路：引入智能体实现自动纠错【Python+Agent】

本文介绍如何利用智能体与Python代码批量处理Excel中的脏数据，解决人工录入导致的格式混乱、逻辑错误等问题。通过构建具备数据校验、异常标记及自动修正功能的系统，将数小时的人工核查任务缩短至分钟级，大幅提升数据一致性和办公效率。

大模型服务小助手

1,164

探索云世界

2025-08-05

817

Qwen-MT：翻得快，译得巧

今天，机器翻译模型Qwen-MT正式上线，支持92种语言互译，具备高度可控性与低延迟、低成本特点，适用于多种场景。开发者可通过Qwen API体验其强大翻译能力。

探索云世界

817

灵杰开发者

2025-08-08

624

Flink 2.1 SQL：解锁实时数据与AI集成，实现可扩展流处理

简介：本文整理自阿里云高级技术专家李麟在Flink Forward Asia 2025新加坡站的分享，介绍了Flink 2.1 SQL在实时数据处理与AI融合方面的关键进展，包括AI函数集成、Join优化及未来发展方向，助力构建高效实时AI管道。

灵杰开发者

624

子潍

2025-05-22

1317

本文介绍了通过MCP（Model Context Protocol）结合通义千问大模型实现跨平台、跨服务的自动化任务处理方案。使用Qwen3-235B-A22B模型，配合ComfyUI生成图像，并通过小红书等社交媒体发布内容，展示了如何打破AI云服务的数据孤岛。具体实践包括接入FileSystem、ComfyUI和第三方媒体Server，完成从本地文件读取到生成图像再到发布的全流程。方案优势在于高可扩展性和易用性，但也存在大模型智能化不足、MCP Server开发难度较大及安全风险等问题。未来需进一步提升模型能力、丰富应用场景并解决安全挑战，推动MCP在更多领域落地。

子潍

1,317

施晨尹丰彬筱文李林杨黄俊等

2023-11-07

43725

基于阿里云PAI平台搭建知识库检索增强的大模型对话系统

基于原始的阿里云计算平台产技文档，搭建一套基于大模型检索增强答疑机器人。本方案已在阿里云线上多个场景落地，将覆盖阿里云官方答疑群聊、研发答疑机器人、钉钉技术服务助手等。线上工单拦截率提升10+%，答疑采纳率70+%，显著提升答疑效率。

施晨尹丰彬筱文李林杨黄俊等

43,725

硅步

2024-09-27

808

灵魂拷问-前端的作用--性能优化篇

作者最近在尝试对负责的平台进行性能优化，本文整理了些前端性能优化的一些常见策略。

硅步

808

官方博客-第9页-阿里云开发者社区

类目筛选

内容类型

大模型推理优化实践：KV cache复用与投机采样

探索LLM推理全阶段的JSON格式输出限制方法

从 DeepSeek 敏感信息泄露谈可观测系统的数据安全预防

Excel数据治理新思路：引入智能体实现自动纠错【Python+Agent】

Qwen-MT：翻得快，译得巧

Flink 2.1 SQL：解锁实时数据与AI集成，实现可扩展流处理

自媒体创作场景实践｜通义千问3 + MCP=一切皆有可能

基于阿里云PAI平台搭建知识库检索增强的大模型对话系统

灵魂拷问-前端的作用--性能优化篇

官方博客-第9页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

大模型推理优化实践：KV cache复用与投机采样

探索LLM推理全阶段的JSON格式输出限制方法

从 DeepSeek 敏感信息泄露谈可观测系统的数据安全预防

Excel数据治理新思路：引入智能体实现自动纠错【Python+Agent】

Qwen-MT：翻得快，译得巧

Flink 2.1 SQL：解锁实时数据与AI集成，实现可扩展流处理

自媒体创作场景实践｜通义千问3 + MCP=一切皆有可能

基于阿里云PAI平台搭建知识库检索增强的大模型对话系统

灵魂拷问-前端的作用--性能优化篇