官方博客-第17页-阿里云开发者社区

殳玄

2025-01-16

1029

现身说法，AI小白的大模型学习路径

写这篇文章的初衷：作为一个AI小白，把我自己学习大模型的学习路径还原出来，包括理解的逻辑、看到的比较好的学习材料，通过一篇文章给串起来，对大模型建立起一个相对体系化的认知，才能够在扑面而来的大模型时代，看出点门道。

殳玄

1,029

新念

2025-02-14

1439

DeepSeek-V3 高效训练关键技术分析

本文从模型架构、并行策略、通信优化和显存优化四个方面展开，深入分析了DeepSeek-V3高效训练的关键技术，探讨其如何以仅5%的算力实现对标GPT-4o的性能。

新念

1,439

荣阳

2025-02-28

1045

使用A10单卡24G复现DeepSeek R1强化学习过程

本文描述DeepSeek的三个模型的学习过程，其中DeepSeek-R1-Zero模型所涉及的强化学习算法，是DeepSeek最核心的部分之一会重点展示。

荣阳

1,045

阿里云开发者

2025-03-21

814

通义灵码2.0引入了DeepSeek V3与R1模型，新增Qwen2.5-Max和QWQ模型，支持个性化服务切换。阿里云发布开源推理模型QwQ-32B，在数学、代码及通用能力上表现卓越，性能媲美DeepSeek-R1，且部署成本低。AI程序员功能涵盖表结构设计、前后端代码生成、单元测试与错误排查，大幅提升开发效率。跨语言编程示例中，成功集成DeepSeek-R1生成公告内容。相比1.0版本，2.0支持多款模型，丰富上下文类型，具备多文件修改能力。总结显示，AI程序员生成代码准确度高，但需参考现有工程风格以确保一致性，错误排查功能强大，适合明确问题描述场景。相关链接提供下载与原文参考。

阿里云开发者

814

墨飏

2025-04-17

684

MCP 的 AI 好搭档

本文介绍了MCP（模型上下文协议）及其在AI领域的应用前景。MCP由Anthropic公司推出，通过标准化通信协议实现AI与数据源间的安全隔离，解决了传统AI应用中的数据隐私和安全问题。文章探讨了从LLM到MCP的进化过程，并分析了其面临的挑战，如算力不足和开放性需求。Serverless技术被提出作为解决这些问题的方案，提供弹性算力和支持安全沙箱环境。最后，文章提供了如何一键部署热门MCP Server的教程，帮助开发者快速上手并体验该协议的实际应用效果。

墨飏

684

阿里云基础设施.

2025-05-01

385

ACK AI Profiling：从黑箱到透明的问题剖析

本文从一个通用的客户问题出发，描述了一个问题如何从前置排查到使用AI Profiling进行详细的排查，最后到问题定位与解决、业务执行过程的分析，从而展现一个从黑箱到透明的精细化的剖析过程。

阿里云基础设施.

385

周宇睿

2023-09-08

735

MaxCompute半结构化数据思考与创新

本文将介绍MaxCompute在半结构化数据方面的一些思考与创新，围绕半结构化数据简析、传统方案优劣对比、MaxCompute半结构化数据解决方案、收益分析。

周宇睿

735

阿里云大数据Al技术

2024-05-15

145486

一键生成视频，用 PAI-EAS 部署 AI 视频生成模型 SVD 工作流

本教程将带领大家免费领取阿里云PAI-EAS的免费试用资源，并且带领大家在 ComfyUI 环境下使用 SVD的模型，根据任何图片生成一个小短视频。

阿里云大数据Al技术

145,486

ModelScope

2024-05-15

747

联合XTuner，魔搭社区全面支持数据集的长文本训练

XTuner和魔搭社区（SWIFT）合作引入了一项长序列文本训练技术，该技术能够在多GPU环境中将长序列文本数据分割并分配给不同GPU，从而减少每个GPU上的显存占用。通过这种方式，训练超大规模模型时可以处理更长的序列，提高训练效率。魔搭社区的SWIFT框架已经集成了这一技术，支持多种大模型和数据集的训练。此外，SWIFT还提供了一个用户友好的界面，方便用户进行训练和部署，并且支持评估功能。

ModelScope

747

官方博客-第17页-阿里云开发者社区

类目筛选

内容类型

现身说法，AI小白的大模型学习路径

DeepSeek-V3 高效训练关键技术分析

使用A10单卡24G复现DeepSeek R1强化学习过程

在IDEA中借助满血版 DeepSeek 提高编码效率

MCP 的 AI 好搭档

ACK AI Profiling：从黑箱到透明的问题剖析

MaxCompute半结构化数据思考与创新

一键生成视频，用 PAI-EAS 部署 AI 视频生成模型 SVD 工作流

联合XTuner，魔搭社区全面支持数据集的长文本训练

官方博客-第17页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

现身说法，AI小白的大模型学习路径

DeepSeek-V3 高效训练关键技术分析

使用A10单卡24G复现DeepSeek R1强化学习过程

在IDEA中借助满血版 DeepSeek 提高编码效率

MCP 的 AI 好搭档

ACK AI Profiling：从黑箱到透明的问题剖析

MaxCompute半结构化数据思考与创新

一键生成视频，用 PAI-EAS 部署 AI 视频生成模型 SVD 工作流

联合XTuner，魔搭社区全面支持数据集的长文本训练