官方博客-第11页-阿里云开发者社区

  • 1077

    Post-Training on PAI (4):模型微调SFT、DPO、GRPO

    阿里云人工智能平台 PAI 提供了完整的模型微调产品能力,支持 监督微调(SFT)、偏好对齐(DPO)、强化学习微调(GRPO) 等业界常用模型微调训练方式。根据客户需求及代码能力层级,分别提供了 PAI-Model Gallery 一键微调、PAI-DSW Notebook 编程微调、PAI-DLC 容器化任务微调的全套产品功能。

  • 2025-08-05
    1053

    Qwen-MT:翻得快,译得巧

    今天,机器翻译模型Qwen-MT正式上线,支持92种语言互译,具备高度可控性与低延迟、低成本特点,适用于多种场景。开发者可通过Qwen API体验其强大翻译能力。

  • 2025-02-14
    1571

    DeepSeek-V3 高效训练关键技术分析

    本文从模型架构、并行策略、通信优化和显存优化四个方面展开,深入分析了DeepSeek-V3高效训练的关键技术,探讨其如何以仅5%的算力实现对标GPT-4o的性能。

    1,571
  • 2024-05-15
    104825

    手把手教你捏一个自己的Agent

    Modelscope AgentFabric是一个基于ModelScope-Agent的交互式智能体应用,用于方便地创建针对各种现实应用量身定制智能体,目前已经在生产级别落地。

    104,825
  • 2025-06-24
    668

    通义灵码用户说 | 编程智能体+MCP加持,秒查附近蜜雪冰城

    通义灵码现已全面支持Qwen3,新增智能体模式,具备自主决策、环境感知、工具使用等能力,可端到端完成编码任务。支持问答、文件编辑、智能体多模式自由切换,结合MCP工具与记忆功能,提升开发效率。AI IDE重构编程流程,让开发更智能高效。

  • 2025-04-17
    1436

    通义灵码 Rules 库合集来了,覆盖Java、TypeScript、Python、Go、JavaScript 等

    通义灵码新上的外挂 Project Rules 获得了开发者的一致好评:最小成本适配我的开发风格、相当把团队经验沉淀下来,是个很好功能……

  • 2024-05-15
    906

    Mistral 7B v0.2 基础模型开源,魔搭社区微调教程和评测来啦!

    Mistral AI在3月24日突然发布并开源了 Mistral 7B v0.2模型,有如下几个特点

  • 2024-12-06
    1480

    【阅读十分钟,百分百成功】——通过大模型实现对客服回答的质量评估

    本文章基于业务实践,总结有关客服质检场景的解决方案和处理经验,为相似场景提供可行的借鉴方法。

    1,480
  • 2025-08-01
    1153

    Vibecoding 新体验:实测 Qwen3 Coder 代码生成效果

    Qwen3 Coder 是全球领先的开源编程大模型,具备强大的代码生成能力与1M超长上下文支持,适用于构建复杂应用。本文通过实际案例展示其在电商网站开发中的应用,并详解提示词设计、技术拆解与部署方案,探讨Agentic AI落地的挑战与经验。

  • 1
    ...
    10
    11
    12
    ...
    33
    到第
    11/33