官方博客-第24页-阿里云开发者社区

ModelScope

2024-05-15

1125

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

1,125

CloudImagine

2024-07-05

372

泛娱乐出海Plus时代，音视频能力基座与时俱进

泛娱乐的音视频技术随着出海在演进，交互和内容的技术是内核，也在融合。

CloudImagine

372

阿里云百炼

2024-07-09

1462

阿里云百炼应用实践系列-基于LlamaIndex的文档问答助手

本文以阿里云百炼官方文档问答助手为例，介绍如何基于阿里云百炼平台打造基于LlamaIndex的RAG文档问答产品。我们基于阿里云百炼平台的底座能力，以官方帮助文档为指定知识库，搭建了问答服务，支持钉钉、Web访问。介绍了相关技术方案和主要代码，供开发者参考。

阿里云百炼

1,462

子丑

2024-07-22

16439

超越流水线，企业研发规范落地新思路

一文详解研发规范的目标、常见误区、选型方法与常见最佳实践。

子丑

16,439

信徒

2024-12-05

799

我的程序突然罢工了｜深入探究HSF调用异常，从死锁到活锁的全面分析与解决

本文详细记录了作者在处理HSF调用异常问题的过程中，从初步怀疑死锁到最终发现并解决活锁问题的全过程。

信徒

799

阿里云弹性计算

2025-01-06

171752

对话｜企业如何构建更完善的容器供应链安全防护体系

阿里云与企业共筑容器供应链安全

阿里云弹性计算

171,752

阿里云云原生

2025-02-19

455

一键构建智能导购 AI 助手，轻松重塑购物体验

在数字化时代，线上购物已成为消费者生活中不可或缺的消费方式，而消费者的购物习惯和需求逐渐呈现多样化的趋势，为了帮助商家全天候、自动化地满足顾客的购物需求，本方案将详细介绍如何基于商品内容构建一个智能商品导购助手。

阿里云云原生

455

柯灵

2025-03-11

1561

QwQ-32B一键部署，真正的0代码，0脚本，0门槛

阿里云发布的QwQ-32B模型通过强化学习显著提升了推理能力，核心指标达到DeepSeek-R1满血版水平。用户可通过阿里云系统运维管理（OOS）一键部署OpenWebUI+Ollama方案，轻松将QwQ-32B模型部署到ECS，或连接阿里云百炼的在线模型。整个过程无需编写代码，全部在控制台完成，适合新手操作。

柯灵

1,561

澄潭计缘望宸

2025-03-14

956

大模型无缝切换，QwQ-32B和DeepSeek-R1 全都要

通义千问最新推出的QwQ-32B推理模型，拥有320亿参数，性能媲美DeepSeek-R1（6710亿参数）。QwQ-32B支持在小型移动设备上本地运行，并可将企业大模型API调用成本降低90%以上。本文介绍了如何通过Higress AI网关实现DeepSeek-R1与QwQ-32B之间的无缝切换，涵盖环境准备、模型接入配置及客户端调用示例等内容。此外，还详细探讨了Higress AI网关的多模型服务、消费者鉴权、模型自动切换等高级功能，帮助企业解决TPS与成本平衡、内容安全合规等问题，提升大模型应用的稳定性和效率。

澄潭计缘望宸等

956

官方博客-第24页-阿里云开发者社区

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

泛娱乐出海Plus时代，音视频能力基座与时俱进

阿里云百炼应用实践系列-基于LlamaIndex的文档问答助手

超越流水线，企业研发规范落地新思路

我的程序突然罢工了｜深入探究HSF调用异常，从死锁到活锁的全面分析与解决

对话｜企业如何构建更完善的容器供应链安全防护体系

一键构建智能导购 AI 助手，轻松重塑购物体验

QwQ-32B一键部署，真正的0代码，0脚本，0门槛

大模型无缝切换，QwQ-32B和DeepSeek-R1 全都要

官方博客-第24页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

泛娱乐出海Plus时代，音视频能力基座与时俱进

阿里云百炼应用实践系列-基于LlamaIndex的文档问答助手

超越流水线，企业研发规范落地新思路

我的程序突然罢工了｜深入探究HSF调用异常，从死锁到活锁的全面分析与解决

对话｜企业如何构建更完善的容器供应链安全防护体系

一键构建智能导购 AI 助手，轻松重塑购物体验

QwQ-32B一键部署，真正的0代码，0脚本，0门槛

大模型无缝切换，QwQ-32B和DeepSeek-R1 全都要