官方博客-第23页-阿里云开发者社区

ModelScope

2024-05-15

1127

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

1,127

澄潭董艺荃

2024-05-16

88524

通义千问 2.5 “客串” ChatGPT4，看这篇让你分清楚

这篇文章介绍了使用开源工具NextChat和Higress搭建的一个模拟ChatGPT和通义千问对话PK的测试场景。

澄潭董艺荃

88,524

阿里云云原生

2024-09-06

292

MacTalk 测评通义灵码，实现“微信表情”小功能

墨问西东创始人池建强分享了团队使用通义灵码的经验。

阿里云云原生

292

寒斜

2024-11-19

727

基于事件驱动构建 AI 原生应用

AI 应用在商业化服务的阶段会面临诸多挑战，比如更快的服务交付速度，更实时、精准的结果以及更人性化的体验等，传统架构限制于同步交互，无法满足上述需求，本篇文章给大家分享一下如何基于事件驱动架构应对上述挑战。

寒斜

727

探索云世界

2025-01-02

378

云端问道11期实践教学-创建专属AI助手

本次分享意在帮助用户更加全面、深入地了解百炼的核心产品能力，并通过实际操作学会如何快速将大模型与自己的系统及应用相结合。主要包括以下三个方面： 1. 阿里云百炼产品定位和能力简介 2. 知识检索 RAG 智能体应用能力和优势 3. 最佳落地案例实践分享

探索云世界

378

李德

2025-04-03

392

结合多模态RAG和异步调用实现大模型内容

文章探讨了如何利用多模态大模型和工程优化手段提升物流理赔业务效率。核心方案包括：通过多模态RAG技术实现图片查重，结合异步调用方法优化货损识别功能。

李德

392

以珩

2025-04-10

483

用自定义插件生成一篇图文并茂的文章

本文是《5步教你创建大模型自定义插件》的下篇，主要就已有的自定义插件中的生图能力为例，演示如何生成一个图文并茂的文章。

以珩

483

阿里云云原生

2025-06-30

406

基于 AI 网关和 llmaz，提升 vLLM 推理服务可用性和部署易用性的实践

本文介绍了如何使用 llmaz 快速部署基于 vLLM 的大语言模型推理服务，并结合 Higress AI 网关实现流量控制、可观测性、故障转移等能力，构建稳定、高可用的大模型服务平台。

阿里云云原生

406

阿里云云原生

2025-08-06

379

JSON 日志分析的“正确姿势”：阿里云 SLS 高效实践指南

JSON 日志因灵活易扩展而广泛应用，但其海量数据也带来分析挑战。本文系统介绍阿里云日志服务（SLS）中处理 JSON 日志的最佳实践，涵盖数据预处理、索引配置、JSON 函数使用及 SQL 智能生成，助你高效挖掘日志价值。

阿里云云原生

379

官方博客-第23页-阿里云开发者社区

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

通义千问 2.5 “客串” ChatGPT4，看这篇让你分清楚

MacTalk 测评通义灵码，实现“微信表情”小功能

基于事件驱动构建 AI 原生应用

云端问道11期实践教学-创建专属AI助手

结合多模态RAG和异步调用实现大模型内容

用自定义插件生成一篇图文并茂的文章

基于 AI 网关和 llmaz，提升 vLLM 推理服务可用性和部署易用性的实践

JSON 日志分析的“正确姿势”：阿里云 SLS 高效实践指南

官方博客-第23页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

通义千问 2.5 “客串” ChatGPT4，看这篇让你分清楚

MacTalk 测评通义灵码，实现“微信表情”小功能

基于事件驱动构建 AI 原生应用

云端问道11期实践教学-创建专属AI助手

结合多模态RAG和异步调用实现大模型内容

用自定义插件生成一篇图文并茂的文章

基于 AI 网关和 llmaz，提升 vLLM 推理服务可用性和部署易用性的实践

JSON 日志分析的“正确姿势”：阿里云 SLS 高效实践指南