ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

408

ModelScope

2024-05-15

194

联合XTuner，魔搭社区全面支持数据集的长文本训练

XTuner和魔搭社区（SWIFT）合作引入了一项长序列文本训练技术，该技术能够在多GPU环境中将长序列文本数据分割并分配给不同GPU，从而减少每个GPU上的显存占用。通过这种方式，训练超大规模模型时可以处理更长的序列，提高训练效率。魔搭社区的SWIFT框架已经集成了这一技术，支持多种大模型和数据集的训练。此外，SWIFT还提供了一个用户友好的界面，方便用户进行训练和部署，并且支持评估功能。

ModelScope

194

刘军

2024-06-18

16589

Dubbo3 服务原生支持 http 访问，兼具高性能与易用性

本文展示了 Dubbo3 triple 协议是如何简化从协议规范与实现上简化开发测试、入口流量接入成本的，同时提供高性能通信、面向接口的易用性编码。

刘军

16,589

继儒

2023-03-21

2278

Hologres技术揭秘，JSON半结构化数据的极致分析性能

本文将会揭秘Hologres JSONB半结构化数据的技术原理，实现JSON半结构数据的极致分析性能。

继儒

2,278

阿里云实时数仓Hologres

2023-07-17

20676

基于Hologres向量计算与大模型免费定制专属聊天机器人

本文为您介绍如何基于Hologres向量计算能力，结合大模型的阅读理解和信息整合能力，对该垂直行业的问题提供更贴切的回答，即费、快速定制专属聊天机器人。

阿里云实时数仓Hologres

20,676

阿里云MaxCompute

2023-09-27

1187

深入MaxCompute，人力家借助Information Schema合理治理费用

本文将为大家带来MaxCompute与人力家客户案例深度解读。

阿里云MaxCompute

1,187

林以琳

2024-05-15

772

基于PAI-DSW快速启动Stable Diffusion WebUI

基于PAI-DSW快速启动Stable Diffusion WebUI，创作你的专属冬日主题AI画作！

林以琳

772

阿里云云原生

2024-05-15

113637

函数计算部署AI艺术字应用，生成新春文字头像

基于 Stable Diffusion Serverless API 解决方案搭建 AI 文字生成应用，支持并发出图。

阿里云云原生

113,637

ModelScope

2024-05-15

351

Modelscope结合α-UMi：基于Modelscope的多模型协作Agent

基于单个开源小模型的工具调用Agent，由于模型容量和预训练能力获取的限制，无法在推理和规划、工具调用、回复生成等任务上同时获得比肩大模型等性能。

ModelScope

351

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

联合XTuner，魔搭社区全面支持数据集的长文本训练

Dubbo3 服务原生支持 http 访问，兼具高性能与易用性

Hologres技术揭秘，JSON半结构化数据的极致分析性能

基于Hologres向量计算与大模型免费定制专属聊天机器人

深入MaxCompute，人力家借助Information Schema合理治理费用

基于PAI-DSW快速启动Stable Diffusion WebUI

函数计算部署AI艺术字应用，生成新春文字头像

Modelscope结合α-UMi：基于Modelscope的多模型协作Agent