ModelScope

2024-05-15

联合XTuner，魔搭社区全面支持数据集的长文本训练

XTuner和魔搭社区（SWIFT）合作引入了一项长序列文本训练技术，该技术能够在多GPU环境中将长序列文本数据分割并分配给不同GPU，从而减少每个GPU上的显存占用。通过这种方式，训练超大规模模型时可以处理更长的序列，提高训练效率。魔搭社区的SWIFT框架已经集成了这一技术，支持多种大模型和数据集的训练。此外，SWIFT还提供了一个用户友好的界面，方便用户进行训练和部署，并且支持评估功能。

ModelScope

193

怀虎

2024-07-08

46688

私网环境下使用云效流水线进行 CI/CD的方法

云效流水线可以托管用户的私网环境内的机器，并将构建任务调度到这些机器上，从而确保整个构建过程，和代码库和制品库的交互在私网环境下进行。

怀虎

46,688

阿里云实时数仓Hologres

2022-12-06

1232

升级JSONB列式存储，Hologres助力淘宝搜索2022双11降本增效

升级JSONB列式存储，Hologres助力淘宝搜索2022双11降本增效。

阿里云实时数仓Hologres

1,232

ModelScope

2024-05-15

407

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

407

阿里云实时数仓Hologres

2023-07-17

20676

基于Hologres向量计算与大模型免费定制专属聊天机器人

本文为您介绍如何基于Hologres向量计算能力，结合大模型的阅读理解和信息整合能力，对该垂直行业的问题提供更贴切的回答，即费、快速定制专属聊天机器人。

阿里云实时数仓Hologres

20,676

阿里云MaxCompute

2023-09-27

1187

深入MaxCompute，人力家借助Information Schema合理治理费用

本文将为大家带来MaxCompute与人力家客户案例深度解读。

阿里云MaxCompute

1,187

勿烦

2023-12-01

607

MaxCompute 重装上阵，Global Zorder

MaxCompute支持Global Zorder，使得整个表或者分区的数据在全局上能按照指定字段进行ZORDER排序，以便数据能有更好的聚集性。

勿烦

607

林以琳

2024-05-15

772

基于PAI-DSW快速启动Stable Diffusion WebUI

基于PAI-DSW快速启动Stable Diffusion WebUI，创作你的专属冬日主题AI画作！

林以琳

772

王骜

2024-05-15

164934

一键开启 GPU 闲置模式，基于函数计算低成本部署 Google Gemma 模型服务

本文介绍如何使用函数计算 GPU 实例闲置模式低成本、快速的部署 Google Gemma 模型服务。

王骜

164,934

类目筛选

内容类型

联合XTuner，魔搭社区全面支持数据集的长文本训练

私网环境下使用云效流水线进行 CI/CD的方法

升级JSONB列式存储，Hologres助力淘宝搜索2022双11降本增效

vLLM部署Yuan2.0：高吞吐、更便捷

基于Hologres向量计算与大模型免费定制专属聊天机器人

深入MaxCompute，人力家借助Information Schema合理治理费用

MaxCompute 重装上阵，Global Zorder

基于PAI-DSW快速启动Stable Diffusion WebUI

一键开启 GPU 闲置模式，基于函数计算低成本部署 Google Gemma 模型服务