官方博客-第17页-阿里云开发者社区

阿里云网络

2023-07-12

897

阿里云飞天洛神云网络集中式网关ACMG最佳实践

云网络集中式网关ACMG的实践

阿里云网络

897

ModelScope

2024-05-15

505

元象开源首个MoE大模型：4.2B激活参数，效果堪比13B模型，魔搭社区最佳实践来了

近日，元象发布其首个Moe大模型 XVERSE-MoE-A4.2B，采用混合专家模型架构（Mixture of Experts），激活参数4.2B，效果即可媲美13B模型。该模型全开源，无条件免费商用，支持中小企业、研究者和开发者可在元象高性能“全家桶”中按需选用，推动低成本部署。

ModelScope

505

ModelScope

2024-05-15

1124

LISA微调技术解析：比LoRA更低的显存更快的速度

LISA是Layerwise Importance Sampling for Memory-Efficient Large Language Model Fine-Tuning的简写，由UIUC联合LMFlow团队于近期提出的一项LLM微调技术，可实现把全参训练的显存使用降低到之前的三分之一左右，而使用的技术方法却是非常简单。

ModelScope

1,124

明巍临城水德

2024-11-14

527

通义灵码 SWE-GPT：从静态代码建模迈向软件开发过程长链推理

在本文中，作者介绍了 Lingma SWE-GPT，一款专为解决复杂软件改进任务设计的开源大型语言模型系列。

明巍临城水德等

527

李德

2024-12-06

1335

【阅读十分钟，百分百成功】——通过大模型实现对客服回答的质量评估

本文章基于业务实践，总结有关客服质检场景的解决方案和处理经验，为相似场景提供可行的借鉴方法。

李德

1,335

阿里云云原生

2025-02-25

1118

解锁 DeepSeek 安全接入、稳定运行新路径

聚焦于企业部署 DeepSeek 的应用需求，本文介绍了模型权重下载及多种部署方案，还阐述了大模型应用落地的常见需求，帮助用户逐步提升模型应用效果。

阿里云云原生

1,118

阿里云MaxCompute

2023-09-27

1422

深入MaxCompute，人力家借助Information Schema合理治理费用

本文将为大家带来MaxCompute与人力家客户案例深度解读。

阿里云MaxCompute

1,422

吴昆

2024-05-15

222076

Kube Queue：Kubernetes 任务排队的利器

吴昆

222,076

ModelScope

2024-05-15

1142

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

1,142

官方博客-第17页-阿里云开发者社区

类目筛选

内容类型

阿里云飞天洛神云网络集中式网关ACMG最佳实践

元象开源首个MoE大模型：4.2B激活参数，效果堪比13B模型，魔搭社区最佳实践来了

LISA微调技术解析：比LoRA更低的显存更快的速度

通义灵码 SWE-GPT：从静态代码建模迈向软件开发过程长链推理

【阅读十分钟，百分百成功】——通过大模型实现对客服回答的质量评估

解锁 DeepSeek 安全接入、稳定运行新路径

深入MaxCompute，人力家借助Information Schema合理治理费用

Kube Queue：Kubernetes 任务排队的利器

vLLM部署Yuan2.0：高吞吐、更便捷

官方博客-第17页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

阿里云飞天洛神云网络集中式网关ACMG最佳实践

元象开源首个MoE大模型：4.2B激活参数，效果堪比13B模型，魔搭社区最佳实践来了

LISA微调技术解析：比LoRA更低的显存更快的速度

通义灵码 SWE-GPT：从 静态代码建模 迈向 软件开发过程长链推理

【阅读十分钟，百分百成功】——通过大模型实现对客服回答的质量评估

解锁 DeepSeek 安全接入、稳定运行新路径

深入MaxCompute，人力家借助Information Schema合理治理费用

Kube Queue：Kubernetes 任务排队的利器

vLLM部署Yuan2.0：高吞吐、更便捷

通义灵码 SWE-GPT：从静态代码建模迈向软件开发过程长链推理