ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

369

升正

2024-05-15

67

请删掉99%的useMemo

你的useMemo真正为你的项目带来了多少性能上的优化？由于useMemo和useCallback类似，所以本文全文会在大部分地方以useMemo为例，部分例子使用useCallback帮助大家更好的理解两个hooks。

升正

67

非有

2024-05-15

916

一文详解 Java 限流接口实现

本文介绍的实现方式属于应用级限制，应用级限流方式只是单应用内的请求限流，不能进行全局限流。要保证系统的抗压能力，限流是一个必不可少的环节，虽然可能会造成某些用户的请求被丢弃，但相比于突发流量造成的系统宕机来说，这些损失一般都在可以接受的范围之内。

非有

916

ModelScope

2024-05-15

398

元象大模型开源30款量化版本加速低成本部署丨附教程

元象大模型一次性发布30款量化版本，全开源，无条件免费商用。

ModelScope

398

探索云世界

2024-05-15

177

针对性架构芯片soc环境傻瓜式教程

本文介绍了初步搭建VNC远程桌面，完成soc环境搭建第一步的方法。

探索云世界

177

豁朗

2021-08-13

1718

用SLS配置日志关键字告警的N种方法

本文主要介绍一种免运维，高性能，支持灵活配置的方案，使用SLS接入日志和告警。

豁朗

1,718

云服务器ECS

2023-07-10

4153

一键配置版：搭建高可用的微信/支付宝小程序服务

本文提供在阿里云云服务器ECS上基于CentOS 7.9 64位操作系统搭建高可用的小程序服务端的指引。同时指导您在本地开发一个简单的微信/支付宝小程序——ECS小助手，通过远程调用部署在ECS上的服务端，实现在小程序中输入框输入ECS实例ID查询实例详细信息的功能。

云服务器ECS

4,153

岱泽

2024-05-15

75508

总结｜性能优化思路及常用工具及手段

性能优化是降低成本的手段之一，每年大促前业务平台都会组织核心链路上的应用做性能优化，一方面提升系统性能，另外一方面对腐化的代码进行清理。本文结合业务平台性能优化的经验，探讨一下性能优化的思路及常用工具及手段。

岱泽

75,508

ModelScope

2024-05-15

141

元象开源首个MoE大模型：4.2B激活参数，效果堪比13B模型，魔搭社区最佳实践来了

近日，元象发布其首个Moe大模型 XVERSE-MoE-A4.2B，采用混合专家模型架构（Mixture of Experts），激活参数4.2B，效果即可媲美13B模型。该模型全开源，无条件免费商用，支持中小企业、研究者和开发者可在元象高性能“全家桶”中按需选用，推动低成本部署。

ModelScope

141

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

请删掉99%的useMemo

一文详解 Java 限流接口实现

元象大模型开源30款量化版本加速低成本部署丨附教程

针对性架构芯片soc环境傻瓜式教程

用SLS配置日志关键字告警的N种方法

一键配置版：搭建高可用的微信/支付宝小程序服务

总结｜性能优化思路及常用工具及手段

元象开源首个MoE大模型：4.2B激活参数，效果堪比13B模型，魔搭社区最佳实践来了

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

请删掉99%的useMemo

一文详解 Java 限流接口实现

元象大模型开源30款量化版本 加速低成本部署丨附教程

针对性架构芯片soc环境傻瓜式教程

用SLS配置日志关键字告警的N种方法

一键配置版：搭建高可用的微信/支付宝小程序服务

总结｜性能优化思路及常用工具及手段

元象开源首个MoE大模型：4.2B激活参数，效果堪比13B模型，魔搭社区最佳实践来了

元象大模型开源30款量化版本加速低成本部署丨附教程