ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

369

升正

2024-05-15

67

请删掉99%的useMemo

你的useMemo真正为你的项目带来了多少性能上的优化？由于useMemo和useCallback类似，所以本文全文会在大部分地方以useMemo为例，部分例子使用useCallback帮助大家更好的理解两个hooks。

升正

67

斗一

2024-05-15

226

阿里云AccessKey调用溯源最佳实践

本文主要介绍如何对阿里云访问控制访问密钥（AccessKey）开展调用溯源工作，方便大家快速有效的开展事件调查、安全加固、应急处置等。

斗一

226

瑞丹

2024-06-05

500

台州银行携手瓴羊Dataphin共建数据平台，打造小微金融治理新标杆

台州银行数据治理项目携手瓴羊Dataphin，荣获中国信息通信研究院评为“2023年铸基计划高质量数字化转型典型优秀案例”、数字化研究机构沙丘社区选为“2024中国数据资产管理最佳实践案例”双重认可。

瑞丹

500

豁朗

2021-08-13

1719

用SLS配置日志关键字告警的N种方法

本文主要介绍一种免运维，高性能，支持灵活配置的方案，使用SLS接入日志和告警。

豁朗

1,719

非有

2024-05-15

916

一文详解 Java 限流接口实现

本文介绍的实现方式属于应用级限制，应用级限流方式只是单应用内的请求限流，不能进行全局限流。要保证系统的抗压能力，限流是一个必不可少的环节，虽然可能会造成某些用户的请求被丢弃，但相比于突发流量造成的系统宕机来说，这些损失一般都在可以接受的范围之内。

非有

916

探索云世界

2024-05-15

209

一天完成基于Serverless架构的头像漫画风处理小程序

我一直都想要有一个漫画版的头像，奈何手太笨，用了很多软件 “捏不出来”，所以就在想着，是否可以基于 AI 实现这样一个功能，并部署到 Serverless 架构上让更多人来尝试使用呢。

探索云世界

209

阿里云实时计算Flink

2023-03-30

4477

Apache Paimon 在同程旅行的探索实践

本文主要介绍 Apache Paimon 在同程旅行的生产落地实践经验。

阿里云实时计算Flink

4,477

ModelScope

2024-05-15

326

Modelscope结合α-UMi：基于Modelscope的多模型协作Agent

基于单个开源小模型的工具调用Agent，由于模型容量和预训练能力获取的限制，无法在推理和规划、工具调用、回复生成等任务上同时获得比肩大模型等性能。

ModelScope

326

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

请删掉99%的useMemo

阿里云AccessKey调用溯源最佳实践

台州银行携手瓴羊Dataphin共建数据平台，打造小微金融治理新标杆

用SLS配置日志关键字告警的N种方法

一文详解 Java 限流接口实现

一天完成基于Serverless架构的头像漫画风处理小程序

Apache Paimon 在同程旅行的探索实践

Modelscope结合α-UMi：基于Modelscope的多模型协作Agent