王骜

2024-05-15

一键开启 GPU 闲置模式，基于函数计算低成本部署 Google Gemma 模型服务

本文介绍如何使用函数计算 GPU 实例闲置模式低成本、快速的部署 Google Gemma 模型服务。

王骜

164,915

扬流

2024-05-15

118021

Paimon 与 Spark 的集成（二）：查询优化

通过一系列优化，我们将 Paimon x Spark 在 TpcDS 上的性能提高了37+%，已基本和 Parquet x Spark 持平，本文对其中的关键优化点进行了详细介绍。

扬流

118,021

阿里云大数据Al技术

2024-05-15

144811

一键生成视频，用 PAI-EAS 部署 AI 视频生成模型 SVD 工作流

本教程将带领大家免费领取阿里云PAI-EAS的免费试用资源，并且带领大家在 ComfyUI 环境下使用 SVD的模型，根据任何图片生成一个小短视频。

阿里云大数据Al技术

144,811

ModelScope

2024-05-15

369

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

369

升正

2024-05-15

67

请删掉99%的useMemo

你的useMemo真正为你的项目带来了多少性能上的优化？由于useMemo和useCallback类似，所以本文全文会在大部分地方以useMemo为例，部分例子使用useCallback帮助大家更好的理解两个hooks。

升正

67

非有

2024-05-15

916

一文详解 Java 限流接口实现

本文介绍的实现方式属于应用级限制，应用级限流方式只是单应用内的请求限流，不能进行全局限流。要保证系统的抗压能力，限流是一个必不可少的环节，虽然可能会造成某些用户的请求被丢弃，但相比于突发流量造成的系统宕机来说，这些损失一般都在可以接受的范围之内。

非有

916

ModelScope

2024-05-15

398

元象大模型开源30款量化版本加速低成本部署丨附教程

元象大模型一次性发布30款量化版本，全开源，无条件免费商用。

ModelScope

398

ModelScope

2024-05-15

391

Multi-Agent实践第6期：面向智能体编程：狼人杀在AgentScope

本期文章，我们会介绍一下AgentScope的一个设计哲学（Agent-oriented programming）

ModelScope

391

瑞丹

2024-06-05

499

台州银行携手瓴羊Dataphin共建数据平台，打造小微金融治理新标杆

台州银行数据治理项目携手瓴羊Dataphin，荣获中国信息通信研究院评为“2023年铸基计划高质量数字化转型典型优秀案例”、数字化研究机构沙丘社区选为“2024中国数据资产管理最佳实践案例”双重认可。

瑞丹

499

类目筛选

内容类型

一键开启 GPU 闲置模式，基于函数计算低成本部署 Google Gemma 模型服务

Paimon 与 Spark 的集成（二）：查询优化

一键生成视频，用 PAI-EAS 部署 AI 视频生成模型 SVD 工作流

vLLM部署Yuan2.0：高吞吐、更便捷

请删掉99%的useMemo

一文详解 Java 限流接口实现

元象大模型开源30款量化版本加速低成本部署丨附教程

Multi-Agent实践第6期：面向智能体编程：狼人杀在AgentScope

台州银行携手瓴羊Dataphin共建数据平台，打造小微金融治理新标杆

类目筛选

内容类型

一键开启 GPU 闲置模式，基于函数计算低成本部署 Google Gemma 模型服务

Paimon 与 Spark 的集成（二）：查询优化

一键生成视频，用 PAI-EAS 部署 AI 视频生成模型 SVD 工作流

vLLM部署Yuan2.0：高吞吐、更便捷

请删掉99%的useMemo

一文详解 Java 限流接口实现

元象大模型开源30款量化版本 加速低成本部署丨附教程

Multi-Agent实践第6期：面向智能体编程：狼人杀在AgentScope

台州银行携手瓴羊Dataphin共建数据平台，打造小微金融治理新标杆

元象大模型开源30款量化版本加速低成本部署丨附教程