ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

407

升正

2024-05-15

98

请删掉99%的useMemo

你的useMemo真正为你的项目带来了多少性能上的优化？由于useMemo和useCallback类似，所以本文全文会在大部分地方以useMemo为例，部分例子使用useCallback帮助大家更好的理解两个hooks。

升正

98

阿里云云原生

2024-08-16

513

用 Higress AI 网关降低 AI 调用成本 - 阿里云天池云原生编程挑战赛参赛攻略

《Higress AI 网关挑战赛》正在火热进行中，Higress 社区邀请了目前位于排行榜 top5 的选手杨贝宁同学分享他的心得。本文是他整理的参赛攻略。

阿里云云原生

513

阿里云中间件

2023-08-25

368

充换电企业开迈斯低成本提升线上应用稳定性的最佳实践

阿里云中间件

368

尹航

2023-10-09

29855

基于阿里云服务网格流量泳道的全链路流量管理（一）严格模式流量泳道

灰度发布是一种常见的对新版本应用服务的发布手段，其特点在于能够将流量在服务的稳定版本和灰度版本之间时刻切换，以帮助我们用更加可靠的方式实现服务的升级。

尹航

29,855

林以琳

2024-05-15

772

基于PAI-DSW快速启动Stable Diffusion WebUI

基于PAI-DSW快速启动Stable Diffusion WebUI，创作你的专属冬日主题AI画作！

林以琳

772

元乙

2024-05-15

53015

面向全栈可观测的性能监控

SLS性能持续分析基于开放的接入生态与持续性能分析的理念所构建（开放接入部分已在iLogtail开源），基于SLS 性能持续分析，将为广大开发者提供开箱即用、一站式的的性能观测体验，助力开发者轻松面对多云、多Region、多版本、微服务等场景下的性能分析需求。

元乙

53,015

葳葳

2024-05-15

122348

每天一个摆脱if-else工程师的技巧，优雅的参数校验

在日常的开发工作中，为了程序的健壮性，大部分方法都需要进行入参数据校验。本文围绕作者如何优雅的进行参数校验展开讨论。

葳葳

122,348

隆基

2024-05-15

90972

深度剖析 RocketMQ 5.0，IoT 消息：物联网需要什么样的消息技术？

本文来学习一个典型的物联网技术架构，以及在这个技术架构里面，消息队列所发挥的作用。在物联网的场景里面，对消息技术的要求和面向服务端应用的消息技术有什么区别？学习 RocketMQ 5.0 的子产品 MQTT，是如何解决这些物联网技术难题的。

隆基

90,972

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

请删掉99%的useMemo

用 Higress AI 网关降低 AI 调用成本 - 阿里云天池云原生编程挑战赛参赛攻略

充换电企业开迈斯低成本提升线上应用稳定性的最佳实践

基于阿里云服务网格流量泳道的全链路流量管理（一）严格模式流量泳道

基于PAI-DSW快速启动Stable Diffusion WebUI

面向全栈可观测的性能监控

每天一个摆脱if-else工程师的技巧，优雅的参数校验

深度剖析 RocketMQ 5.0，IoT 消息：物联网需要什么样的消息技术？