ModelScope

2024-05-15

vLLM部署Yuan2.0：高吞吐、更便捷

vLLM是UC Berkeley开源的大语言模型高速推理框架，其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等，一方面可以提升Yuan2.0模型推理部署时的内存使用效率，另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

ModelScope

408

尹航

2023-10-09

29856

基于阿里云服务网格流量泳道的全链路流量管理（一）严格模式流量泳道

灰度发布是一种常见的对新版本应用服务的发布手段，其特点在于能够将流量在服务的稳定版本和灰度版本之间时刻切换，以帮助我们用更加可靠的方式实现服务的升级。

尹航

29,856

豁朗

2024-05-15

56091

使用 SPL 高效实现 Flink SLS Connector 下推

SLS 推出了 SPL 语言，可以高效的对日志数据的清洗，加工。对 SPL 及 SPL 在阿里云 Flink SLS Connector 中应用进行介绍及举例。

豁朗

56,091

阿里云大数据Al技术

2024-05-15

77695

【AAAI 2024】MuLTI：高效视频与语言理解

多模态理解模型具有广泛的应用，比如多标签分类、视频问答（videoQA）和文本视频检索等。现有的方法已经在视频和语言理解方面取得了重大进展，然而，他们仍然面临两个巨大的挑战：无法充分的利用现有的特征；训练时巨大的GPU内存消耗。我们提出了MuLTI，这是一种高度准确高效的视频和语言理解模型，可以实现高效有效的特征融合和对下游任务的快速适应。本文详细介绍基于MuLTI实现高效视频与语言理解。

阿里云大数据Al技术

77,695

太业

2024-05-15

164

跟着iLogtail学习无锁化编程

锁是解决这些问题的传统方法，而无锁化编程是一种更高级但复杂的技术，它能够在某些情况下提供更优的性能和可扩展性。正确选择和实现适合应用场景的并发策略，是高效多线程编程的关键。本文由作者带着大家一起学习无锁化编程。

太业

164

澄潭董艺荃

2024-05-16

87959

通义千问 2.5 “客串” ChatGPT4，看这篇让你分清楚

这篇文章介绍了使用开源工具NextChat和Higress搭建的一个模拟ChatGPT和通义千问对话PK的测试场景。

澄潭董艺荃

87,959

澄潭望宸

2024-07-22

372

AI 时代，网关更能打了

随着互联网从 Web 2.0 迈进到 AI 时代，用户和互联网的交互方式，AI 时代下互联网的内容生产流程都发生了显著的转变，这对基础设施（Infra）提出了新的诉求，也带来了新的机遇。Infra 包含的内容非常丰富，本文仅从网关层面分享笔者的所见所感所悟。

澄潭望宸

372

阿里云云原生

2024-08-16

513

用 Higress AI 网关降低 AI 调用成本 - 阿里云天池云原生编程挑战赛参赛攻略

《Higress AI 网关挑战赛》正在火热进行中，Higress 社区邀请了目前位于排行榜 top5 的选手杨贝宁同学分享他的心得。本文是他整理的参赛攻略。

阿里云云原生

513

阿里云中间件

2023-08-25

368

充换电企业开迈斯低成本提升线上应用稳定性的最佳实践

阿里云中间件

368

类目筛选

内容类型

vLLM部署Yuan2.0：高吞吐、更便捷

基于阿里云服务网格流量泳道的全链路流量管理（一）严格模式流量泳道

使用 SPL 高效实现 Flink SLS Connector 下推

【AAAI 2024】MuLTI：高效视频与语言理解

跟着iLogtail学习无锁化编程

通义千问 2.5 “客串” ChatGPT4，看这篇让你分清楚

AI 时代，网关更能打了

用 Higress AI 网关降低 AI 调用成本 - 阿里云天池云原生编程挑战赛参赛攻略

充换电企业开迈斯低成本提升线上应用稳定性的最佳实践