官方博客-第36页-阿里云开发者社区

  • 2024-05-15
    1125

    vLLM部署Yuan2.0:高吞吐、更便捷

    vLLM是UC Berkeley开源的大语言模型高速推理框架,其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等,一方面可以提升Yuan2.0模型推理部署时的内存使用效率,另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

    1,125
  • 2024-06-27
    34029

    基于阿里云 OpenAPI 插件,让 Grafana 轻松实现云上数据可视化

    本文旨在提供一个指导性的框架,帮助用户了解插件的安装、配置以及探索如何通过 Grafana 内的阿里云 OpenAPI 插件来对云上数据进行可视化和快速验证开发原型,加强数据可视化和云监控能力,助力开发速度。

    34,029
  • 2024-08-12
    7722

    使用对比!SLS 数据加工 SPL 与旧版 DSL 场景对照

    本文讨论在不同的数据处理需求中,新版数据加工 SPL 与旧版数据加工 DSL 的使用对照。

    7,722
  • 2024-08-15
    2239

    MySQL实现并发控制的过程

    数据库系统到底是怎么进行并发访问控制的?本文以 MySQL 8.0.35 代码为例,尝试对 MySQL 中的并发访问控制进行整体介绍。

    2,239
  • 2024-08-22
    19632

    一线实战:运维人少,我们从 0 到 1 实践 DevOps 和云原生

    上海经证科技有限公司为有效推进软件项目管理和开发工作,选择了阿里云云效作为 DevOps 解决方案。通过云效,实现了从 0 开始,到现在近百个微服务、数百条流水线与应用交付的全面覆盖,有效支撑了敏捷开发流程。

  • 2024-09-03
    816

    面向OpenTelemetry的Golang应用无侵入插桩技术

    文章主要讲述了阿里云 ARMS 团队与程序语言与编译器团队合作研发的面向OpenTelemetry的Golang应用无侵入插桩技术解决方案,旨在解决Golang应用监控的挑战。

    816
  • 2024-09-04
    462

    WASM性能分析-插桩方案

    本文结合了代码插桩和性能火焰图的技术,以 WebAssembly 为例介绍了性能分析的方法和相关实现。

    462
  • 2024-09-14
    734

    阿里云函数计算 x NVIDIA 加速企业 AI 应用落地

    阿里云函数计算与 NVIDIA TensorRT/TensorRT-LLM 展开合作,通过结合阿里云的无缝计算体验和 NVIDIA 的高性能推理库,开发者能够以更低的成本、更高的效率完成复杂的 AI 任务,加速技术落地和应用创新。

    734
  • 1
    ...
    35
    36
    37
    ...
    92
    到第