官方博客-第27页-阿里云开发者社区

  • 2024-05-15
    2882

    阿里云大降价后,再谈“降本增效”

    2024年2月29日,阿里云宣布史上最大力度降价,引发行业对用云成本的热议。

  • 125874

    PolarDB闪电助攻,《香肠派对》百亿好友关系实现毫秒级查询

    PolarDB分布式版助力《香肠派对》实现百亿好友关系20万QPS的毫秒级查询。

  • 2024-05-15
    1133

    vLLM部署Yuan2.0:高吞吐、更便捷

    vLLM是UC Berkeley开源的大语言模型高速推理框架,其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等,一方面可以提升Yuan2.0模型推理部署时的内存使用效率,另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

    1,133
  • 分析性能提升40%,阿里云Hologres流量场景最佳实践

    分析性能提升40%,阿里云Hologres流量场景最佳实践

  • 2024-09-06
    292

    MacTalk 测评通义灵码,实现“微信表情”小功能

    墨问西东创始人池建强分享了团队使用通义灵码的经验。

  • 2024-09-10
    464

    浅析MySQL Join Reorder算法

    本文浅析了MySQL Join Reorder算法的流程,cost计算,剪枝算法等,希望通过本文能帮助大家了解MySQL优化器生成执行计划的具体流程。

    464
  • 2024-09-11
    313

    内核网络小白之故障寻踪记

    本文记述了一次由 skb(socket buffer)异常导致的内核故障排查过程。

    313
  • 2024-11-21
    977

    “无”中生有:基于知识增强的RAG优化实践

    本文作者基于自身在RAG技术领域长达半年的实践经验,分享了从初识RAG的潜力到面对实际应用挑战的心路历程,以及如何通过一系列优化措施逐步解决这些挑战的过程。

  • 1
    ...
    26
    27
    28
    ...
    52
    到第