官方博客-第38页-阿里云开发者社区

  • 2024-05-15
    1125

    vLLM部署Yuan2.0:高吞吐、更便捷

    vLLM是UC Berkeley开源的大语言模型高速推理框架,其内存管理核心——PagedAttention、内置的加速算法如Continues Batching等,一方面可以提升Yuan2.0模型推理部署时的内存使用效率,另一方面可以大幅提升在实时应用场景下Yuan2.0的吞吐量。

    1,125
  • 实时数仓Hologres OLAP场景核心能力介绍

    Hologres提供统一、实时、弹性、易用的一站式实时数仓引擎,解决复杂OLAP难题。

  • 2024-07-05
    372

    泛娱乐出海Plus时代,音视频能力基座与时俱进

    泛娱乐的音视频技术随着出海在演进,交互和内容的技术是内核,也在融合。

  • 2024-07-09
    1462

    阿里云百炼应用实践系列-基于LlamaIndex的文档问答助手

    本文以阿里云百炼官方文档问答助手为例,介绍如何基于阿里云百炼平台打造基于LlamaIndex的RAG文档问答产品。我们基于阿里云百炼平台的底座能力,以官方帮助文档为指定知识库,搭建了问答服务,支持钉钉、Web访问。介绍了相关技术方案和主要代码,供开发者参考。

  • 2024-07-22
    16439

    超越流水线,企业研发规范落地新思路

    一文详解研发规范的目标、常见误区、选型方法与常见最佳实践。

    16,439
  • 2024-08-06
    8547

    【AI 冰封挑战】搭档函数计算,“冰”封你的夏日记忆

    夏日炎炎,别让高温打败你的创意,立即体验 ComfyUI 自制冰冻滤镜!无需繁琐的后期技巧,三步开启一段清凉无比的视觉探险。参与实验并上传作品即可获得运动无线蓝牙耳机,限量 800 个,先到先得!

  • 2024-08-20
    19099

    AI 网关零代码解决 AI 幻觉问题

    本文主要介绍了 AI Agent 的背景,概念,探讨了 AI Agent 网关插件的使用方法,效果以及实现原理。

    19,099
  • 2024-09-02
    1632

    基于阿里云函数计算(FC)x 云原生 API 网关构建生产级别 LLM Chat 应用方案最佳实践

    本文带大家了解一下如何使用阿里云Serverless计算产品函数计算构建生产级别的LLM Chat应用。该最佳实践会指导大家基于开源WebChat组件LobeChat和阿里云函数计算(FC)构建企业生产级别LLM Chat应用。实现同一个WebChat中既可以支持自定义的Agent,也支持基于Ollama部署的开源模型场景。

    1,632
  • 2024-09-05
    956

    RAG效果优化:高质量文档解析详解

    本文关于如何将非结构化数据(如PDF和Word文档)转换为结构化数据,以便于RAG(Retrieval-Augmented Generation)系统使用。

  • 1
    ...
    37
    38
    39
    ...
    89
    到第