官宣:Ray 正式加入 PyTorch 基金会

简介: https://www.anyscale.com/blog/ray-by-anyscale-joins-pytorch-foundation 译文

2025年10月22日,Ray 正式加入隶属于 Linux 基金会的 PyTorch 基金会。Linux 基金会是众多基础架构项目的摇篮,其中包括 Kubernetes、PyTorch 以及 vLLM。

过去一年间,Ray 的日下载量增长了近10倍。

image.gif

Ray日下载

如今,Ray 支撑着全球数十亿美元的年度计算消耗,并为各类人工智能工作负载提供动力。2025年的Ray Summit将邀请到以下众多企业分享他们的应用案例:

- 人工智能初创企业:xAI、Thinking Machines、Perplexity

- 成熟科技公司:Netflix、ByteDance、Apple、Tencent、Alibaba

- 大型企业:JPMorgan、BMW、Bridgewater、Workday

早期发展

我们在加州大学伯克利分校启动了 Ray 项目。当时作为从事人工智能研究的研究生,我们需要将算法扩展到 CPU 和 GPU 集群上运行,却发现自己大部分时间都在搭建基础设施,以解决分布式系统在扩展过程中面临的难题(如可靠性、成本、性能问题)。

从项目伊始,我们就致力于开发实用的开源软件。实验室前辈们开发 Apache Spark的经历,也给了我们极大的启发。

2019年,我们成立了 Anyscale 公司,旨在对 Ray 进行开发并推动其商业化。但在当时,仅有早期先行者存在大规模使用需求。蚂蚁集团(Ant Group)是 Ray 首个重要的生产环境用户,Uber 和 Pinterest 随后也加入了这一行列。然而事实上,那时绝大多数企业尚未有对人工智能计算进行扩展的需求。

随着生成式人工智能(generative AI)、大型语言模型(LLMs)以及如今推理模型(reasoning models)的出现,一切都发生了改变。到2025年的今天,对计算扩展的需求已十分明确,而且当前人工智能工作负载扩展所面临的软件工程挑战,远比我们启动 Ray 项目时更为艰巨。

回归初心

从某种程度而言,我们的发展仿佛画了一个圈。最初,我们将 Ray 定位为通用框架(其核心是一个 actor 框架),但我们首个探索的应用场景却是强化学习。在 Ray 的原始论文中,我们就以强化学习为例,展示了 Ray 的优势。当时我们之所以聚焦强化学习,是因为团队成员本身就在从事该领域研究(如 TRPO 、RLlib),而且人工智能领域的很大一部分研究者都在专注于让人工智能玩 Atari 游戏,以及在 Mujoco 等物理模拟器中实现运动控制学习。不过,那一轮围绕强化学习的热潮相对孤立,并未转化为广泛的实际应用。

如今,借助在构建推理模型和塑造智能体行为方面的成功,强化学习迎来了强势回归。目前,几乎所有用于大型语言模型训练后优化的开源强化学习框架,都是基于Ray 构建的。

PyTorch 基金会

在基础设施软件领域,开源模式始终占据优势。随着人工智能计算软件栈的逐步形成,该软件栈的每一层都将拥有一套开源标准。其中,PyTorch 是主流的深度学习框架,Kubernetes 是主流的容器编排工具,而我们正致力于将 Ray 打造为开源的分布式计算引擎。

过去一年,Ray 的采用率呈爆发式增长。如今 Ray 选择加入 PyTorch 基金会,核心原因在于我们正在构建一个全球性的贡献者社区。当前,对计算扩展的需求仍在不断增长,我们计划加大投入,围绕 Ray 打造开源社区,以满足人工智能领域快速演变的需求。

加入 Ray 社区

    这只是一个开始。

    - 2025年11月3日至5日,来旧金山参加 Ray 峰会,与社区成员面对面交流

    - 报名参加全新的“Ray 入门”课程

    - 前往 GitHub 为 Ray 项目贡献代码

    - 加入 Ray Slack 社区

    未来,我们将携手共进,继续打造开放化、社区驱动的人工智能基础设施未来。

    相关文章
    |
    10月前
    |
    自然语言处理 算法 数据可视化
    DeepInsight x ChatBI:“智能歧义识别+知识沉淀”,化解模糊查询
    本文针对自然语言数据分析中的语义歧义问题,提出“智能澄清-知识沉淀-动态召回”闭环方案,通过精准识别、最少提问、结构化留存用户意图,实现一次澄清、长期复用,显著提升查询效率与体验一致性。
    【鸿蒙软件开发】进度条Progress
    【鸿蒙软件开发】进度条Progress
    746 0
    |
    存储 编解码 弹性计算
    视频点播技术概述|学习笔记
    快速学习视频点播技术概述
    视频点播技术概述|学习笔记
    |
    8月前
    |
    人工智能 运维 监控
    2026年OpenClaw/Clawdbot必装10大Skills指南:从部署到技能精通
    在AI Agent技术飞速迭代的2026年,OpenClaw(原Clawdbot)凭借轻量化部署、高自由度扩展的特性,成为个人与企业构建自动化工作流的核心工具。而真正决定OpenClaw能力上限的,并非基础模型本身,而是其开放的Skills(技能系统)——这一插件生态如同给AI助手装上“多功能工具包”,可扩展实时搜索、浏览器自动化、网页部署、性能检测等关键能力,让普通问答助手升级为能执行真实任务的智能工作系统。
    7214 15
    |
    存储 SQL 人工智能
    Deepinsight x ChatBI:个人Agent助手养成计划
    ✨一文详解Deepinsight x ChatBI个人Agent助手养成计划
    |
    3月前
    |
    分布式计算 运维 自然语言处理
    EMR Serverless Spark PB级文本语义去重4倍加速的技术方案解读
    针对大模型语料清洗中文本去重面临的性能瓶颈,某企业迁移至阿里云emr serverless spark后实现突破。新方案通过minhash-lsh内置函数将算法下沉引擎层,减少40%代码量;结合fusion engine向量化加速与shuffle优化,消除python udf跨进程开销并解决数据倾斜问题。实测去重性能提升4倍,任务耗时从天级降至小时级,且实现零shuffle失败与免运维。该实践验证了serverless架构在pb级数据预处理中的高效性与稳定性,显著加速模型迭代并降低计算成本。
    370 0
    |
    运维 NoSQL 调度
    GPU集群扩展:Ray Serve与Celery的技术选型与应用场景分析
    Ray Serve与Celery对比:Ray Serve适用于低延迟、高并发的GPU推理服务,支持资源感知调度;Celery适合CPU密集型的离线批处理,具备成熟的任务队列机制。两者设计理念不同,适用场景各异,可根据任务类型灵活选型。
    527 6
    GPU集群扩展:Ray Serve与Celery的技术选型与应用场景分析
    |
    12月前
    |
    人工智能 分布式计算 PyTorch
    Ray Forward 2025 定档 12 月 20 日北京!议题征集通道已开放
    由蚂蚁集团发起的 Ray 中文社区与蚂蚁开源联合主办的 Ray Forward 2025,将于 12 月 20 日在北京蚂蚁 T 空间正式启幕,以 “拥抱 AI,Ray 向未来” 为主题,邀您共探下一代智能计算架构的进化方向。
    |
    11月前
    |
    人工智能 运维 算法
    2025 中国头部工业软件厂商 TOP10,AI + 工业软件融合加速,全栈赋能智能制造​
    2025年全球工业软件迈向AI全栈融合与平台化发展,市场规模超8560亿美元,中国增速领跑。AI赋能、轻量化部署成核心趋势,本土厂商崛起。盘古信息凭借IMS OS底座与行业深度适配登顶榜首,助力企业高效转型。
    2415 1