Dragonwell JDK 在 RISC-V 上的探索
介绍了阿里巴巴基于 Alibaba Dragonwell (一款免费的 OpenJDK 发行版,提供长期支持(LTS),涵盖性能增强、安全修复以及性能增强等特性),在 RISC-V 架构上的探索工作。从 2022 年开始,Alibaba Dragonwell 团队联合达摩院,参与 RISC-V 后端研发,为Dragonwell JDK 增加对 RISC-V 的支持,同时对上游 OpenJDK RISC-V 后端提供多个贡献,以及今后针对 Datacenter 的 RISC-V 芯片的展望。
龙蜥社区全面升级为“AI 原生操作系统社区”,打造下一代 Agentic 操作系统开源根社区
2026 开放原子开源生态大会上,在开放原子开源基金会理事长谢少锋和龙蜥社区理事们的见证下,龙蜥社区(OpenAnolis)正式官宣升级为 AI 原生操作系统社区,并发布了面向智能体系统的社区级技能生态平台 SkillHub 。
面向multi-agent场景的长上下文管理方法|龙蜥MeetUp
本次分享围绕“面向 multi-agent 场景的长上下文管理方法”展开,结合研究背景、现有系统痛点、方案设计与实验结果,系统介绍多智能体协作中长上下文管理的关键挑战与应对思路。内容涵盖长上下文在 multi-agent 场景中的应用需求、当前方法的局限性、本文提出的管理策略及其创新点,并展示系统实现与实验验证结果,帮助观众全面了解该方向的核心问题与解决方案。
基于龙蜥操作系统的AI服务器GPU RAS增强技术|龙蜥大讲堂
在AI算力快速发展的今天,GPU已经成为AI服务器的核心引擎,但随之而来的稳定性、可观测性和故障定位问题,也对底层基础设施提出了更高要求。本视频将以“GPU黑匣子”技术应用为例,介绍如何基于龙蜥操作系统增强AI服务器的GPU RAS能力,提升GPU在运行过程中的可靠性、可用性与可维护性。通过对GPU关键状态、异常信息和运行日志的持续记录与分析,帮助运维人员在故障发生前提前感知风险,在故障发生后快速定位问题,从而有效降低AI训练与推理任务中断带来的影响,构建更加稳定、高效的AI算力底座。
ROLL:面向大规模 AgenticRL 的异步解耦与异构算力调度实践
本次分享将介绍阿里巴巴自研强化学习框架ROLL及其针对AgenticRL异构负载的深度优化方案。重点解读如何通过异构硬件亲和性调度、细粒度异步编排以及状态感知的按需弹性部署,攻克大规模场景下的通信与计算瓶颈。目前,ROLL已在三千卡集群、千亿参数MoE模型上实现了生产级的极致吞吐;此外,我们将探讨ROLL与Mooncake存算分离架构结合的未来演进,进一步释放大规模RL后训练的潜力。
英特尔平台上的功耗性能优化
功耗与性能在许多情况下存在竞争关系,但二者并非总是互斥的。通过合理分配各组件间的功耗,可以有效提升整体性能表现。英特尔高级工程师张锐分享了《英特尔平台上的功耗性能优化》,与现场嘉宾深入探讨了近期基于最新英特尔平台在龙蜥社区中开展的功耗相关工作,并阐述了这些工作的必要性,以及如何运用这些技术来优化功耗管理并提升系统性能。
组装式 OS 可靠性增强组件实践|龙蜥MeetUp
越来越多的场景对可靠性有更高的要求,如基站、卫星、工业网关、智能汽车等,而当前 Linux 聚焦资源管理机制的实现,不重点关注资源使用策略导致的异常,其主要提供了硬件的可靠性处理,整体上没有体系化的管理手段。同时对于操作系统而言,可组装的定制功能将能在不同的场景下最大化功能价值。面对可靠性增强的需求和挑战,中兴通讯进行了组装式 OS 可靠性增强组件实践,充分覆盖系统各类亚健康事件,并进行对应策略处理,尽可能保障系统的可靠运行,同时提供必要的维测信息,方便后续故障定位。设计上采用可组装思路,利用 ftrace、kprobes 及 eBPF 技术进行功能解耦,可以很好地满足多场景下 OS 可靠性增强需求。
Perf Arm SPE介绍与使用
SPE是Armv8.2引入一种性能剖析机制,可以提供更加细节的CPU运行时采样信息。本次分享主要介绍如何在倚天710平台上利用Arm SPE特性定位伪共享问题、分析内存访问、分析指令延时以及监控访存延时等功能。
AArch64架构调用链性能数据采集原理
调用链 (Callchain) 是软硬件事件上下文信息之一,对性能优化和故障排具有非常重要的作用。如著名的火焰图 (Flamegraph) 就是对调用链信息汇总统计和可视化的结果。但是在调用链收集的过程中,工程师往往因为不了解底层的采集原理导致调用链收集不完整,采集开销不可控等问题。本议题核心介绍了在AArch64架构下调用链采集的原理,比较它们之间的不同和阐述适用场景。同时对Linux内核态和eBPF调用链采集做了一些简单介绍。
C++20 高性能基础库--兰亭集库助力开发者构建高性能应用
了解如何编译安装兰亭集库; 2.了解如何使用兰亭集库快速开发静态文件服务器; 3.了解如何使用兰亭集库快速开发websocket应用;
obdiag:一款OceanBase 数据库诊断的利器
了解OceanBase分布式数据库及其诊断现状,快速洞悉obdiag作为OceanBase敏捷诊断工具的项目价值及其设计与实现,提前知晓obdiag未来规划。
阿里云与龙蜥携手打造智算时代最佳服务器操作系统
阿里云基础软件部产品总监张鹏程从阿里云和龙蜥的角度,详细介绍了在共建服务器操作系统这条路线上走过的历程,以及未来的发展方向。随着 AI 时代推动云计算迎来第三次浪潮,借力"云+AI"趋势,阿里云携手龙蜥打造云上体验最佳的服务器操作系统 - Alibaba Cloud Linux/Anolis OS。经过 15 年的经验积累,阿里云明确了一个新兴方向和四大战略领域,形成 1+4 开源战略。开源是系统软件的源头活水,基于开源的丰饶土壤,阿里云把更多的先进技术传递到整个产业,也通过这样的生态拓展方式,让更多的行业从事者可以去拥抱这些技术和探索产业落地机会。而龙蜥得益于治理模式的成功和商业+开源的双轮驱动,已经成为国内活跃贡献机构最多、最多样化的社区,在云智融合浪潮下迈向高质量发展阶段。
专有云CentOS迁移替换实践分享|飞天技术沙龙-CentOS迁移替换专场
阿里云高级技术专家谢家森围绕用户上云/迁云、自动化迁移管理平台技术开发以及 OS 迁移产品化流程等方面展开详细介绍。他表示,得益于操作系统团队提供的技术优化能力,以及成熟的迁移技术工具,阿里云和龙蜥社区为用户提供成熟和稳定的迁移方案,帮助大家从 CentOS 7/8 迁移到 Alibaba Cloud Linux /Anolis OS。
云上体验最佳的服务器操作系统 - Alibaba Cloud Linux | 飞天技术沙龙-CentOS 迁移替换专场
从 Alinux 的产生背景、产品优势以及云上用户使用 Alinux 享受的技术红利等方面详细进行了介绍。同时,通过国内某社交平台、某快递企业、某手机客户大数据业务 3 大案例,成功助力客户实现弹性扩容能力提升、性能提升、降本增效。
阿里云副总裁李俊平致辞|2023龙蜥操作系统大会
互联网为开源提供了理想的土壤,让全球开发者们可以不受物理距离的限制,共同在一个透明开放的环境中工作。与此同时,开源项目在互联网发展中起到了积极的贡献。在这个时代背景下,阿里云极度重视开源项目,尤其重视操作系统方向的开源合作。2019 年开始,阿里云和业界伙伴一起着手构建面向云计算场景的原生操作系统的开源社区,2020 年龙蜥随之应运而生,社区的开放、平等、中立的价值理念,确保了公平公正的决策和核心项目的健康运行。无论是持续的技术创新,还是社区的治理理念,阿里云作为社区的参与方,都将实质地坚持和保持投入,共同推动整个社区的未来的持续壮大与发展。
统信软件“3+3+6”CentOS替换解决方案 | 2023龙蜥操作系统大会
CentOS系统停更,给各行业现有业务系统的稳定持续运行带来了巨大的不确定性。为应对CentOS的停更,保障各行业业务系统的持续运行,统信软件可为用户提供远程支持、现场支持、培训服务、顾问咨询、系统定制等一系列服务支持。不仅能够满足用户快速响应、及时处理和修复问题的要求,还可以按照用户的个性化需求提供订制服务,满足不同用户在各种复杂业务场景下的需求。
中兴通讯携手龙蜥社区,共创繁荣生态 | 2023龙蜥操作系统大会
本次大会上,中兴通讯|新支点等 3 家企业凭借对社区开源生态建设的卓越贡献,升级为龙蜥社区“新晋副理事长单位”,中兴通讯操作系统技术总工徐立锋与浪潮信息副总裁 DonnyZhang、Intel 技术总监杨继国上台接受授牌,共同开启“同心共行·共建龙蜥”的新里程道路。与此同时,为表彰中兴通讯在 2023 年在龙蜥社区中投入的显著成果,中兴通讯操作系统技术总工徐立锋获得「2023 年度龙蜥社区卓越贡献奖」,并在大会现场进行了颁奖。除此之外,中兴通讯也开设了分论坛和专区。
龙蜥社区高级顾问致辞|2023龙蜥操作系统大会
面向未来,我们要大力推广软件开源事业,让软件成为新时代发展的强大引擎。要深化社区或者共同体的建设,希望国家给予更多的政策引导,社会各界和更多的伙伴加入,高校和院所能更好地培养人才,同时共同推动包括 OpenAnolis 在内的软件开源生态繁荣,打造千行百业坚实的计算基底。
开放原子开源基金会孙文龙致辞|2023龙蜥操作系统大会
自 2020 年以来,龙蜥社区集聚产业力量,为开源操作系统发展,全球开源操作系统生态的繁荣做出了突出贡献,也欣喜地见证了龙蜥社区发展壮大的历程。
云智融合浪潮之下,打造中国操作系统黄金时代 | 2023龙蜥操作系统大会
在云智融合的跨时代浪潮下,阿里云坚持 1+4 开源战略,坚持核心技术的攻关,鼎力支持龙蜥操作系统社区发展,携手产业力量,共同打造中国操作系统的黄金时代。
基于龙蜥操作系统Arm架构下软件迁移和优化案例分享|龙蜥社区走进Arm MeetUp
介绍 Arm 架构下常用性能分析工具,结合龙蜥操作系统分享软件移植的注意事项和实际优化案例,从而帮助大家了解 Arm 架构下软件移植、优化过程中的常见问题和优化思路。
Arm 架构下性能优化经验分享 | 龙蜥社区走进 Arm MeetUp
从实用角度解读如何在 Arm 平台上进行业务软件的性能测评、分析及优化,涵盖负载配置模式的选择、波动因素的消除、宏观经验调优及多层配合(应用层、系统层及微架构层)的深度性能优化,充分挖掘底层基于 Arm 架构硬件的性能潜力。
云原生转型之路的多系统运维|龙蜥社区系统运维MeetUp
企业面向几百个转型中间态的系统,通过建设统一对象模型,对异源同域的数据进行解析丰富处理,实现多维数据自主关联。算法和机器学习为复杂的体系提供了动态问题感知和预测的能力。在问题发生后基于根因推荐、同源分析等措施快速故障定界并开始应急处置,保障业务的连续性是首要之责,数智化观测为排障和系统调优提供有效的决策能力。
龙蜥社区 & kindling社区联合发布:北极星指标体系构建|龙蜥社区系统运维MeetUp
分享了关于排障北极星指标理论的独到见解。尽管在传统的可观测性领域,涵盖了 tracing、metrics、logging等要素,但依然存在一些无法观测到的盲区。这些盲区的存在使得我们在故障排除过程中常常感到困惑。由于 Linux 内核的复杂性,即使是专家们也常常受限于某一特定领域,例如网络、存储、CPU 调度等。因此,故障排查的挑战在于,虽然问题表面看起来可能出现在某一领域,但根本原因可能却隐藏在另一个领域。这意味着解决故障通常需要集结来自多个领域的专家,而这也导致了 1-5-10 等迅速恢复业务的问题难以解决和实施。 为了解决这一问题,Kindling 社区与龙蜥社区合作,共同推出了排障北极星理论。
云原生技术在容器方面的应用|龙蜥大讲堂54期
CXL 作为下一代高带宽低延迟的互联协议,即将被广泛应用在数据中心之中。本次活动主要介绍了 CXL 的基础概念和规范,当前 Linux 内核和硬件厂商 Intel 对于 CXL 的支持,以及龙蜥社区对于 CXL 的规划。
SysOM 操作系统运维平台的介绍和使用方法|龙蜥大讲堂42期
通过本次讲解,可以了解到操作系统相关运维知识,包括监控,宕机分析,系统诊断,安全等相关专业知识,了解 SysOM 操作系统运维平台的部署方法,以及使用方法,能够通过部署 SysOM 平台,对自己的操作系统进行系统级别的运维和诊断。
核心技术分享: CRI-RM based CPU and NUMA Affinity | 龙蜥大讲堂28期
介绍一种新的 CPU 和 NUMA 绑定方法,并在 CRI 资源管理器 (CRI-RM) 中实现,主要将其用作 K8S 上加速工作负载的解决方案。
CSI 与 open-local 核心技术分享 | 龙蜥大讲堂30期
介绍 kubernetes CSI 技术原理,并以 open-local 为代表介绍本地存储上解决方案,以及高性能存储 dpdk 在 open-local 中的应用。
plugsched : Linux 内核调度器子系统热升级|龙蜥大讲堂18期
plugsched 是 Linux 内核调度器子系统热升级的 SDK,它可以实现在不重启系统、应用的情况下动态替换调度器子系统,毫秒级 downtime 。plugsched 可以对生产环境中的内核调度特性动态的进行增、删、改,以满足不同场景或应用的需求,且支持回滚。
解读集群镜像“开箱即用”神器——sealer!| 龙蜥大讲堂第 11 期
集群镜像把整个集群看成一台服务器,把 k8s 看成云操作系统,实现整个集群的镜像化打包和交付,为企业级软件提供一种“开箱即用”的应用封装技术。以行业 ISV为例,集群镜像帮助企业解决了分布式软件的部署一致性难题、降低了交付出错率,最终指数级降低分布式软件的交付成本。受 docker 等容器技术的启发,集群镜像将单机应用封装技术,上升到分布式集群维度,最终实现分布式软件的高效交付(build、share、run)。
千万级可观测采集器—iLogtail功能介绍与入门
作为阿里内部可观测数据采集的基础设施,iLogtail 承载了阿里巴巴集团、蚂蚁的日志、监控、Trace、事件等多种可观测数据的采集工作。iLogtail 运行在服务器、容器、K8s、嵌入式等多种环境,支持采集数百种可观测数据,目前已经有千万级的安装量,每天采集数十 PB 的可观测数据,广泛应用于线上监控、问题分析/定位、运营分析、安全分析等多种场景。
数据安全-云原生机密计算介绍
随着数据要素价值的不断提高,保护处于使用状态中的敏感数据比以往任何时候都更为重要。Gartner 已将隐私计算标记为 2021 年的关键企业技术趋势,并用于处理和分析高度敏感的数据;到 2025 年,50% 的大型组织将采用隐私计算技术,应用于在不可信环境中处理数据以及多方数据分析的场景中。 机密计算是隐私计算的关键核心技术之一,可以实现数据的可用不可见,解决“数据孤岛”,释放数据价值,进而实现数据的全生命周期安全。本场演讲麻付强和张佳乐介绍了机密计算的基本概念、浪潮信息的机密计算应用,以及龙蜥社区的云原生机密计算SIG 最佳实践。
龙蜥系统运维 SIG 和 eBPF 技术探索 SIG介绍
eBPF & Linux 稳定性专场是由龙蜥系统运维 SIG 和 eBPF 技术探索 SIG 协办,开场主持人毛文安为大家介绍了这两个 SIG 的情况。为大家分享这两大 SIG 的愿景和目标,以及当前 SIG 的重点项目情况和 SIG 的下一步规划。也欢迎大家在龙蜥官网 SIG 组查看详情。
龙蜥基础设施SIG 专场:全场景质量协同平台 T-One | 龙蜥大讲堂84期
龙蜥基础设施SIG 专场:全场景质量协同平台 T-One | 龙蜥大讲堂84期 讲师/嘉宾简介: 支智昇:龙蜥T-One SIG Maintainer 工业和信息化部电子第五研究所自动化工具负责人
英特尔第四代至强可扩展处理器 DLB 加速器的云上探索
直播主题:DLB 加速器云上探索 直播时间:2023 年 06 月 28 日(周三)15:00-16:00 直播内容: DLB(Dynamic Load Balancer)是英特尔第四代至强可扩展处理器(Sapphire Rapids)上众多加速器中的一个,具备了完全虚拟化(包括 SRIOV 和 SIOV)能力,提供了无锁的硬件队列,可以实现无锁的经典生产者消费者模型。 听众受益: 了解 DLB 加速器的原理及部署实践。 适合人群: 芯片、云计算、加速器相关研发人员。 讲师介绍: 易兴睿,Intel Arch SIG contributor,负责阿里云 SPR 平台加速器使能。
龙蜥操作系统
龙蜥社区(OpenAnolis)是面向国际的 Linux 服务器操作系统开源根社区及创新平台,秉承“平等、开放、协作、创新”的原则,理事会由阿里云、统信软件、龙芯、Arm 、Intel 等 24 家国内外头部企业共同组成,有超过 1000 家来自芯片厂商、软件厂商、整机厂商、操作系统厂商等覆盖操作系统全产业链的合作伙伴参与生态共建。