|
运维 Linux Anolis
|

经验分享!Linux 内核宕机介绍和简单分析思路 | 龙蜥大讲堂 77 期

直播主题:Linux 内核宕机介绍和简单分析思路直播时间:2023 年 05 月 16 日(周二)16:00-17:00直播内容:首先简要介绍宕机发生的场景、原因,基于现有的阿里云运维经验和 SysOM 宕机中心,讲解可以排查的思路和经验。听众受益:了解 Linux 内核宕机的原因、发生情况和简单的分析思路和应对方式。适合人群:研发工程师、运维工程师。讲师介绍:刘馨蔚,龙蜥社区系统运维 SIG Contributor ,硕士毕业于北京大学信息工程学院计算机应用技术专业。研究领域为未来基础网络架构、传输控制算法等。目前负责内核宕机检测和自动分析工作,是 SysOM 宕机中心和内存诊断核心开发者。

6178 42
|
JavaScript Java C#
|

如何查看Linux系统平均负载?

如何查看Linux系统平均负载?

714 0
|
JavaScript Java PHP
|

不装虚拟机,如何在线学习Linux命令?

不装虚拟机,如何在线学习Linux命令?

525 0

Linux指令入门-文件与权限

视频介绍Linux系统中常用的文件目录管理和文件权限管理命令。

860 47

Nydus容器镜像加速技术及实践

2020年11月5日,OpenAnolis社区(Anolis is not just Linux System)联合Open Infrastructure基金会举办了首场线下meetup,围绕「Cloud Native Infrastructures」主题,各路大牛相聚北京阿里中心。本次活动共计8大议题。来自阿里云、蚂蚁集团、Intel、中国移动、红帽等公司的技术专家围绕内核、容器及虚拟化等云原生基础设施技术展开探讨,解析相关开源技术内幕及社区进展,分享企业落地及实践经验。讲师及内容阿里云技术专家关尔昱与蚂蚁金服高级技术专家高级技术专家彭涛联合做《Nydus容器镜像加速技术及实践》技术分享。彭涛介绍,nydus容器镜像服务,是一个在CNCF dragonfly项目中孵化的子项目。相比目前的OCI镜像标准,nydus具有按需加载镜像数据、安全增强等特性。nydus能够大大增加容器和应用启动的速度。它的安全相关的特性是提供安全的金融服务和企业级云服务的关键。根据关尔昱的分享,nydus在阿里云上的实践可以将镜像拉取的时间缩短为原来的十分之一。

756 0

Inclavare Containers 机密容器技术

2020年11月5日,OpenAnolis社区(Anolis is not just Linux System)联合Open Infrastructure基金会举办了首场线下meetup,围绕「Cloud Native Infrastructures」主题,各路大牛相聚北京阿里中心。本次活动共计8大议题。来自阿里云、蚂蚁集团、Intel、中国移动、红帽等公司的技术专家围绕内核、容器及虚拟化等云原生基础设施技术展开探讨,解析相关开源技术内幕及社区进展,分享企业落地及实践经验。讲师及内容介绍阿里云操作系统系统安全团队主管张佳分享技术《 Inclavare Containers机密容器技术》。Inclavare Containers是云原生领域的机密计算容器运行时和服务,旨在把机密计算做为一种容器化的通用计算资源基础设施,在为云用户隐私保护和敏感数据保护的同时,还能提供与普通容器一致的使用体验。Inclavare Containers技术栈中的rune组件已经成为OCI Runtime参考实现之一,并支持docker和containerd。使用者可以基于Inclavare Containers技术栈轻松搭建K8s机密计算集群。

849 0
|
4月前
|
Linux Anolis
|

基于龙蜥操作系统的AI服务器GPU RAS增强技术|龙蜥大讲堂

在AI算力快速发展的今天,GPU已经成为AI服务器的核心引擎,但随之而来的稳定性、可观测性和故障定位问题,也对底层基础设施提出了更高要求。本视频将以“GPU黑匣子”技术应用为例,介绍如何基于龙蜥操作系统增强AI服务器的GPU RAS能力,提升GPU在运行过程中的可靠性、可用性与可维护性。通过对GPU关键状态、异常信息和运行日志的持续记录与分析,帮助运维人员在故障发生前提前感知风险,在故障发生后快速定位问题,从而有效降低AI训练与推理任务中断带来的影响,构建更加稳定、高效的AI算力底座。

172 0
|
7月前
|
Linux Anolis
|

智算新范式:基于 Anolis OS 构建 Confidential AI Agent — OpenClaw-CC 隐私保护实践|龙蜥大讲堂144期

近日,英特尔中国高级工程师朱运阁与龙蜥社区云原生机密计算 SIG Contributor 赖堃共同带来了《智算新范式:构建 Confidential AI Agent》的主题分享。他们基于Intel® TDX(可信域扩展)技术与龙蜥社区开源生态,深度解析了 OpenClaw-CC 项目的架构设计与落地实践,展示了一套从硬件根信任到应用层隔离的全栈机密计算解决方案,为您系统化拆解如何构建“可用不可见”的机密智能体。

330 0

大模型安全攻防技术解析|龙蜥大讲堂135期

理解大模型在数据、模型、应用层的核心安全威胁,以及如何通过技术手段来增强模型的安全性。

318 0

龙蜥社区技术委员会副主席苏志远:浪潮信息与龙蜥实现共赢

浪潮信息系统软件产品部总经理、龙蜥社区技术委员会副主席苏志远讲述了浪潮信息如何在一年时间从理事单位晋升为副理事长单位,分享双方在AI、安全层面的最新合作成果。

467 0

圆桌会议:聚焦AI时代机遇下操作系统产业的进化与重构 | 2024龙蜥大会主论坛

中国工程院院士陈纯,中国开源软件推进联盟副主席刘澎,阿里巴巴集团合伙人、阿里云基础设施事业部总经理蒋江伟,中兴通讯中心研究院副院长刘东等五位嘉宾,现场进行了主题为“聚焦AI时代机遇下操作系统产业的进化与重构”的产业圆桌讨论,结合龙蜥社区和龙蜥操作系统(Anolis OS)的近期动态,深入探讨了开源操作系统的发展历史与挑战,AI 与操作系统的融合创新和协同发展等话题。

502 45

Intel Linux 内核测试套件-LKVS介绍 | 龙蜥大讲堂104期

分享Intel内核测试组开发并维护的LKVS(Linux内核测试套件),介绍套件的发展、特性、用法以及当前在最新Intel服务器CPU上的热门属性,及其使用和验证方法。

526 0

OGAI:大模型智算软件栈

OGAI:大模型智算软件栈。

651 0

操作系统分层分类的实现与应用 | 2023龙蜥操作系统大会

统信UOS服务器版汲取国内外主流社区技术栈优势,并率先提出了「分层分类」的开源技术路线,分层分类理论可以将分散、无序的操作组件维护工作拆解,极大地提升了操作系统的研发效率。目前,分层分类研究成果已广泛应用于多产品、多领域,可以更好地协调产业/团队分工、明确研发方向、维护关键软件、共建共享共治开源新生态。

641 0

国产服务器操作系统发展报告(2023年)|2023龙蜥操作系统大会

国产服务器操作系统发展报告(2023年)解读。

562 0

surftrace在内核网络问题中的典型应用|龙蜥大讲堂23期

surftrace在内核网络问题中的典型应用。

702 0

如何测试硬件设备与龙蜥操作系统的兼容性?|龙蜥大讲堂12期

硬件生态是一个操作系统的重要基石。但是硬件种类众多,各种各样的服务器和板卡外设,这些硬件设备与龙蜥操作系统(Anolis OS)各个发行版的兼容性如何?如何评估?龙蜥操作系统的潜在用户如何查询自己的硬件设备与龙蜥操作系统的兼容性?这次就和大家聊一聊龙蜥社区硬件兼容性 SIG 的主要工作,包括龙蜥社区硬件兼容性列表、硬件兼容性申请流程以及硬件兼容性测试套件 ancert 用法等。

743 0
|
网络协议 Linux 网络虚拟化
|

2022开源开放周分享 - SMC-R + eRDMA:一种新的云上高性能网络协议栈

SMC-R + eRDMA:一种新的云上高性能网络协议栈

436 0
|
弹性计算 Linux Anolis
|

龙蜥大讲堂第69期 - 阿里云 ECS 八代 SPR 实例上使用 Intel AMX 特性加速 AI 类业务的实践

69期-阿里云 ECS 八代 SPR 实例上使用 Intel AMX 特性加速 AI 类业务的实践

1266 0

基于 ContainerOS 应用的实践经验

统信软件研发主管、龙蜥容器优化 OS SIG Maintainer 王磊分享《基于ContainerOS应用的实践经验》主题演讲。ContainerOS 会加速云原生建设,提供更轻、更稳定、更便捷的云底座 OS。系统只保留了系统运行的软件包和容器运行依赖的软件包,使系统更轻更薄;系统关键目录采用只读权限,不再提供 yum 等软件包管理方式,所有应用都以容器镜像方式运行,使系统更稳定安全;在一个云原生的集群里以一个整体系统镜像为原子进行更新和升级,确保集群内每个节点的软件包版本都是一致固化的,使系统升级更简单。更多内容可以关注龙蜥云原生 LifseaOS 和统信云原生操作系统。

554 0

使用人工智能驱动开源翻译组

使用人工智能驱动开源翻译组 讲师/嘉宾简介: 白宦成:Linux中国开源社区

3106 57

内存缺陷检测技术以及在中兴内部的工程应用实践

龙蜥社区开发者服务(devFree)MeetUp 内存缺陷检测技术以及在中兴内部的工程应用实践 讲师/嘉宾简介: 程圣宇:中兴通讯操作系统工具平台经理

548 54

libvirt 虚拟机热迁移流程简介

直播主题:libvirt 虚拟机热迁移流程简介 直播时间:2023 年 05 月 31 日(周三)16:00-17:00 直播内容: libvirt 是用于管理虚拟机的开源项目,是各大基于 OpenStack 二次开发的云平台管理底层 qemu-kvm 虚拟机的核心组件,而热迁移作为虚拟机管理中较为常用的功能,其在稳定性和效率关乎云平台的整体使用体验,本次分享主要讲解虚拟机热迁移在 libvirt 项目中的主要流程及迁移参数作用和影响。 听众受益: 了解 libvirt 虚拟机热迁移整体流程,迁移方式及关键迁移参数作用及影响。 适合人群: 云计算研发人员。 讲师介绍: 李东世,浪潮数据云计算高级研发工程师,负责浪潮数据云平台核心功能开发及维护,主导底层虚拟化相关功能开发、问题定位处理。

719 0
|
架构师 Linux 程序员
|

2分钟快速学懂Linux目录结构

2分钟快速学懂Linux目录结构

638 0
|
JavaScript Java C#
|

安装系统太麻烦?试试这几个Linux模拟器

安装系统太麻烦?试试这几个Linux模拟器

614 1
|
JavaScript Java PHP
|

Linux命令太多记不住怎么办?

Linux命令太多记不住怎么办?

18982 1

在AIibaba CIoud Linux上编辑iptabIes

视频介绍如何在 Alibaba Cloud Linux 上配置 iptables防火墙。

636 0

Cloud Hypervisor or Cloud Native Hypervisor

2020年11月5日,OpenAnolis社区(Anolis is not just Linux System)联合Open Infrastructure基金会举办了首场线下meetup,围绕「Cloud Native Infrastructures」主题,各路大牛相聚北京阿里中心。本次活动共计8大议题。来自阿里云、蚂蚁集团、Intel、中国移动、红帽等公司的技术专家围绕内核、容器及虚拟化等云原生基础设施技术展开探讨,解析相关开源技术内幕及社区进展,分享企业落地及实践经验。讲师及内容介绍Intel 系统软件部云原生基础设施软件研发经理朱江云介绍Cloud Hypervisor诞生的缘起,从其架构和特性的介绍,我们可以看到Cloud Hypervisor是一款为云原生打造的虚拟机管理器。Clou Hypervisor技术委员会成员刘奖分享了云原生基础设施对于Kata Containers和Cloud Hypervisor在理论和实践上的根本诉求,给了大家进一步的思考和启发。

863 0

开源操作系统社区和生态

观看其他分论坛内容阿里云开发者大会主论坛大数据与AI一体化开发平台视觉AI开发平台及其行业应用云原生数据库:一站式数据服务前沿人工智能技术与算法实践从1到∞ :极致原生安全云原生技术与最佳实践钉应用开发:人人都是工程师基础设施的云上管控应用开发的云基础设施优化开源操作系统社区和生态泛云生态人才培养合作智能开发与高效运维RISC-V技术趋势与芯片应用实践AIoT云端一体加速设备智能

1932 56

「主机智能巡检」实操演示:24 小时在线的“AI医生”,为服务器提供智能化自动体检与深度诊断

主机智能巡检,正是“业务韧性”最锋利的那把刀——从事后救火,转向事前防护。

170 0
|
3月前
|
Linux Anolis
|

XSCC 源于开源,注入开源

XSCC 是由香山编译器团队开发的一个编译器项目,构建在开源的 LLVM 编译器基础设施之上。通过利用和扩展现有的 LLVM 技术栈,XSCC 致力于基于香山处理器打造 RISC-V 生态的高性能编译器。北京开源芯片研究院编译器团队工程师王陆霖分享了《XSCC 源于开源,注入开源》。王陆霖介绍了 XSCC 项目,并分享了团队参与开源编译器社区的实践经验。接着,与现场嘉宾们一起讨论了在 LLVM 基础上开展编译器技术研发、为香山生态开发相关基础设施与工具,以及将研发过程中产生的改进和技术成果贡献回上游开源项目的经验。

162 0

从社区到生产——基于 SGLang HiCache + Mooncake 的深度优化与企业级落地

陈凯悦带来《从社区到生产:基于 SGLang HiCache + Mooncake 的深度优化与企业级落地工程实践》主题分享。视频完整还原了 HiCache 与 Mooncake 在内部推理集群的规模化部署过程,并深入解析其在企业客户环境中的落地实践,为 SGLang 从开源社区走向生产环境提供了宝贵的工程经验与优化思路。

282 0
|
4月前
|
Linux Anolis
|

从割裂到协同——超智融合算力中心的系统化搭建思路与落地路径

分享系统化搭建超智融合算力架构的思路,实现整套集群从芯片、存储、网络到操作系统、算力调度、系统运维的深度融合,以支撑复杂科学计算、工程仿真和AI大模型训练/推理的超智融合应用场景。

130 0
|
4月前
|
Linux Anolis
|

MuxWise:面向高Goodput LLM服务的GPU内Prefill-Decode复用技术

LLM推理中prefill(计算密集)与decode(访存密集)资源特性迥异。现有PD分离方案割裂KV cache池、难以适应流量波动;Chunked-prefill则在SLO达标率与GPU利用率间顾此失彼。MuxWise提出GPU内PD空分复用新范式:动态划分SM,让prefill与decode在同一GPU上并行执行、共享KV cache。系统包含三项核心技术:无气泡空分复用引擎、竞争感知延迟预测器、decode优先SLO感知调度。在主流GPU和任务上实现最高3倍goodput提升,代码已合并入SGLang主分支。

170 0
|
4月前
|
Linux Anolis
|

面向multi-agent场景的长上下文管理方法|龙蜥MeetUp

本次分享围绕“面向 multi-agent 场景的长上下文管理方法”展开,结合研究背景、现有系统痛点、方案设计与实验结果,系统介绍多智能体协作中长上下文管理的关键挑战与应对思路。内容涵盖长上下文在 multi-agent 场景中的应用需求、当前方法的局限性、本文提出的管理策略及其创新点,并展示系统实现与实验验证结果,帮助观众全面了解该方向的核心问题与解决方案。

81 0

2分钟带你了解 ANOLISA——Agent 系统管家

ANOLISA 是转为AI Agent打造的操作系统,致力于打造更高效、更安全的 Agent Native 环境。

146 0

如何系统化搭建超智融合算力架构|龙蜥大讲堂第139期

联科集团加入龙蜥社区多年,一直与龙蜥保持深度合作,其超智融合算力管理平台 CHESS 与 Anolis OS 的完成了兼容适配认证。联科集团联席合伙人付鸿雁结合联科集团 25 年深耕高性能计算的经验,系统化解析超智融合算力中心的搭建路径,实现整套集群从芯片、存储、网络到操作系统、算力调度、系统运维完成超算和智算真正的融合。

335 0

Confidential AI:基于机密计算的 AI 推理安全与隐私保护方案|龙蜥MeetUp

针对AI在医疗、金融等敏感领域应用带来的数据隐私与模型安全推理问题,介绍了基于机密计算技术的Confidential AI解决方案。解析了如何在机密计算环境中实现端到端安全推理,涵盖加密模型部署、端到端通信安全、系统数据落盘加密保护等关键技术,旨在为行业提供可复用的安全推理框架。

333 0

Co-Sight:基于多 Agent 动态规划与分层反思的下一代 AI 决策系统|龙蜥MeetUp

探讨了AI技术应用于复杂任务时,传统大语言模型(LLM)在动作决策和多步推理上的局限性。构建具备自主规划与动态纠偏能力的智能体系统成为关键挑战。中兴通讯介绍了其Co-Sight框架,该框架通过多Agent协同架构(Plan-Actor-Memory)实现任务降维,结合实时上下文精炼消除冗余,并依托分层反思系统生成奖惩信号以动态优化DAG执行路径。其核心创新在于关注点分离与闭环反思机制。在GAIA评测中,Co-Sight以72.73%综合得分超越Google DeepMind与OpenAI,在复杂多步任务(L2级)中稳定性显著领先。

587 0

Mooncake 大模型开源生态体系建设与产业应用实践|龙蜥MeetUp

介绍了大模型推理架构Mooncake。该架构通过创新的KVCache中心设计,显著提升了Kimi智能助手的推理吞吐和成本效率,已引起业界广泛关注。近期,清华大学与阿里云等多家企业宣布共建Mooncake项目,旨在构建高性能推理框架的开源生态。阿里云与清华大学共同探索了大模型资源池化技术的工业应用,推动推理实例共享与缓存池化层标准化,实现高效分布式资源解耦,提升大模型长上下文推理性能。目前Mooncake已在vLLM/SGLang等多个推理框架集成,并在多家企业落地。

400 0

基于 LLM Agent 的智能诊断机器人|龙蜥MeetUp

陈诗雁介绍了系统运维的现状和难点、智能对话机器人的发展、大模型在系统运维的应用、基于大模型智能体的诊断机器人设计,并演示了 SysOM 智能诊断机器人。智能机器人和运维平台是相辅相成的关系,运维平台的诊断能力成就了智能机器人解决实际问题的能力,智能机器人帮助运维平台更好地发挥和展示运维能力。

597 0

某国有银行大规模带外监控管理技术实践分享|龙蜥MeetUp

随着数据中心设备量的不断增大,传统基于带外通道的监控方式面临诸多挑战。为此,他介绍了一种创新的系统架构,即多采集器、多分析器及微服务分布式架构。该架构以资源为作业单位,根据不同类型的作业实施差异化的数据采集与监控周期,从而显著提升了采集效率,降低了系统负载,并有效减少了数据延时。这一创新方案为数据中心的运维管理提供了更加全面、细致的数据支持,充分展现了浪潮电子信息产业股份有限公司在大规模带外监控技术领域的创新实力与丰富经验,也为行业提供了新的发展思路和实践路径。

288 0

SysOM 健康度和 Livetrace 的评测方法探索|龙蜥MeetUp

Livetrace 作为一种先进的操作系统级性能分析方法,能够通过不断地监测操作系统、容器运行环境以及应用程序等多个层次的性能指标,深入揭示整体性能瓶颈。借助 Livetrace,软件的性能管理更加稳健,性能表现的可预测性得到显著提升。

370 0

中兴通讯操作系统产品部副部长蒋学鑫致辞|龙蜥MeetUp

作为本次大会的承办单位,中兴通讯持续为联盟的运作提供了资金、服务和技术的支持,在操作系统运维领域积极参与共建,为联盟成员做好服务,助力联盟健康发展。同时,中兴通讯也是龙蜥社区副理事长单位,秉承开发合作,共创共赢的理念积极参与社区建设,力争打造国内社区生态底座,促进社区繁荣发展。

335 0

龙蜥社区系统运维联盟主席冯富秋致辞|龙蜥MeetUp

龙蜥社区系统运维联盟主席冯富秋表示龙蜥社区系统运维联盟作为运维技术创新的前沿阵地,承载着双重使命:第一通过强化联盟与各成员单位间的协同合作,打造出运维能力跃升新引擎;第二,致力于制定并推广运维产业标准,为用户提供一盏明灯,让他们清晰洞悉市场运维水准的现状与未来趋势。同时,他也详细介绍了联盟当前的工作进展,强调通过联盟,牵引国内系统运维健康、有序、领先的发展。

340 0

浪潮信息副总经理赵帅:向更高层次的操作系统智能化迈进|龙蜥+超级探访

浪潮信息副总经理赵帅聊了聊“服务器操作系统目前的发展现状”以及“根社区”的重要性如何体现等热点话题。

510 0

操作系统迁移技术

CentOS 停止更新,企业和用户面临着系统安全和稳定性的双重挑战。而国内对于自主可控操作系统的需求日益增加,在此背景下,操作系统迁移已成为势在必行的选择。KOS 团队立足于国产化需求,提出了浪潮的操作系统迁移方案,并经过多个行业的实战落地,形成一套成熟方案,迁移技术自主可控,助力企业在数字化转型中稳步前行。

406 0

龙蜥社区漏洞管理治理策略与实践

开源软件漏洞治理是构建龙蜥操作系统安全基石的重要一环。本次分享聚焦龙蜥社区的安全漏洞管理体系及其治理策略,包括漏洞情报感知收集、威胁分析与风险评估、漏洞修复及公告披露等流程。同时简单介绍社区在漏洞治理协作上的初步实践,探讨社区漏洞治理未来的优化方向。

352 0

龙蜥操作系统

龙蜥社区(OpenAnolis)是面向国际的 Linux 服务器操作系统开源根社区及创新平台,秉承“平等、开放、协作、创新”的原则,理事会由阿里云、统信软件、龙芯、Arm 、Intel 等 24 家国内外头部企业共同组成,有超过 1000 家来自芯片厂商、软件厂商、整机厂商、操作系统厂商等覆盖操作系统全产业链的合作伙伴参与生态共建。

0
今日
4428
内容
9
活动
9736
关注
你好!
登录掌握更多精彩内容

活跃用户