AIX定时删除归档日志时系统HANG住

本文涉及的产品
日志服务 SLS,月写入数据量 50GB 1个月
简介: 【环境说明】 Oracle Dataguard在的运用已经算是比较成熟了,个人也用了挺多的场景和各种平台了。之前在windows2003平台上面的搭建oracle 11.2数据库的datagaurad遇到了bug。
【环境说明】
Oracle Dataguard在的运用已经算是比较成熟了,个人也用了挺多的场景和各种平台了。之前在windows2003平台上面的搭建oracle 11.2数据库的datagaurad遇到了bug。
今天在AIX 6.1平台基于Oracle 11.2的数据库又遇到了BUG。具体场景如下:
  • 数据库的dataguard已经搭建完毕,且同步正常;
  • 在从库配置自动删除已运用归档日志的时候,整体服务器处于hang的状态,操作系统不能做任何操作,需要重启才能解决。

【执行的操作】

点击(此处)折叠或打开

  1. pecdg@oraecp> cat /home/orapec/rmarchlog.sh
  2. #!/bin/sh
  3. export PATH
  4. ORACLE_SID=PEC
  5. TABLE='v$archived_log'
  6. export ORACLE_BASE ORACLE_SID
  7. export ORACLE_HOME=/oracle/pec/112_64
  8. export PATH=$PATH:$ORACLE_HOME/bin:$ORACLE_HOME/OPatch
  9. $ORACLE_HOME/bin/sqlplus -silent "/ as sysdba" <<EOF > /home/oraecp/deleteorclarch.sh
  10. set heading off;
  11. set pagesize 0;
  12. set term off;
  13. set feedback off;
  14. set linesize 32767;
  15. select 'rm -rf '||name from ${TABLE} where DELETED='NO' and APPLIED='YES';
  16. exit;
  17. EOF
  18. sh /home/oraecp/deleteorclarch.sh
  19. rman target /<<END
  20. crosscheck archivelog all;
  21. delete noprompt expired archivelog all;
  22. exit;
  23. END

【详细的alert log】
1
Errors in file /oracle/PEC/pectrace/diag/rdbms/pecdg/PEC/trace/PEC_psp0_8061016.trc:
2
ORA-27300: OS system dependent operation:fork failed with status: 12
3
ORA-27301: OS failure message: Not enough space
4
ORA-27302: failure occurred at: skgpspawn3

【Meatlink的相关信息】
数据库版本及服务器
1
Applies to: 
2
Oracle Database - Enterprise Edition - Version 11.2.0.3 and later
3
IBM AIX on POWER Systems (64-bit)
4
***Checked for relevance on 03-July-2017***

【原因】
1
In this case, this is an IBM bug:
2
3
IV37048 CIFS_FS LEAVES BEHIND DEFUNCT KERNEL PROCESSES.

【解决方法】
1
Apply IBM patch: IV37048 CIFS_FS LEAVES BEHIND DEFUNCT KERNEL PROCESSES
2
3
The IBM patch will prevent zombies (defunct processes) and prevents symptoms.
该问题属于IBM的文件系统的一个BUG,更新patch后就可以了。后面交给公司的sa同事,让他处理再测试就没有问题了;
相关实践学习
【涂鸦即艺术】基于云应用开发平台CAP部署AI实时生图绘板
【涂鸦即艺术】基于云应用开发平台CAP部署AI实时生图绘板
相关文章
|
24天前
|
Prometheus 监控 Cloud Native
基于docker搭建监控系统&日志收集
Prometheus 是一款由 SoundCloud 开发的开源监控报警系统及时序数据库(TSDB),支持多维数据模型和灵活查询语言,适用于大规模集群监控。它通过 HTTP 拉取数据,支持服务发现、多种图表展示(如 Grafana),并可结合 Loki 实现日志聚合。本文介绍其架构、部署及与 Docker 集成的监控方案。
234 122
基于docker搭建监控系统&日志收集
WGLOG日志管理系统是怎么收集日志的
WGLOG通过部署Agent客户端采集日志,Agent持续收集指定日志文件并上报Server,Server负责展示与分析。Agent与Server需保持相同版本。官网下载地址:www.wgstart.com
|
4月前
|
监控 API 开发工具
HarmonyOS Next的HiLog日志系统完全指南:从入门到精通
本文深入解析HarmonyOS Next的HiLog日志系统,涵盖日志级别、核心API、隐私保护与高级回调功能,助你从入门到精通掌握这一重要开发工具。
212 1
|
14天前
|
Ubuntu
在Ubuntu系统上设置syslog日志轮替与大小限制
请注意,在修改任何系统级别配置之前,请务必备份相应得原始档案并理解每项变更可能带来得影响。
63 2
|
3月前
|
存储
WGLOG日志管理系统可以采集网络设备的日志吗
WGLOG日志审计系统提供开放接口,支持外部获取日志内容后发送至该接口,实现日志的存储与分析。详情请访问:https://www.wgstart.com/wglog/docs9.html
|
8月前
|
存储 前端开发 数据可视化
Grafana Loki,轻量级日志系统
本文介绍了基于Grafana、Loki和Alloy构建的轻量级日志系统。Loki是一个由Grafana Labs开发的日志聚合系统,具备高可用性和多租户支持,专注于日志而非指标,通过标签索引而非内容索引实现高效存储。Alloy则是用于收集和转发日志至Loki的强大工具。文章详细描述了系统的架构、组件及其工作流程,并提供了快速搭建指南,包括准备步骤、部署命令及验证方法。此外,还展示了如何使用Grafana查看日志,以及一些基本的LogQL查询示例。最后,作者探讨了Loki架构的独特之处,提出了“巨型单体模块化”的概念,即一个应用既可单体部署也可分布式部署,整体协同实现全部功能。
2557 70
Grafana Loki,轻量级日志系统
|
7月前
|
存储 消息中间件 缓存
MiniMax GenAI 可观测性分析 :基于阿里云 SelectDB 构建 PB 级别日志系统
基于阿里云SelectDB,MiniMax构建了覆盖国内及海外业务的日志可观测中台,总体数据规模超过数PB,日均新增日志写入量达数百TB。系统在P95分位查询场景下的响应时间小于3秒,峰值时刻实现了超过10GB/s的读写吞吐。通过存算分离、高压缩比算法和单副本热缓存等技术手段,MiniMax在优化性能的同时显著降低了建设成本,计算资源用量降低40%,热数据存储用量降低50%,为未来业务的高速发展和技术演进奠定了坚实基础。
273 1
MiniMax GenAI 可观测性分析 :基于阿里云 SelectDB 构建 PB 级别日志系统
|
7月前
|
存储 JSON Go
PHP 日志系统的最佳搭档:一个 Go 写的远程日志收集服务
为了不再 SSH 上去翻日志,我写了个 Go 小脚本,用来接收远程日志。PHP 负责记录日志,Go 负责存储和展示,按天存储、支持 API 访问、可远程管理,终于能第一时间知道项目炸了。
114 10
|
7月前
|
安全 测试技术
【YashanDB知识库】设置归档日志上限,但归档日志没自动清理,导致磁盘空间满
客户在一主一备性能压测中设置了归档日志清理上下限(12G-16G),但实际产生了100G+归档日志,导致磁盘空间满。原因是未设置ARCH_CLEAN_IGNORE_MODE=BACKUP,系统默认在备份后才清理日志。解决方法是设置ARCH_CLEAN_IGNORE_MODE=BACKUP,并执行`alter database delete archivelog all`触发清理。修改参数后,日志仍可能短暂超过上限,因备机同步延迟。经验总结:需同时设置归档上下限和ARCH_CLEAN_IGNORE_MODE=BACKUP以确保日志及时清理。
|
6月前
|
存储 数据库
YashanDB归档日志文件管理
本文介绍了YashanDB中归档日志文件的管理,包括默认存储路径($YASDB_DATA/archive)和文件命名规则。单机部署格式为arch_{resetlogs_id}_{sequence}.ARC,共享集群新增instanceId字段,格式为arch{instanceId}_{resetlogs_id}_{sequence}.ARC。1号节点与单机格式一致。可通过V$ARCHIVED_LOG视图查询相关信息,文件的增删由归档管理操作控制,详情参见官方文档。