Prometheus

首页 标签 Prometheus
# Prometheus #
关注
2553内容
|
11天前
| |
来自: 云原生
周五 21:47,checkout 又慢了:云监控 MCP 想接住的那二十分钟
阿里云云监控 MCP Cloud 正式发布,提供近 200 项工具,Agentic 能力再进一步:让 Agent 直接查询与管控用云可观测,守护应用稳定运行。
开源可观测栈选型报告:Prometheus + Grafana + Tempo 能不能替掉商业 APM
本文对比开源三件套(Prometheus+Grafana+Tempo)与商业APM,从能力覆盖、运维成本、告警降噪、Trace-指标关联、上手门槛五维剖析:开源栈可满足中小规模(数十服务)、有专职可观测工程师的团队“看”的需求,但难以替代商业APM在自动根因、7×24兜底、多团队协同等场景下的“省人”价值。
k6 压测结果别只发终端截图:摘要、HTML、Grafana 三层怎么落地
本文详解k6压测报告三层架构:终端摘要(秒级判定)、HTML报告(归档可读)、Grafana看板(时序对比)。解决截图失真、时间维度丢失、跨版本难比等痛点,提供可落地的配置方案与避坑清单,让压测结果真正可追溯、可对比、可决策。(239字)
|
22天前
| |
来自: 云原生
AI Agent 时代,需要的不是更多数据,而是一个语义层
AI Agent 缺的不是数据而是系统地图。UnifiedModel 开源语义层将资产、数据与关系组织为可查询对象图,实验显示旗舰模型准确率提升 10-20%。它助 Agent 按对象读数、沿关系定位根因,真正看懂复杂系统。
|
27天前
| |
来自: 弹性计算
Prometheus 监控越跑越胖?别急着加硬盘,TSDB 压缩才是关键
Prometheus 监控越跑越胖?别急着加硬盘,TSDB 压缩才是关键
|
2月前
| |
来自: 数据库
Redis 监控面板搭建:Tair 企业版全链路可观测方案
本文详细拆解如何用 Tair 控制台 + 云监控在 30 分钟内搭建一套生产级 Redis 监控面板。
|
2月前
| |
来自: 数据库
《电商API调用链路追踪:九家平台耗时/成功率/成本的可观测性方案》(附Python源码)
本方案为九家电商API打造统一可观测性体系:融合RED(耗时/错误率/QPS)、USE(配额/余额/超量)、FinOps(调用/云资源/敞口)三层指标,覆盖平台/店铺/API三维度,输出实时看板、日报与多通道告警;基于OpenTelemetry+自研Exporter归一化“API方言”,实测故障定位从45分钟缩至3分钟,成本异常由月底延迟转为实时感知。(239字)
|
2月前
| |
来自: 云原生
从“自己造轮子”到“OpenAPI 嵌进来”:精臣全栈上云后的智能运维底座之选
精臣业务全球化发展导致系统复杂度激增,面临业务系统拓扑复杂、问题根因定位链路较长等挑战。借助阿里云 STAROps 构建全域智能运维体系,实时生成业务系统全域拓扑图,实现自建 SRE 平台闭环诊断,推动运维向 AI 智能化转型。
|
2月前
|
[058][调度模块]任务生命周期事件与监听器机制
本文介绍调度模块的任务生命周期事件机制,通过`ChangeStatusEvent`事件与`ChangeStatusEventConsumer`监听器,实现任务状态(CREATED/STARTED/COMPLETED等)变更的灵活监听。支持日志、持久化、消息推送等扩展,具备高解耦性与异常隔离能力。(239字)
|
3月前
| |
来自: 数据库
第三方 API 接口后的架构反思:适配器模式 + 重试 + 熔断的通用封装
本文总结了对接50+第三方API的实战经验,提出「适配器+管道+策略」架构:通过统一请求/响应模型、SPI接口契约、鉴权/重试/熔断管道及可观测性埋点,实现高复用、易扩展、强容错。完整代码开箱即用。(239字)
免费试用