深度吐槽阿里云ack服务

本文涉及的产品
日志服务 SLS,月写入数据量 50GB 1个月
简介: 算是一个腾讯云深度用户,用了78年左右,由于业务需求,今年五月份开始逐步在阿里云跑了一些服务。不吹不黑。发自内心的吐槽一下阿里云的ack服务。其他服务没有多大发言权。都差不多。但是作为一个算是比较早期的kubernetes用户有必要吐槽一下阿里云的ack服务,没有办法。圈子里面没有阿里云容器组的人,像是腾讯云的tke的服务有问题可以直接找到相关人员反映,提交一下个人意见了。

背景:

算是一个腾讯云深度用户,用了78年左右,由于业务需求,今年五月份开始逐步在阿里云跑了一些服务。不吹不黑。发自内心的吐槽一下阿里云的ack服务。其他服务没有多大发言权。都差不多。但是作为一个算是比较早期的kubernetes用户有必要吐槽一下阿里云的ack服务,没有办法。圈子里面没有阿里云容器组的人,像是腾讯云的tke的服务有问题可以直接找到相关人员反映,提交一下个人意见了。

深度吐槽阿里云ack服务

1.从创建集群开始吧

1. 关于虚拟交换机

关于这个选择虚拟交换机我就很不能理解,比如我现在有四个交换机,ok,我选择了三个,是不是我另外一个交换机的服务器就不能加入集群?前提是我选择了专用网络了,理论上我的专用网络内任何一台服务器是不是都可以加入集群?为什么要给我加一个这个的限制呢?不知道我的理解有没有问题,也欢迎各位阿里云的大佬指正!

2.关于容器的网络

这个地方更是恶心....默认的pod 的cidr 172网段的,service cidr192.168.0.0/16段的?这只是我的截图阿,反正就是 两个网络的段不会是一个大的网段默认的......

pod 网络  service网络默认会是两个不一样的私网....可是我有点强迫症....我想pod service cidr在一个网络内可不可以?请看一下腾讯的我只设置了容器网络172.1716.0/20,然后我的容器pod网络自动设置为了172.17.16.0/20,service cidr设置为了172.17.28.0/22:

这样他不香吗?关键是这样,我后面如果多vpc,多地域集群作互联是不是会方便一些?

可能手动的可以设置。但是用户引导这方面设置为两个不同的私网是很恶心的,请考虑一下多集群互联,和网络资源的规划!

这只是集群创建过程中体验的不爽的...

2.当集群创建完成之后:

1.资源的扩容添加服务器到集群

这个问题我提交过工单,工单可见服务编号000D0585GS。过程是这样的。我要添加一台已有的服务器加入集群,然后竟然加不进去,查了一圈问题,客服告诉我,要先把这台服务器加入到ack节点的安全祖我才能操作....what这是什么鬼操作?我添加机器进入集群,安全祖不应该默认添加吗?还需要我手动先将机器加入安全祖我才能添加机器进入集群?这是什么神仙操作?很让我费解。工单中提交了个人意见希望能更改这个流程,不知道后续是否有什么修改

2.诡异的alb

事情是这样的:我应该三四月份创建的ack集群,然后当时看网络路由有ALB ingress,咱没有用过阿...体验一下吧!结果就是我没有创建成功......有点忧伤,作为一个用了kubernetes5-6年的用户我竟然没有搞成功,好吧一气之下删除了,换成了traefik作代理。诡异的时期 14天后的一个夜晚发生了.....自动创建了ALB服务。完全懵了......我不是删除了吗?为什么是14天的周期自动创建了?

我关心的是删除了服务 ,为什么没有删除干净?为什么14天后服务自动创建了?这都是什么神仙操作?

3.日志服务关于Job日志的采集

谁家还没有几个job服务呢对吧?然后接入了阿里云的日志采集服务。恩关键是日志完全没有采集到阿....怎么会事情?问 了一下我的job退出太快了....

关键是job就算退出了也是complete状态吧?默认的可以看到最新的三个任务的日志吧?起码kubectl logs -f?采集不到....好吧,修改代码打完了日志等待30秒再推出...这也太恶心了......我起码filebeat啥的采集也能采集到吧?怎么就不能呢?能不能别让我修改阿......

4.可恶的报警.......

先吐槽一下这个报警模板,大家的审美观看一下可还顺眼?

第一眼ack 好的我默认打开ACK

TMD报警模板里面的实例名称能不能给ack集群中节点名称一致我那里下手阿?哦对有公网IP我凑 ,这ack控制台显示公网Ip吗?点开详情ip这里才能发现是这一台

这里我希望报警模板实例能与ACK节点名称规范化一下。ack控制台节点相关信息显示也能够更完善一下。

然后接着吐槽,报警这里fs.inode.utilization_device设置的阈值是85%没有问题,看一下kubelet的垃圾回收:--eviction-hard=imagefs.available<15%,memory.available<300Mi,nodefs.available<10%,nodefs.inodesFree<5%

这是默认的吧压根就没有修改吧?那这个报警与垃圾回收有什么用呢?我就想知道?

好吧我自己去修改kubelet配置文件行不行?

eviction-hard=imagefs.available<15%,memory.available<300Mi,nodefs.available<20%,nodefs.inodesFree<15%

找了一圈我竟然无法确定改修改哪个文件

我这里修改可以吗?

重启服务后

ps -ef|grep kubelet


还是这样 我怂了 ,惹不起!

我改一下报警行了不?,惹不起我躲了!

看一下正常kubeadm集群的配置:


我修改了一下kubeadm-flags.env好歹是生效的阿?对不

惹不起我躲了....先修改监控报警策略了!而且从根本上来说,托管的服务。这些东西应该是优化好的尽量去减少用户的操作不是吗?你的 报警跟垃圾回收策略都不一致,搞毛线呢?问题是我个人修改参数他也不生效阿.....这让我怎么玩?毫无舒适感,不想动了!

希望阿里云ack的小伙伴能看到我的吐槽,没有办法阿吐槽无门阿....太高高在上了.....希望能听一下用户的心声!

相关实践学习
通过Ingress进行灰度发布
本场景您将运行一个简单的应用,部署一个新的应用用于新的发布,并通过Ingress能力实现灰度发布。
容器应用与集群管理
欢迎来到《容器应用与集群管理》课程,本课程是“云原生容器Clouder认证“系列中的第二阶段。课程将向您介绍与容器集群相关的概念和技术,这些概念和技术可以帮助您了解阿里云容器服务ACK/ACK Serverless的使用。同时,本课程也会向您介绍可以采取的工具、方法和可操作步骤,以帮助您了解如何基于容器服务ACK Serverless构建和管理企业级应用。 学习完本课程后,您将能够: 掌握容器集群、容器编排的基本概念 掌握Kubernetes的基础概念及核心思想 掌握阿里云容器服务ACK/ACK Serverless概念及使用方法 基于容器服务ACK Serverless搭建和管理企业级网站应用
相关文章
|
1天前
|
Prometheus Kubernetes 监控
OpenAI故障复盘 - 阿里云容器服务与可观测产品如何保障大规模K8s集群稳定性
聚焦近日OpenAI的大规模K8s集群故障,介绍阿里云容器服务与可观测团队在大规模K8s场景下我们的建设与沉淀。以及分享对类似故障问题的应对方案:包括在K8s和Prometheus的高可用架构设计方面、事前事后的稳定性保障体系方面。
|
15天前
|
人工智能 运维 监控
阿里云ACK容器服务生产级可观测体系建设实践
本文整理自2024云栖大会冯诗淳(花名:行疾)的演讲,介绍了阿里云容器服务团队在生产级可观测体系建设方面的实践。冯诗淳详细阐述了容器化架构带来的挑战及解决方案,强调了可观测性对于构建稳健运维体系的重要性。文中提到,阿里云作为亚洲唯一蝉联全球领导者的容器管理平台,其可观测能力在多项关键评测中表现优异,支持AI、容器网络、存储等多个场景的高级容器可观测能力。此外,还介绍了阿里云容器服务在多云管理、成本优化等方面的最新进展,以及即将推出的ACK AI助手2.0,旨在通过智能引擎和专家诊断经验,简化异常数据查找,缩短故障响应时间。
阿里云ACK容器服务生产级可观测体系建设实践
|
15天前
|
运维 Kubernetes 调度
阿里云容器服务 ACK One 分布式云容器企业落地实践
阿里云容器服务ACK提供强大的产品能力,支持弹性、调度、可观测、成本治理和安全合规。针对拥有IDC或三方资源的企业,ACK One分布式云容器平台能够有效解决资源管理、多云多集群管理及边缘计算等挑战,实现云上云下统一管理,提升业务效率与稳定性。
|
15天前
|
Kubernetes 算法 调度
阿里云 ACK FinOps成本优化最佳实践
本文源自2024云栖大会梁成昊演讲,讨论了成本优化策略的选择与实施。文章首先介绍了成本优化的基本思路,包括优化购买方式、调整资源配置等基础策略,以及使用弹性、资源混部等高级策略。接着,文章详细探讨了集群优化和应用优化的具体方法,如使用抢占式实例降低成本、通过资源画像识别并优化资源配置,以及利用智能应用弹性策略提高资源利用效率。
|
15天前
|
弹性计算 调度 数据中心
阿里云 ACK One 注册集群云上弹性:扩展业务新利器
随着企业数字化转型深入,传统IDC数据中心因物理容量限制,难以实现动态扩容,缺乏弹性能力。阿里云ACK One注册集群凭借其高度灵活性和丰富资源选择,成为解决此问题的最佳方案。通过与阿里云资源的整合,ACK One不仅实现了计算资源的按需扩展,提高了资源利用率,还通过按需付费模式降低了成本,使企业能够更高效地应对业务增长和高峰需求。
|
15天前
|
运维 Kubernetes Serverless
阿里云Argo X K8s玩转工作流引擎,实现大规模并行计算
本文基于2024云栖大会田双坤的演讲,介绍了Kubernetes作为云原生操作系统的角色及其在各类任务中的应用,重点探讨了Argo Workflows在Kubernetes上编排并行任务的能力。面对自建Argo Workflows的挑战,如稳定性、成本和安全性等问题,阿里巴巴云推出了全托管的Serverless Argo工作流,提供全托管、免运维、可观测和易集成的特点,显著提升了任务编排的效率和稳定性。适用于数据处理、科学计算、自动驾驶仿真等多个领域。
|
15天前
|
Kubernetes 容灾 调度
阿里云 ACK 高可用稳定性最佳实践
本文整理自2024云栖大会刘佳旭的演讲,主题为《ACK高可用稳定性最佳实践》。文章探讨了云原生高可用架构的重要性,通过Kubernetes的高可用案例分析,介绍了ACK在单集群高可用架构设计、产品能力和最佳实践方面的方法,包括控制面和数据面的高可用策略、工作负载高可用配置、企业版容器镜像服务高可用配置等内容,旨在帮助企业构建更加可靠和高效的应用运行环境。
|
15天前
|
存储 Kubernetes 关系型数据库
阿里云ACK备份中心,K8s集群业务应用数据的一站式灾备方案
本文源自2024云栖大会苏雅诗的演讲,探讨了K8s集群业务为何需要灾备及其重要性。文中强调了集群与业务高可用配置对稳定性的重要性,并指出人为误操作等风险,建议实施周期性和特定情况下的灾备措施。针对容器化业务,提出了灾备的新特性与需求,包括工作负载为核心、云资源信息的备份,以及有状态应用的数据保护。介绍了ACK推出的备份中心解决方案,支持命名空间、标签、资源类型等维度的备份,并具备存储卷数据保护功能,能够满足GitOps流程企业的特定需求。此外,还详细描述了备份中心的使用流程、控制台展示、灾备难点及解决方案等内容,展示了备份中心如何有效应对K8s集群资源和存储卷数据的灾备挑战。
|
1月前
|
存储 Kubernetes 网络协议
k8s的无头服务
Headless Service 是一种特殊的 Kubernetes 服务,其 `spec:clusterIP` 设置为 `None`,不会分配 ClusterIP,通过 DNS 解析提供服务发现。与普通服务不同,Headless Service 不提供负载均衡功能,每个 Pod 都有唯一的 DNS 记录,直接映射到其 IP 地址,适用于有状态应用的场景,如与 StatefulSet 一起部署数据库。示例中通过创建 Nginx 的 StatefulSet 和 Headless Service,展示了如何直接访问单个 Pod 并进行内容修改。
53 3
|
1月前
|
存储 Kubernetes Devops
Kubernetes集群管理和服务部署实战
Kubernetes集群管理和服务部署实战
56 0

热门文章

最新文章