Kubernetes 节点 DiskPressure 导致 Pod Pending 的排查与治理实践
## 适用场景 本文适用于 Kubernetes 集群中出现以下问题的场景: - 新发布的 Pod 长时间处于 `Pending` 状态; - `kubectl describe pod` 中看到 `node(s) had disk pressure`; - 节点状态出现 `DiskPressure=True`;
Tag
包含这个标签的文章。
## 适用场景 本文适用于 Kubernetes 集群中出现以下问题的场景: - 新发布的 Pod 长时间处于 `Pending` 状态; - `kubectl describe pod` 中看到 `node(s) had disk pressure`; - 节点状态出现 `DiskPressure=True`;
## 适用场景 这篇文章适用于 Pod 一直停留在 `Pending`、`ErrImagePull` 或 `ImagePullBackOff`,业务发布后没有新实例可用的场景。常见环境包括自建 Kubernetes、云厂商托管集群、私有镜像仓库 Harbor、阿里云/腾讯云镜像仓库,以及通过 CI/CD 自动更新镜像
## 适用场景 本文适用于 Kubernetes 中业务 Pod 间歇性进入 `CrashLoopBackOff`、`RestartCount` 持续增长、服务短时间不可用,但应用日志里又看不到明确业务异常的场景。常见于 Spring Boot、Django、Go HTTP 服务、Node.js 服务等 Web 应用
# Kubernetes 集群内 DNS 超时导致服务偶发访问失败的排查 ## 适用场景 本文适用于 Kubernetes 集群中应用访问 Service、数据库、Redis、外部域名时,偶发出现 DNS 解析超时、连接超时或请求延迟突然升高的场景。常见环境包括使用 CoreDNS、kube-proxy、conta
# 关于 ServiceAccounts 及其 Secrets 的重大变化 kubernetes v1.24.0 更新之后进行创建 ServiceAccount 不会自动生成 Secret 需要对其手动创建 ### 创建 ServiceAccount ```shell cat<<EOF | kubectl app
在ingress注释中添加以下配置一直没有生效的状态 ```yaml apiVersion: networking.k8s.io/v1 kind: Ingress metadata: annotations: nginx.ingress.kubernetes.io/proxy-connect-timeout
[TOC] ### 一、k8s containerd配置 #### 1、环境 三台机器 系统 centos7.9 ```shell hostnamectl set-hostname k8s-master hostnamectl set-hostname k8s-node1 hostnamectl set-h
当node宕机时,希望该node节点上的pod能够快速疏散到其他节点,并提供服务。测试发现,要等待5分钟,上面的pod才会疏散。 网上介绍通过修改 ```yaml # /etc/systemd/system/kube-controller-manager.service --node-monitor-grace-
#### 准备环境 Elasticsearch:http://10.0.0.1:9200", "http://10.0.0.2:9200", "http://10.0.0.3:9200 redis:10.0.0.1 6379 kibana: 10.0.0.1 5601 更改Ingress Nginx日志格式
#### 创建认证文件 通过htpasswd工具生成用户密码文件 ``` # htpasswd是apache httpd工具包中的工具 # 安装htpasswd ## centos yum install httpd-tools -y ## ubuntu sudo apt-get install apache2-u