systemd 服务启动失败 status=203/EXEC 的排查与修复
适用场景 本文适用于 Linux 服务器上使用 systemd 管理自研服务、脚本任务、Java 服务、Python 服务或二进制程序时,执行 systemctl start 后服务立即失败,并在日志中看到 status=203/EXEC 的场景。 这类问题通常不是业务代码运行时报错,而是 systemd 在执行 Ex
Tag
包含这个标签的文章。
适用场景 本文适用于 Linux 服务器上使用 systemd 管理自研服务、脚本任务、Java 服务、Python 服务或二进制程序时,执行 systemctl start 后服务立即失败,并在日志中看到 status=203/EXEC 的场景。 这类问题通常不是业务代码运行时报错,而是 systemd 在执行 Ex
适用场景 这类问题常见于日志文件、临时文件或应用输出文件被手动 rm 删除后,df -h 仍然显示磁盘空间没有释放。典型环境包括: 业务服务持续写入日志,日志文件被误删或被不规范清理脚本删除。 Nginx、Java、Python、Go 服务长期运行,进程仍持有旧文件句柄。 Docker 容器内日志或挂载目录文件被删除,
适用场景 这篇文章适用于线上 Redis 作为缓存、会话、计数器或排行榜组件时,出现接口响应时间突然升高、Redis CPU 飙升、慢查询增多、网络出口流量变大等问题的排查。 典型环境包括: 单机 Redis 或 Redis Sentinel 架构; Redis Cluster 分片集群; 业务使用 Python、Ja
适用场景 在 Codex 里配置了一个定时任务,希望它每天自动生成内容,并调用线上接口完成发布。但任务执行时发现:手动运行脚本可以访问线上接口,定时任务运行时却被沙箱拦截,表现为无法访问目标域名或提示网络权限不足。 这个问题很容易误判成“没有互联网权限”,但实际根因往往不是互联网不可用,而是定时任务使用的命令没有命中已
适用场景 本文适用于线上业务访问 MySQL 时突然出现连接失败、接口大量报错、应用日志出现 Too many connections、连接池获取连接超时,或者监控中 MySQL Threads_connected 快速逼近 max_connections 的场景。 这类问题通常不是简单把 max_connection
Kubernetes 集群内 DNS 超时导致服务偶发访问失败的排查 适用场景 本文适用于 Kubernetes 集群中应用访问 Service、数据库、Redis、外部域名时,偶发出现 DNS 解析超时、连接超时或请求延迟突然升高的场景。常见环境包括使用 CoreDNS、kube-proxy、containerd 或
适用场景 线上服务通过 Nginx 反向代理访问,业务侧反馈接口偶发失败、页面加载慢,Nginx 访问日志里出现大量 502、504 或 499 状态码。 这类问题很常见,但三个状态码代表的方向并不一样: 502 Bad Gateway:Nginx 作为网关访问上游失败,通常是上游服务异常、连接失败、协议异常。 504