k9s 快速上手指南5 步完成 Kubernetes Pod 排障顺手做一次集群体检【免费下载链接】k9s Kubernetes CLI To Manage Your Clusters In Style!项目地址: https://gitcode.com/GitHub_Trending/k9s/k9s凌晨一个 Pod 突然 CrashLoopBackOff你在终端里一条条拼 kubectl 命令。k9s就是为解决这种场景而做的一个跑在终端里的 Kubernetes 管理台它持续监听集群变化资源清单在你眼前自动刷新看到异常直接按键操作全程不用离开终端。没有它的时候排障是这样过的先kubectl get pods找到异常 Pod记下名字再kubectl logs xxx翻崩溃栈觉得不对劲切到kubectl describe pod xxx看探针和 Events怀疑 OOM 还得kubectl exec -it xxx -- /bin/sh进容器验证。集群大一点每条命令都得记得补-n 命名空间看的是 A 集群还得先切 context。每条命令都是一次性快照你真正需要的是一张持续更新的清单这个靠敲命令拼不出来。k9s 直接复用你机器上已有的~/.kube/config不用额外登录装完就能看集群。kubectl、Web 控制台和 k9s各自适合谁做法工作方式适合谁kubectl 命令行一条命令一个动作状态靠自己记写脚本、CI 自动化、一次性操作Web 控制台GUI 仪表盘要登录浏览器偶尔看看状态、不在终端机上的人k9s常驻终端进程清单实时更新按键直接操作资源天天在终端里排障和巡检的人结论很直接如果你每天靠 kubectl 或跳板机管集群受够了拼命令和切上下文就该把 k9s 放手上。三分钟安装一条 brew 命令跑起 k9smacOS 和 Linux 都用 Homebrew最短路径一条命令brew install derailed/k9s/k9s export KUBE_EDITORvim第一行装 k9s第二行指定在 k9s 里按e编辑资源时用的编辑器不设置的话找不到编辑器会报错。运行k9s启动页之后直接落在Pod 列表视图当前命名空间的 Pod 按 READY、STATUS、RESTARTS、CPU、MEM 排成列异常的 Pod 标红RESTARTS 在涨会自己跳出来全程不用敲任何命令。按?能列出所有按键按ctrl-a能看到全部可切换的资源别名。主线走一遍Pod 反复重启的完整排障链路场景某个 Pod 处于 CrashLoopBackOffRESTARTS 持续增长。整条链路 5 步走一条线讲完看到异常。目标确认是哪个 Pod。动作在 Pod 视图里标红且 RESTARTS 持续增长的那一行就是。做完后看到异常行孤零零排在列表前部不用肉眼扫全表。过滤定位。目标把列表收敛到这一行。动作按/输入应用名片段列表实时过滤支持fred|blee这类正则。做完后看到只剩匹配的几行上下文再乱也不影响你。日志取证。目标找到崩溃原因。动作选中该行按l打开日志视图b上翻、f下翻定位崩溃栈想看上一次崩溃按p。做完后看到日志里的报错指向某个启动命令失败。描述核对。目标排除探针配置问题。动作按d打开 describe 页重点看探针配置段和 Events 段。做完后看到要么有探针失败记录要么确认是应用本身崩了。处置恢复。目标干净重建。动作按ctrl-d删除这个 PodTAB 回车确认后自动重建如果确认是镜像或配置问题切到:dp视图选中对应 Deployment 按r整组重启。做完后看到新 Pod 拉起STATUS 转为 Running。全程没有离开终端也没有拼任何一条 kubectl 命令。掌握基础后的三个省时功能健康仪表盘只看一列数字命令模式下输入:health进入健康仪表盘。每种资源占一行格式是总数 : 健康 : 异常第三位是 0 就不用管。日常巡检一步完成扫一眼面板只去追非 0 的行。比如 Pod 行异常数大于 0就跳回 Pod 视图看那几个是谁。内置 Popeye一键集群合规扫描输入:popeye或缩写pop触发一次集群扫描结果按资源类型分组每行给出扫描数与 OK / INFO / WARNING / ERROR 计数。常见扣分项是缺少 NetworkPolicy、容器没配资源限制、镜像没锁版本。把它当基线用评分保持在 80 以上算受控低于 50 就该优先安排整改。团队化hotkeys 与 plugins配置文件统一放在~/.config/k9smacOS 为~/Library/Application Support/k9s拿不准路径就跑k9s info它会列出 config、日志、皮肤等每个文件的实际位置。hotkeys.yaml把按键绑到资源视图plugins.yaml把外部命令绑到视图上plugins: pod-logs: shortCut: Ctrl-L description: 跟踪 Pod 日志 scopes: [pods] command: kubectl args: [logs, -f, $NAME, -n, $NAMESPACE]$NAME、$NAMESPACE会自动替换为当前选中资源的值仓库 skins/ 里有一批 Dracula、Nord、Monokai 等现成主题plugins/ 目录里全是可以直接改造的插件示例。避坑现象出现时先检查什么颜色不渲染、图标乱码先查终端是否支持 256 色图标持续乱码就在配置里把ui.noIcons: true打开别怀疑工具坏了。改了配置不生效先跑k9s info看 k9s 实际加载的目录配置写错地方是最常见原因也可以用K9S_CONFIG_DIR显式指定。大集群刷新卡顿、API server 压力大把配置里的refreshRate调大单位秒默认 2最低也只能到 2。删除、编辑操作点了没反应查readOnly是不是被设成true这是防手滑的设计巡检场景建议保持打开。今天就能做装好 k9s进入 Pod 视图用/过滤一次列表挑一个 Pod 走完整条l日志 →d描述 →ctrl-d重建的路径输入:health看一眼记下非 0 的那几行是谁【免费下载链接】k9s Kubernetes CLI To Manage Your Clusters In Style!项目地址: https://gitcode.com/GitHub_Trending/k9s/k9s创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考