DevOps与SRE面试深挖 15 题

涵盖容器编排、SLI/SLO 体系、故障自愈、容灾架构与全链路可观测性实战。

了解 AI 模拟面试
15 道真题·3 大分类·每题配面试官追问逻辑

题目为高频真实问法;①②③ 三层答案为模拟示范,非真实面经

15 题点击题目展开三层拆解

① 简历常见平淡回答

「用 kubectl logs 看报错日志,没有日志就 kubectl describe 看退出状态码,然后进容器看。」

停留在基础命令罗列,未讲清应用初始化探针配置、OOMKilled 内存溢出判定、依赖未就绪与系统信号处理的底层定位链条。

② 面试官追问逻辑

当容器由于僵尸进程未回收耗尽 PID 导致节点不可用时,如何在 Pod 级别配置 pause 容器或启用共享 PID 命名空间?Pod 频繁发生 OOMKilled 但 JVM 内部堆内存监控并未达到上限,排查堆外内存(Direct Memory/Metaspace)泄漏的手段有哪些?在 CI/CD 自动发布流程中,如何利用 PreStop Hook 与优雅停机参数 terminationGracePeriodSeconds 实现平滑切流?

③ 深挖后可量化的高分示范

排查 CrashLoop 首先执行 kubectl describe pod 检查 Last State:若退出码为 137 则明确是 OOMKilled,需核实 limit 限制或排查内存泄漏;若退出码为 1 或 2,则通过 kubectl logs --previous 查看上一次崩溃前的控制台输出。若日志为空,排查启动命令挂载、Secret/ConfigMap 挂载缺失或 InitContainer 执行阻塞;若应用启动后几秒退出,检查健康探针(Liveness/Readiness)端口与超时参数是否过严,避免探针误杀。

看完真题拆解,来一场全真模拟面试

免注册体验一轮 AI 模拟面试,体验真实深度追问,聊出你的真实高光与项目细节。

免费注册账号

无需信用卡 · 注册即送 600 积分