面试 Q&A 文档索引#
共 10 份文档、210+ 道问题,覆盖本项目全部高频面试考点。 每道题含完整回答 + 代码引用 + 真实数据(如有),可直接用于面试准备。
文档列表#
| # | 文档 | 题数 | 核心考点 |
|---|---|---|---|
| 0 | 压测方法与数据 | 35 | 压测工具选型、5 种流量模型、数据解读、限流精度、并发槽参数 |
| 1 | 告警风暴治理 | 26 | 5 层递进消化、归一分组、任务去重、优先级队列、burst 数据 |
| 2 | RAG 检索管线 | 23 | 混合检索 (Vector+BM25+RRF)、Rerank、Parent-Child 分块、pgvector |
| 3 | 多智能体编排 | 28 | LangGraph 状态机、Skill 路由、Plan-Exec-Replan、Deep 模式、并行工具、checkpointer+interrupt() 审批重构 |
| 4 | 全链路容错设计 | 20 | Fail-open、DLQ、Worker 崩溃恢复、健康检查、降级汇总、可观测 |
| 5 | 限流与并发控制 | 26 | 固定窗口/滑动窗口/令牌桶对比、Lua 原子性、分布式并发槽、Pause/Resume |
| 6 | Benchmark 构建方法论 | 36 | 5 个简历点的对照实验设计、真实发现的代码 gap、免费事后归因分析、成本控制、数字诚实性 |
| 7 | 事务化处置与闭环 | 16 | 资源建模、五段式事务、CAS 漂移检测、多步 Saga 补偿、资源锁+幂等、分级回归门禁、escalate-then-deny、对齐开源三块、verify_metric 端到端、飞书长连接手机一键审批、100% 红队拦截 |
| 8 | 手写 Harness 设计 | 8 | 为什么不用 create_agent、并行编排、强制收尾轮、预算/工具熔断、上下文压缩、token 台账、参数级权限 |
| 9 | 真机端到端集成调试 | 10 | 单测盲区 vs 集成契约、5 个真机 bug 复盘(部署编排/jsonb 序列化/MCP 返回格式/跨线程 event-loop/lark SDK 契约)、假成功假失败、可观测调试手法 |
按面试场景速查#
”介绍一下你的项目”#
→ 先读 01-告警风暴 Q1(5 层架构总览),再补 03-Agent Q1(编排流程)
“说说你做过的性能优化”#
→ 00-压测 Q5-Q9(核心数据卡片)+ 00-压测 Q23(瓶颈分析)
“遇到过什么技术难点”#
→ 00-压测 Q11(Lua 竞态 bug)+ 01-告警风暴 Q11(SELECT+INSERT 竞态)+ 02-RAG Q5(BM25 内存迁 DB)
- 09-集成调试 Q4(committed 被误判 tool_error 的”假失败”)+ 09-Q5(跨线程 event-loop 崩溃)
“单测都过了为什么还出 bug / 你怎么保证质量 / 怎么做集成测试”#
→ 09-集成调试 Q1(单测盲区 vs 集成契约的 5 个真机 bug 表)
“系统怎么保证高可用”#
→ 04-容错 Q1-Q3(Fail-open)+ 04-容错 Q7-Q8(Worker 崩溃恢复)+ 04-容错 Q15(9 个降级点汇总)
“如果让你重新设计,你会改什么”#
→ 每份文档最后一节都有”设计取舍与反思”: 00-Q34 | 01-Q26 | 02-Q23 | 03-Q20 | 04-Q20 | 07-Q16 | 09-Q10(契约测试缺位/启动自检/假失败告警)
“讲讲限流怎么做的”#
→ 05-限流 Q1-Q5(四种算法对比 + 滑动窗口/令牌桶 Lua 实现)+ 05-限流 Q6-Q9(Lua 原子性 + 踩坑)+ 05-限流 Q13-Q17(分布式并发槽 vs Semaphore)
“你的简历上写了 XXX 数据,怎么得到的”#
→ 00-压测 Q2(数据准确性)+ 00-压测 Q30-Q32(简历衔接三连问)+ 06-Benchmark Q1-Q3(5 个简历点为什么要专门做 benchmark、量级怎么定)
“处置/自动化怎么保证安全” / “Agent 怎么做闭环”#
→ 07-处置事务 Q1-Q3(意图-执行分离 + 五段式事务 + CAS)
- 07-Q4-Q5(Saga 补偿 + 三层防重)
- 07-Q6-Q11(审批超时降级、分级回归门禁、可观测闭环)
- 07-Q12-Q15(对齐开源三块、verify_metric 端到端、飞书长连接手机一键审批的无公网破局 + 三道安全关)
“对标竞品/开源你做了什么” / “手机审批怎么实现的”#
→ 07-Q12(对照 itops-agent-platform 补三块 + 不为对齐而对齐)
- 07-Q15(飞书长连接 WebSocket 无公网实现手机一键审批)
“为什么自己写 Agent 执行器 / Harness 治理做了什么”#
→ 08-Harness Q1(三个 create_agent 给不了的能力)
“你是怎么做 A/B 对照实验 / 消融实验的”#
→ 06-Benchmark Q4-Q10(工具收窄 scoped/unscoped 对照)+ 06-Benchmark Q24-Q27(三层去重消融)+ 06-Benchmark Q6-Q7(跑出 0% 差异后怎么排查根因并推动修复)