DocMind 面试主题文档集#
按 RAG 管线 6 层优化 + 2 个横切关注点组织。
每篇覆盖 通用知识(面试八股)+ DocMind 实践(项目故事)+ 追问应对。
旧文档(interview-docs/00-22)保留为归档参考。
RAG 管线全景#
文档 ──→ ① 知识工程 ──→ ② Query改写 ──→ ③ 检索召回 ──→ ④ Rerank截断 ──→ ⑤ 可信生成 ──→ ⑥ 反馈闭环
切块/索引 改写/分类/路由 混合检索/Agentic Cross-Encoder 引用/CRAG/评测 观测/记忆/缓存
横切:⑦ 架构收敛("加了又删") ⑧ 全链路降级(10层独立兜底)
Agent 横切:⑨ 工具设计 ⑩ MCP互操作 ⑪ Prompt工程 ⑫ 推理与规划 ⑬ 安全约束 ⑭ 多Agent编排 ⑮ 长上下文与记忆
plaintext
文档索引#
| # | 文档 | 核心内容 | 行数 |
|---|
| 01 | 知识工程优化 | 切块策略全景 / Contextual Retrieval / 父子块 / Embedding选型 / TextChunker双层切块+增量索引 | 312 |
| 02 | Query改写优化 | HyDE / Step-Back / RAG-Fusion / Query Routing / 5→1合并+确定性后处理 | 392 |
| 03 | 检索召回优化 | BM25公式 / RRF / HNSW / 检索指标 / Agentic Retrieval / 三模式路径+agentic循环 | 385 |
| 04 | Rerank和截断优化 | Bi-vs-Cross Encoder / Lost in the Middle / MMR / 统一标尺+Token压缩+降级 | 330 |
| 05 | 可信生成与评测 | 幻觉分类 / CRAG/Self-RAG/FLARE / RAGAS / 结构化引用+覆盖率置信度+52条评测 | 354 |
| 06 | 线上反馈闭环 | 可观测性 / Memory系统 / 缓存策略 / Langfuse Score+MemoryExtractor+语义缓存 | 299 |
| 07 | 架构收敛 | Anthropic Effective Agents / ReAct/Plan-Execute / 5条分支→1个agentic循环 | 268 |
| 08 | 全链路降级 | Circuit Breaker / Graceful Degradation / 10层独立降级路径 | 326 |
| 09 | 工具设计与Function Calling | Function Calling协议 / 工具描述工程 / 6 @Tool Bean双路(executeCode仅内部)+AgentToolContext+白名单4读+executeCode | 333 |
| 10 | MCP协议与Agent互操作 | MCP四层协议 / Transport选型 / Spring AI MCP Server+API-Key鉴权+Cursor实测 | 307 |
| 11 | Prompt Engineering实践 | System Prompt设计 / 结构化输出 / 6模板多场景+双源透明+memoryHints注入清洗 | 308 |
| 12 | Agent推理与规划 | 隐式规划 / 推理失败模式 / SYS_PROMPT策略引导+空轮早停+锚定效应防护 | 300 |
| 13 | Agent安全与约束 | OWASP LLM06 / 注入分类 / 16硬约束+6类软约束+间接注入事件 | 300 |
| 14 | 多Agent与编排模式 | Orchestrator-Worker / 框架选型 / 三模式路由+并行Worker+CrewAI PoC评估 | 304 |
| 15 | 长上下文与记忆管理 | 记忆分层 / 冲突消解 / 三层去重+MySQL SoR三层存储(#34)+滚动摘要+上下文溢出排查 | 322 |
| — | 面试速查卡 | 考前15分钟速览:数字/故事/必杀题/反击句 | 95 |
面试问题 → 文档速查#
每篇文档结构#
一、通用知识 ── 面试官问"你对 XX 怎么理解"
1.1 核心概念与原理
1.2 业界方案对比(表格)
1.3 关键论文
1.4 通用面试问答(5-8个 Q+A)
二、DocMind 实践 ── 面试官问"你具体怎么做的"
30秒口述版 → 详细展开(SAR) → 代码锚点 → 量化数据
三、追问应对 ── 面试官追问 + 反击引导
plaintext