# FDE W8D4 评测题 · 系统设计题

> 配套手册：《FDE-W8D4-系统设计题-学习手册.html》
> 候选人背景：36 岁，Java + 大数据 + 医疗保险；冲刺高级 / 架构 / 负责人岗。
> 共 13 题，分 L1 基础 / L2 进阶 / L3 深度 / L4 场景。每题含考察点、评分维度、折叠参考答案。
> 场景默认结合：特药理赔 Agent、企业 Agent 平台、企业 RAG 平台。

---

## L1 基础（概念清楚即可）

### 1. 系统设计题面试官主要在评估什么？
- **考察点**：考查本质。
- **评分维度**：结构化思维/权衡/边界/落地 四维度；是否强调"看怎么想"。
<details>
<summary>参考答案</summary>

评估四维度：① 结构化思维（先澄清再分层）；② 权衡能力（每个选型讲 pros/cons）；③ 边界意识（哪该规则/AI/人工）；④ 落地经验（容量/可靠/评测真实考量）。看"怎么想"重于"答了什么"。

</details>

### 2. LLM 系统的四层架构是什么？各管什么？
- **考察点**：分层基本功。
- **评分维度**：接入/编排/能力/数据 四层及职责；是否有典型组件。
<details>
<summary>参考答案</summary>

接入层（鉴权/限流/路由）、编排层（Agent 流程/状态/降级）、能力层（推理/RAG/规则/工具）、数据层（向量/图/日志/原始存储）。分层=关注点分离，每层可独立扩缩与替换，便于多租户隔离。

</details>

### 3. 标准解题节奏应该是怎样的？
- **考察点**：解题方法论。
- **评分维度**：澄清→四层→组件+理由→扩展可靠→四类边界→评测安全成本。
<details>
<summary>参考答案</summary>

节奏：澄清需求（场景/规模/SLA）→ 画四层架构 → 填每层组件+选型理由 → 讲扩展与可靠 → 点四类边界 → 补评测/安全/成本。上来就堆技术栈是没想清需求，直接扣分。

</details>

---

## L2 进阶（能选、能扩、能可靠）

### 4. 组件选型怎么回答最加分？举例说明。
- **考察点**：权衡表达。
- **评分维度**："选 X 因 Y、不选 Z 因缺点、到阈值切 Z"；演进路径。
<details>
<summary>参考答案</summary>

用模板：选 X 因场景约束 Y；考虑过 Z 但因缺点放弃；规模到阈值切 Z。例：向量库小量用 pgvector 省运维，海量切 Milvus；推理小量/弹性用 API，量大合规用 vLLM 私有。体现当下适合+未来演进。

</details>

### 5. LLM 系统的 Scalability 有哪些杠杆？
- **考察点**：扩展性。
- **评分维度**：无状态横扩/推理副本/Kafka削峰/数据分片；联系 Day1/Day2 容量闭环。
<details>
<summary>参考答案</summary>

无状态层（网关/编排）天然横扩；推理层 vLLM 多副本+路由（受 GPU 限）；数据层分片；耗时任务 Kafka 异步削峰。容量用 Day1 实测+Day2 副本公式闭环，配自动伸缩与冷启动缓冲。

</details>

### 6. 可靠性"四件套"是什么？在 LLM 系统怎么体现？
- **考察点**：可靠性设计。
- **评分维度**：限流/降级/熔断/重试；降级终点常转人工。
<details>
<summary>参考答案</summary>

限流（按租户/QPS 保护后端）、降级（模型超时切小模型/缓存/人工）、熔断（副本持续失败断流）、重试（带退避防雪崩）。LLM 系统里降级终点常是人工兜底，绝不静默出错——医疗尤甚。

</details>

### 7. 在架构里怎么"画"出四类边界？
- **考察点**：边界的架构落点。
- **评分维度**：决策路由图；规则/知识在能力层、Agent 在编排层、人工为显式出口。
<details>
<summary>参考答案</summary>

画决策路由：请求先过规则引擎（硬约束）→ RAG（知识）→ Agent（编排）→ 高风险转人工。落点：规则/知识在能力层、Agent 在编排层、人工是带触发条件的显式出口（非备注）。主动画路由图显深度。

</details>

---

## L3 深度（能设计、能辨析）

### 8. 现场设计一个企业 RAG 平台，你会怎么组织？
- **考察点**：RAG 平台设计。
- **评分维度**：先澄清需求；四层；混合检索/重排/溯源/拒答；扩展可靠。
<details>
<summary>参考答案</summary>

先澄清量级/实时性/多租户/合规/准确率。四层：接入（网关鉴权限流）、编排（改写→检索→重排→生成→引用校验）、能力（嵌入+向量库 Milvus+重排+生成 vLLM）、数据（语义切分+混合检索+溯源）。无知识则拒答转人工；副本扩容+Kafka 削峰+可靠四件套。

</details>

### 9. 为什么设计里要有"LLMOps 运维面"？怎么画？
- **考察点**：运维闭环意识。
- **评分维度**：评测集/监控/回归/闭环 四要素；只画运行面不完整。
<details>
<summary>参考答案</summary>

只画运行面不算完整设计。要在图里预留运维面：数据层存评测集、接入/能力层埋监控（延迟/漂移/成本）、更新触发回归流水线、bad case 闭环到知识与 prompt。证明想过"上线后怎么保质量"，是高级与初级的分水岭。

</details>

### 10. 安全在 LLM 系统里怎么设计才体系化（以医疗为例）？
- **考察点**：横切安全。
- **评分维度**：四层贯穿；脱敏时机；审计留痕（用哪条知识）；多租户隔离。
<details>
<summary>参考答案</summary>

安全作为横切关注点贯穿四层：接入鉴权限流、数据脱敏+字段权限、能力层推理前脱敏+输出过滤、全链路审计（谁/何时/用哪条知识/得什么结论）。医疗场景不能只在某一层提，且要防模型吐出记忆泄露。

</details>

### 11. 模型网关（Model Gateway）解决什么问题？
- **考察点**：网关价值。
- **评分维度**：统一接口/路由降级/配额/缓存/计量；与中台关系。
<details>
<summary>参考答案</summary>

网关是 AI 中台总闸口：统一接口（屏蔽 vLLM/API 差异）、按成本/可用性路由与降级、限流配额、结果缓存、计量账单。把 Day2 成本控制和 Day1 多模型部署串成统一面，让上层无感切换底层。

</details>

---

## L4 场景（结合实际业务设计/判断）

### 12. 场景：请现场设计一个"特药理赔 Agent"系统，要求体现四类边界、可靠性和合规审计。
- **考察点**：综合设计 + 边界 + 可靠 + 合规。
- **评分维度**：四层架构；规则→RAG→Agent→人工 路由；可靠四件套；审计贯穿；容量呼应 Day1/2。
<details>
<summary>参考答案</summary>

四层：接入（网关鉴权+限流+合规闸口）、编排（状态机：待审→检索→计算→结论→复核，低置信转人工）、能力（规则引擎硬计算+知识库条款RAG+vLLM生成+查保单工具）、数据（脱敏材料+向量/图+审计日志）。

四类边界：规则先校验材料/免赔额→RAG 取条款→Agent 编排计算与初审→金额/拒赔/低置信转人工。可靠：模型超时降级规则模板、限流熔断重试、终点人工。合规：每步留痕（条款/模型版本），全链路审计。容量用 Day1 实测+Day2 副本公式。

</details>

### 13. 场景：公司要建"企业 AI 中台"支撑 10 个业务部门，你作为架构负责人怎么设计？重点讲复用与隔离的权衡。
- **考察点**：中台架构 + 多租户权衡 + 负责人视角。
- **评分维度**：多租户隔离/共享底座/编排市场/治理；复用与隔离平衡；模型网关；LLMOps。
<details>
<summary>参考答案</summary>

定位：把 RAG/Agent 能力多租户化+可编排+可治理，避免各部门烟囱。

权衡核心——共享什么、隔离什么：共享底座（向量库/推理集群/模型网关）、隔离数据与配额（向量 namespace/独立副本+限流）。提供 Agent 模板市场让业务低门槛自助搭建；治理面含模型注册/版本/评测/成本看板（呼应 Day2/3）。模型网关统一路由与计量。运维面预置评测集/监控/回归。安全横切四层，医疗部门强隔离+审计。

</details>

---

## 评分汇总表

| 层级 | 题号 | 主题 | 达标要求 |
|------|------|------|----------|
| L1 基础 | 1-3 | 本质/分层/节奏 | 概念准确 |
| L2 进阶 | 4-7 | 选型/扩展/可靠/边界 | 能选、能扩、能可靠 |
| L3 深度 | 8-11 | RAG平台/LLMOps/安全/网关 | 能设计、能辨析 |
| L4 场景 | 12-13 | 理赔 Agent / 企业 AI 中台 | 综合设计 + 边界 + 可靠 |

### 计分
- 每题按"概念准确度 / 完整性 / 业务结合度"三档：✅ 到位 / ⚠️ 部分 / ❌ 缺失。
- **达标线①（现场设计企业 RAG 平台）**：L1(2,3) + L2(4,5,6) + L3(8) + L4(12) 全 ✅，能澄清需求、画四层、讲组件权衡、给混合检索/溯源/拒答、补扩展与可靠。
- **达标线②（体现四类边界）**：L2(7) + L3(8,10) + L4(12,13) 全 ✅，能在架构里画"规则→RAG→Agent→人工"决策路由并说清落点，联动可靠与合规。
- 任一达标线出现 ❌ 即未达标，需回看对应手册章节重做自测清单。
