READ · UNDERSTAND · TRANSFER
Agent 核心知识与面试题库
从核心原理出发,沿着实现、连续问答和条件变化深入 Agent 工程。阅读为主,短答与实验帮助巩固理解。
怎样阅读与巩固?
先读核心原理与实现,再沿着有答案的追问深入,最后比较条件变化后的迁移案例。需要检查理解时,可收起解析独立作答,或完成一个小实验。
题目依据公开官方资料与工程边界设计,案例中的规模、故障和目标为教学假设。参考资料支持技术机制,问答、迁移场景与自评标准由本站设计。
准备面试时,用自己的话解释原理、边界和取舍,再对照基础达标、中高级信号与资深信号检查。阅读记录与单次作答不直接代表掌握。
找到 63 个知识单元
01
Agent 架构与编排基础原理约 12 分钟
Agent 循环的控制权与完成判据
从工具调用循环出发,设计终止条件、预算、取消与可验证的完成状态。
Agent Loop预算终止条件取消
02
Agent 架构与编排进阶场景设计约 15 分钟
确定流程与局部探索的组合
围绕确定流程、动态探索、检查点和人工审批,选择可恢复的编排结构。
LangGraph状态机工作流检查点
03
Agent 架构与编排高级实现约 15 分钟
任务契约与独立验收
把模型外围的执行环境、权限、状态、证据与完成判定做成工程契约。
Harness任务契约验收执行环境
04
Agent 架构与编排高级场景设计约 18 分钟
多 Agent 的分工收益与协调成本
考察任务可并行性、协调成本、证据合并和对照实验。
Multi-Agent任务拆分成本
05
Agent 架构与编排高级实现约 18 分钟
并行状态合并的代数与业务语义
考察状态建模、Reducer、并发合并与消息去重。
LangGraphReducer并发状态
06
Agent 架构与编排高级场景设计约 18 分钟
计划修订与外部事实的分离
考察动态计划、已完成副作用、依赖关系和验收不变式。
规划状态版本审批
07
Agent 架构与编排进阶实现约 12 分钟
有损摘要与可回读事实
考察上下文预算、摘要失真、按需加载和恢复验证。
Context Engineering压缩Token预算
08
Agent 架构与编排高级场景设计约 18 分钟
任务交接的责任与权限传播
考察 Handoff、身份传播、最小上下文与责任边界。
Handoff身份传播权限
09
工具调用与 MCP基础实现约 12 分钟
工具参数的结构、授权与业务约束
将结构校验、业务语义、授权身份和输出校验分开处理。
JSON Schema参数校验工具网关业务规则
10
工具调用与 MCP高级场景设计约 15 分钟
MCP 集成中的协议与信任边界
区分协议互操作、OAuth 授权、业务权限和工具风险提示。
MCPOAuth信任边界工具授权
11
工具调用与 MCP高级实现约 15 分钟
结果未知下的幂等与补偿
用稳定操作标识、参数摘要与结果查询处理外部副作用的不确定结果。
幂等副作用重试不确定结果
12
工具调用与 MCP进阶场景设计约 12 分钟
大工具目录的发现与执行分层
考察工具目录、动态发现、召回质量和服务端授权。
工具路由工具发现MCP
13
工具调用与 MCP高级原理约 18 分钟
连接恢复、消息恢复与业务核验
考察 stdio、Streamable HTTP、会话恢复与业务幂等的区别。
MCPStreamable HTTP断线恢复
14
工具调用与 MCP高级实现约 18 分钟
并行结果的交付条件与共享截止时间
考察异步并发、截止时间、取消传播与部分结果。
asyncio并发Deadline
15
工具调用与 MCP高级场景设计约 18 分钟
长期任务中的工具语义与版本迁移
考察工具 Schema 版本、长期任务兼容与发布回滚。
Schema版本兼容回滚
16
工具调用与 MCP进阶实现约 12 分钟
大结果的计算、引用与快照一致性
考察输出契约、分页、产物引用与确定性计算。
工具输出Artifact大数据
17
RAG 与检索工程进阶场景设计约 15 分钟
RAG 的证据流与分阶段诊断
建立分阶段证据与指标,避免所有错误都用换模型解决。
RAG召回重排评测
18
RAG 与检索工程高级实现约 15 分钟
RAG 中授权与派生数据的一致性
把授权贯穿召回、重排、上下文、缓存和来源访问,而非只过滤最终答案。
RAG权限租户隔离ACL缓存
19
RAG 与检索工程进阶实现约 12 分钟
切块中的语义完整性与证据定位
考察文档结构、检索单位、上下文补全和可复核的切块实验。
Chunking文档解析证据
20
RAG 与检索工程高级实现约 18 分钟
混合检索中的互补召回与排名融合
考察混合检索、排序融合、去重与多阶段评测。
BM25Hybrid SearchRRF
21
RAG 与检索工程高级场景设计约 18 分钟
Embedding 迁移中的版本闭包与增量一致性
考察向量空间兼容、双索引、增量变更和删除一致性。
Embedding索引迁移增量同步
22
RAG 与检索工程进阶场景设计约 12 分钟
证据支持、部分回答与可校准的拒答
考察证据充分性、逐项引用、冲突处理与拒答校准。
Grounding拒答引用
23
RAG 与检索工程高级实现约 18 分钟
自然语言查询的口径、粒度与执行边界
考察语义层、受控 SQL、只读执行和结果复核。
Text-to-SQL司库权限
24
RAG 与检索工程进阶实现约 12 分钟
查询改写中的实体消歧与约束保真
考察多轮指代、实体链接、澄清与原始约束保留。
查询改写实体链接多轮对话
25
记忆管理进阶场景设计约 12 分钟
记忆作用域与可信授权上下文
把记忆作用域、真实性、权限与召回顺序设计成数据契约,向量相似度只负责排序。
记忆命名空间多租户权限召回
26
记忆管理高级实现约 14 分钟
记忆撤销、派生清理与防复活
将删除与恢复连接起来,用撤销版本、来源校验、物理清理和故障测试处理旧状态。
记忆删除撤销Checkpoint版本恢复
27
记忆管理进阶场景设计约 12 分钟
长期记忆的准入、来源与事实修正
考察记忆准入、来源、有效期与纠错。
Memory记忆准入污染
28
记忆管理高级实现约 18 分钟
记忆冲突中的对象、来源与双时间
考察事实版本、有效时间、来源优先级与冲突呈现。
记忆冲突版本有效时间
29
记忆管理进阶场景设计约 12 分钟
记忆召回中的硬过滤、价值排序与因果评估
考察记忆检索分层、相关性、权限、时效和反事实评测。
记忆检索权限评测
30
长任务与可靠执行高级实现约 14 分钟
Checkpoint、重放与外部副作用的边界
区分状态恢复、历史重放与外部副作用,设计稳定操作键、执行账本和故障注入验证。
LangGraphCheckpoint幂等恢复
31
长任务与可靠执行高级场景设计约 15 分钟
租约接管与过期执行者的写入隔离
租约负责接管,单调递增令牌负责拒绝过期写入,业务副作用仍须独立约束。
Worker租约Fencing Token并发控制
32
长任务与可靠执行进阶实现约 12 分钟
重试、期限、取消与预算的统一状态机
将总截止时间、单次超时、错误分类、预算预留与协作取消纳入同一个执行策略。
重试取消超时预算asyncio
33
长任务与可靠执行高级实现约 18 分钟
Outbox 的原子意图与重复投递
考察双写问题、事务 Outbox、重复投递和恢复扫描。
Outbox消息队列可靠投递
34
长任务与可靠执行高级实现约 18 分钟
审批快照、持久化等待与一次逻辑恢复
考察持久化等待、一次性批准、过期校验和并发恢复。
Human-in-the-loop审批恢复竞态
35
长任务与可靠执行高级场景设计约 18 分钟
工作流升级的结构兼容与业务兼容
考察工作流版本、持久化状态 Schema 和回放兼容。
CheckpointSchema迁移发布
36
长任务与可靠执行高级场景设计约 18 分钟
Saga 中已发生事实与条件补偿
考察跨服务事务、补偿前提、不可逆动作和人工介入。
Saga补偿事务
37
长任务与可靠执行高级场景设计约 18 分钟
多租户公平调度、资源配额与背压
考察多租户排队、公平调度、背压与多维配额。
队列多租户背压
38
评测与质量验证进阶场景设计约 12 分钟
可执行验收与质量边界
把结果、权限、证据、资源成本和恢复能力转化为可判定条件,再组合成发布门禁。
评测验收契约回归发布门禁
39
评测与质量验证高级原理约 13 分钟
结果与轨迹的双重验收
用结果后置条件、必要事件的偏序和禁止行为评测轨迹,不强制所有工具调用完全一致。
轨迹评测工具调用偏序可观测性
40
评测与质量验证进阶场景设计约 12 分钟
评测样本的独立性与代表性
考察任务采样、失败覆盖、数据泄漏与标注质量。
Eval Dataset回归数据泄漏
41
评测与质量验证高级场景设计约 18 分钟
语义裁判的校准与误差
考察裁判偏差、人工一致性、评分契约和对抗样本。
LLM-as-Judge校准偏差
42
评测与质量验证高级原理约 18 分钟
随机任务的成功率与重试口径
考察随机性、任务级统计、pass@k 与稳定性。
pass@k稳定性统计
43
评测与质量验证高级实现约 18 分钟
故障窗口与恢复不变量
考察故障点、业务不变式、确定性工具替身和恢复验收。
故障注入恢复测试不变式
44
评测与质量验证高级场景设计约 18 分钟
行为配置的发布与回滚
考察行为版本、回归门槛、影子流量与线上归因。
Prompt版本灰度回归
45
生产运维与安全进阶实现约 12 分钟
任务因果链与资源归因
把业务任务、模型请求与工具调用串成可查询的链路,并用质量回归补足运行指标。
OpenTelemetryTracing评测成本控制
46
生产运维与安全高级场景设计约 15 分钟
批准对象与执行时授权
在工具执行边界落实权限检查,把审批绑定到不可变参数及资源版本,拒绝提示词注入扩大授权。
权限隔离人工审批MCPPrompt Injection
47
生产运维与安全高级场景设计约 18 分钟
外部数据与执行权限的边界
考察间接提示注入、数据与指令分离、工具权限和出站控制。
Prompt Injection工具网关安全
48
生产运维与安全高级场景设计约 18 分钟
代码执行的资源与能力隔离
考察文件、网络、进程、凭证和资源限制。
Sandbox代码执行权限隔离
49
生产运维与安全高级场景设计约 18 分钟
备用模型的能力与状态契约
考察多模型适配、能力矩阵、失败分类和降级。
模型路由Fallback限流
50
生产运维与安全高级实现约 18 分钟
缓存复用的语义与授权等价
考察不同缓存层、权限版本、时效与真实节省。
缓存成本多租户
51
生产运维与安全高级实现约 18 分钟
连接重建与持久任务状态
考察任务与连接解耦、事件序号、重连和明确终态。
SSE流式进度重连
52
生产运维与安全高级场景设计约 18 分钟
事故止血、证据与因果定位
考察止损、版本归因、分层指标、隐私和复盘。
事故处理Observability成本
53
系统设计与选型高级场景设计约 20 分钟
证据到发布的受控任务链
把身份、知识权限、结构化工具、持久化任务与审核发布连接成可恢复的系统。
系统设计RAG+SQL持久化Outbox
54
系统设计与选型进阶场景设计约 15 分钟
编排抽象与业务责任的匹配
用状态复杂度、恢复要求、工具契约和团队约束做取舍,而不是按框架热度选择。
LangGraphAgents SDKTemporal技术选型
55
系统设计与选型高级场景设计约 18 分钟
代码变更与验收证据绑定
考察代码库理解、隔离执行、验收、回归与人工评审。
Coding AgentJavaPR
56
系统设计与选型高级场景设计约 18 分钟
自然语言诉求与交易状态分离
考察意图理解、业务规则、授权和可追溯执行。
客服Agent业务规则退款
57
系统设计与选型高级场景设计约 18 分钟
主张、来源与验证范围的绑定
考察研究计划、来源核验、证据账本、实验与发布门槛。
研究Agent证据内容生产
58
系统设计与选型高级场景设计约 18 分钟
租户隔离与执行面的权限连续性
考察控制面、执行面、数据隔离、容量和渐进交付。
平台架构多租户交付
59
系统设计与选型高级场景设计约 18 分钟
项目能力的证据与条件推演
考察项目复盘、本人贡献、量化证据和技术取舍。
项目深挖技术领导面试方法
60
模型基础与接口基础原理约 6 分钟
LLM 接口的容量、结果形态与执行边界
只关注影响 Agent 工程行为的上下文预算、结构化输出、工具调用与有界重试。
TokenContextStructured OutputTool Calling
61
模型基础与接口基础原理约 12 分钟
Token 计量、上下文容量与生成余量
用明确的预算算例区分输入容量、生成上限与下一轮余量,再判断何时分段、筛选或压缩。
Token上下文窗口输出预算截断证据使用
62
模型基础与接口基础原理约 16 分钟
参数能力、上下文证据与任务行为的适配边界
区分参数中的能力、请求中的证据与训练后的行为,按失败原因选择适配方法。
预训练RAG微调模型适配
63
模型基础与接口基础原理约 12 分钟
模型响应的生命周期与完成语义
把传输结束、模型终止、输出类型和工具结果分别判断,知道哪些片段可预览、哪些状态可交付。
模型接口响应生命周期流式输出工具请求拒绝与截断