这篇文章只列举了问题完整回答请看这篇帖子Agent应用开发面试100题汇总(问题答案完整版)-CSDN博客Q1入门Agent 基本概念Agent 与直接调用 LLM 的核心区别是什么为什么说「能调用工具」是 Agent 的关键特征而非充分条件Q2入门Planner/Executor 模式在 Agent 架构中Planner 和 Executor 各自的职责是什么为什么要将规划与执行分离Q3入门记忆与上下文Agent 的「记忆」和 LLM 的「上下文窗口」是同一个概念吗两者的关系是什么Q4入门护栏概念什么是 Agent 的「护栏Guardrails」它和普通的输入校验有什么本质区别Q5入门轨迹与可观测性在 Agent 语境下「轨迹Trajectory」指的是什么为什么它对调试 Agent 很重要Q6入门状态与记忆分类Agent 的短期状态和长期记忆分别指什么举一个场景说明两者的区别。Q7入门工具调用基础什么是 Agent 的「工具调用Tool Calling」它和函数调用Function Calling是什么关系Q8入门多 Agent 编排概念多 Agent 系统中「编排Orchestration」是什么意思为什么单 Agent 不一定需要编排Q9入门人类介入什么是「人类介入Human-in-the-loop」在 Agent 系统中它通常出现在哪个环节Q10入门评估指标Agent 评估中的「任务完成度」和「成功率」是同一回事吗它们分别关注什么Q11入门幂等性什么是工具调用的「幂等性」为什么 Agent 场景下尤其需要关注这个特性Q12入门审计与可追溯性Agent 系统中的「审计日志Audit Log」通常需要记录哪些信息它和普通系统日志有什么不同Q13入门Agent 循环机制什么是 Agent 的「推理-行动循环Reasoning-Action Loop」它和一次性生成回答有什么本质区别Q14入门权限边界Agent 的「权限边界」是什么意思为什么不能直接给 Agent 所有工具的访问权Q15入门成本控制基础什么是 Agent 的「成本控制」在 Agent 运行过程中成本主要来自哪些方面Q16初级Agent vs Workflow 场景选择在什么场景下你会选择用 Agent 而不是固定 workflow请给出一个具体的判断依据。Q17初级工具描述如何为 Agent 编写一个好的工具描述Tool Description描述的好坏会怎样影响 Agent 的调用决策Q18初级错误恢复当 Agent 调用工具失败时常见的错误恢复策略有哪些直接重试为什么不一定有效Q19初级上下文管理在多轮对话中Agent 的上下文会越来越长。简单的「保留全部历史」方案有什么问题Q20初级记忆选择策略一个客服 Agent 需要记住用户的偏好信息你会选择存在短期状态还是长期记忆中为什么Q21初级Agent 模式对比ReAct 模式的 Agent交替推理和行动和「先规划全部步骤再执行」的 Agent各自适合什么类型的任务Q22初级循环行为Agent 在执行任务时为什么会陷入「反复调用同一工具」的循环你如何初步判断和解决Q23初级人类介入时机在 Agent 系统中什么情况下应该在工具调用前加入「人类审批」环节选择依据是什么Q24初级工具权限控制如何限制 Agent 只能调用被授权的工具简单的「不在 prompt 中列出工具」是否足够安全Q25初级参数校验Agent 的工具参数校验应该在哪些层面进行仅依赖 LLM 生成正确参数有什么风险Q26初级记忆策略对比总结记忆Summary Memory和检索记忆Retrieval Memory分别适合什么场景各有什么优缺点Q27初级评估方法在评估 Agent 时为什么只看最终结果是否正确是不够的轨迹分析能提供哪些额外信息Q28初级执行反馈Agent 执行多步任务时中间步骤的反馈如何影响后续决策缺乏执行反馈会导致什么问题Q29初级单 Agent vs 多 Agent在什么情况下多 Agent 系统比单 Agent 更合适请给出一个具体场景并说明原因。Q30初级系统提示词设计Agent 的系统提示词System Prompt通常应该包含哪些关键信息缺少这些信息会导致什么问题Q31初级总结记忆Agent 在长任务执行过程中为什么要对中间结果进行总结直接保留原始输出有什么隐患Q32初级失败分类如何判断一个 Agent 的失败是由于规划错误还是执行错误你会怎么区分这两类问题Q33初级工具粒度设计给 Agent 配置工具时「一个万能工具」和「多个细粒度工具」各有什么利弊你会如何取舍Q34初级上下文污染Agent 的「上下文污染」是什么意思通常是怎么产生的Q35初级成本控制实践在 Agent 系统中成本控制最基础的策略有哪些为什么 Agent 比普通 LLM 调用更容易产生高额费用Q36中级Agent vs Workflow 权衡如果任务步骤是已知的且固定的为什么用 Agent 反而可能比 workflow 更差从可靠性和成本两个角度分析。Q37中级ReAct vs Plan-then-ExecuteReAct 模式中Agent 每一步都先推理再行动。这种「边想边做」的模式在什么情况下会导致比「先全局规划再执行」更差的结果Q38中级记忆存储策略Agent 的长期记忆应该存什么、不该存什么如果存了不该存的信息如临时性的中间状态会带来什么问题Q39中级上下文污染防治上下文污染在 Agent 中具体是如何发生的有哪些策略可以有效避免或减轻上下文污染Q40中级多 Agent 编排架构在多 Agent 系统中集中式编排和去中心化协调各有什么优劣什么场景下你会选择去中心化Q41中级错误分类与重试Agent 调用工具时如何区分「可重试的临时错误」和「不可重试的逻辑错误」错误分类对重试策略有什么影响Q42中级工具描述优化工具描述写得越详细Agent 的调用准确率一定越高吗过长的工具描述会带来什么副作用Q43中级反思机制Agent 的「反思Reflection」机制是什么它在什么情况下能提升性能什么情况下只是增加成本而无实质收益Q44中级检索记忆优化检索记忆系统中检索质量直接影响 Agent 的决策。你会如何评估和优化 Agent 记忆检索的召回率和相关性Q45中级评估指标设计在 Agent 评估中步骤成功率Step Success Rate和任务成功率Task Success Rate分别能反映什么问题两者之间可能存在什么不一致Q46中级架构对比单 Agent 多工具 vs 多 Agent 各自专属工具这两种架构在通信开销、上下文管理和调试难度上各有什么权衡Q47中级规划能力边界Agent 的规划能力如何随任务复杂度变化在什么类型的任务上LLM 的规划质量会出现显著下降Q48中级护栏设计权衡如何设计 Agent 的护栏使其既能阻止危险操作又不过度限制 Agent 的自主性护栏过严会带来什么问题Q49中级多 Agent 冲突处理在多 Agent 系统中如果两个 Agent 对同一问题给出冲突的结论系统应该如何处理这种冲突有哪些协调策略Q50中级记忆淘汰策略Agent 的记忆淘汰策略应该如何设计基于时间、基于频率、基于重要性还是组合策略各自的适用场景是什么Q51中级路由策略对比规则路由和 LLM 路由是多 Agent 系统中常见的两种任务分发方式。它们各自在延迟、成本和灵活性上有什么权衡Q52中级动态重规划Agent 在执行过程中发现初始规划不可行时应该「重新规划」还是「局部调整」两种策略各有什么风险Q53中级轨迹评估如何评估 Agent 的推理轨迹是否合理如果最终结果正确但推理过程有逻辑跳跃或错误这算不算一个问题Q54中级副作用与幂等性Agent 的工具调用如果涉及副作用操作如写数据库、发邮件重试策略和幂等性设计应该如何配合Q55中级同步 vs 异步执行在 Agent 系统中同步工具执行和异步工具执行各有什么优劣什么场景下异步执行是必须的Q56中级记忆内容分类Agent 的记忆系统中如何区分「事实信息」和「推断信息」存储推断信息可能带来什么风险Q57中级自主性权衡为什么给 Agent 更多的自主权不一定能带来更好的任务完成效果自主权和可控性之间的最佳平衡点如何确定Q58中级失败分类体系Agent 的失败分类体系应该如何设计一个好的失败分类应该能指导什么后续行动Q59中级上下文压缩策略在长任务执行中Agent 的上下文窗口可能被中间结果占满。滑动窗口、摘要压缩和外部检索这三种策略各有什么优劣Q60中级多 Agent 状态共享多 Agent 系统中Agent 之间的状态共享是必要的吗无状态共享的松耦合设计和有状态共享的紧耦合设计分别适合什么场景Q61中级延迟优化Agent 的工具调用延迟会直接影响整体响应时间。在多步工具调用场景下你会如何优化端到端延迟Q62中级自我修正机制Agent 的「自我修正Self-Correction」能力在什么情况下有效什么情况下反而会导致问题恶化如越改越错Q63中级停止条件设计如何为 Agent 设计有效的「停止条件」如果没有明确的停止条件Agent 可能出现什么行为Q64中级失败归因分析在 Agent 的轨迹分析中如何区分「LLM 推理能力不足导致的失败」和「工具或环境问题导致的失败」Q65中级记忆时效性Agent 的记忆如果包含了过时信息可能会导致什么问题如何检测和处理记忆中的过期信息Q66高级复杂场景系统设计设计一个处理复杂法律文档的 Agent 系统文档可能长达数百页需要提取条款、交叉引用并生成摘要。你会如何设计其记忆和工具架构Q67高级记忆压缩策略一个 Agent 在多轮对话后因上下文过长导致性能下降。你会如何设计一个分层记忆压缩策略在不丢失关键信息的前提下控制上下文长度Q68高级多 Agent 系统设计设计一个用于软件开发的多 Agent 系统包含需求分析、代码编写、测试、审查等角色。Agent 之间的通信协议和状态同步机制应该如何设计Q69高级动态工具管理如何实现动态工具选择——Agent 的可用工具集根据当前上下文动态变化这种设计的好处和挑战分别是什么Q70高级Fallback 策略设计当 Agent 的所有可用工具都无法产生有效结果时系统应该如何优雅降级设计一个多层级的 fallback 策略。Q71高级状态一致性在多 Agent 系统中多个 Agent 并发修改共享状态时可能出现竞态条件。你会如何设计状态一致性保证机制Q72高级上下文溢出恢复Agent 在任务执行中途因上下文窗口超限而无法继续。你会如何设计一个「上下文溢出恢复」机制使 Agent 能从中断点继续执行Q73高级成本感知路由在多 Agent 系统中不同 Agent 可能使用不同大小的 LLM。你会如何设计成本感知路由策略在保证任务质量的前提下最小化 API 调用成本Q74高级多维记忆架构为一个长期运行的 Agent 设计记忆系统需要在「近期相关性」「主题相关性」和「信息重要性」三个维度间平衡。你会如何设计这个多维度的记忆检索和淘汰策略Q75高级循环检测与恢复如何检测 Agent 是否陷入了推理循环反复在相似的中间步骤间跳转而不取得进展检测到后应采取什么恢复策略Q76高级安全护栏设计设计一个护栏系统使 Agent 可以自主执行大多数操作但对「不可逆操作」如删除数据、发送外部消息实施强制拦截。如何定义和检测「不可逆性」Q77高级自我修正的失败模式Agent 的自我修正机制有哪些典型失败模式如错误累积、过度修正、修正引入新错误如何检测和缓解这些失败模式Q78高级多层级评估系统设计一个 Agent 评估流水线需要同时捕获任务级指标最终结果质量和轨迹级指标推理和行动的合理性。这两个层级的指标如何关联和综合Q79高级分布式执行一致性在分布式 Agent 系统中工具执行可能出现部分失败如 3 个工具调用中 2 个成功 1 个失败。如何设计事务性的执行和回滚策略Q80高级工具版本管理生产环境中的 Agent 系统需要支持工具版本升级如 API 签名变更。你会如何设计工具版本管理机制确保升级不影响正在执行的 Agent 任务Q81高级Prompt 缓存优化Agent 使用大量稳定的系统提示词和工具描述。你会如何利用 prompt caching 来优化成本和延迟缓存策略需要考虑哪些失效条件Q82高级动态人类介入设计一个人机协作 Agent 系统目标是最小化人类介入次数同时保证安全底线。你会如何动态决定哪些操作需要人类审批而不是使用固定规则Q83高级多语言 Agent 设计Agent 需要在多语言环境下运行且不同语言环境下可用的工具集不同。你会如何设计 Agent 的语言感知和工具适配层Q84高级状态持久化与恢复Agent 在任务执行中途崩溃进程意外终止。你会如何设计状态持久化和恢复机制使 Agent 能从崩溃点恢复而非从头开始需要持久化哪些最小信息集Q85高级架构对比方法论如何设计一个公平的 Agent 架构对比基准需要控制哪些变量当两个架构在不同任务类型上表现不一致时如何做综合评判Q86专家大规模多 Agent 架构设计一个支持 100 并发 Agent 协同工作的系统。核心挑战包括通信开销、状态一致性、资源竞争和故障隔离。你会如何设计整体架构Q87专家自适应架构设计一个能够根据任务复杂度动态切换架构的 Agent 元系统——简单任务用单 Agent ReAct复杂任务用多 Agent Plan-Execute。如何设计这个「架构路由器」的决策逻辑Q88专家自主性与可预测性权衡Agent 的自主性和可预测性之间存在根本性张力。从系统设计角度如何做原则性的权衡在什么情况下可预测性应优先于自主性Q89专家护栏形式化验证如何为 Agent 护栏设计形式化验证方法使其能够可证明地阻止某些危险的操作序列传统模型检测技术在 Agent 场景下面临哪些新挑战Q90专家Agent 持续学习设计一个能从执行轨迹中持续学习改进的 Agent 系统。如何避免「灾难性遗忘」学到新模式后旧能力退化和「经验偏差」过度拟合到特定执行路径Q91专家ReAct 扩展性极限ReAct 模式的推理-行动循环在任务复杂度增加到什么程度时会遇到根本性瓶颈这些瓶颈是 LLM 能力限制还是架构限制有哪些替代范式Q92专家多租户 Agent 隔离设计一个多租户 Agent 系统不同租户有不同的工具访问权限、记忆隔离要求和成本预算。如何在共享基础设施的同时保证租户间的安全隔离Q93专家对抗性防御攻击者可能通过精心构造的输入操纵 Agent 的工具使用如 prompt injection 诱导 Agent 调用危险工具。你会如何设计纵深防御策略来应对这类对抗性攻击Q94专家分布式 Agent 一致性设计一个在不可靠网络上运行的分布式 Agent 系统Agent 可能在不同节点上执行且网络可能分区。如何保证 Agent 系统的最终一致性和任务完成的语义正确性Q95专家模型选择架构权衡在 Agent 系统中使用单个大模型 vs 多个小型专用模型各有什么深层权衡从延迟、成本、能力边界、维护复杂度等维度做系统性分析。Q96专家资源感知决策设计一个能感知自身资源约束token 预算、时间预算、成本预算并据此做战略决策的 Agent。例如它应在何时选择「足够好」的结果而非追求最优这个决策逻辑如何实现Q97专家长期运行记忆架构设计一个需要服务数千用户、持续运行数月的 Agent 系统的记忆架构。核心挑战包括跨用户记忆隔离、单用户长期记忆的一致性、记忆膨胀的控制。你会如何设计Q98专家评估鸿沟与持续评估Agent 在 benchmark 上表现优异但在生产环境中频繁失败评估鸿沟问题。你会如何设计一个持续评估系统来弥合这个鸿沟需要采集哪些生产数据如何避免评估本身影响生产性能Q99专家组合动作空间规划当任务的动作空间是组合爆炸的如工具调用序列的排列组合LLM 的规划能力面临什么根本性瓶颈可能的突破方向有哪些如分层规划、启发式搜索与 LLM 结合等Q100专家高风险 Agent 系统设计设计一个在高风险环境如金融交易、医疗诊断中运行的 Agent 系统要求满足实时护栏、完整审计链和监管合规。这些约束之间可能存在什么冲突如何做系统级权衡