跳到正文

大模型面试题库(2026)

851 道大模型面试题,覆盖 RAG、Agent、模型架构、模型微调、推理优化等 15 个模块及 36 家公司题源。每题含书面答案、口语讲法和 2–3 种面试官问法。

按模块与公司找题

Agent(154题)

  1. Agent 中断恢复:状态持久化策略
    蚂蚁真题
  2. Agent 资源调度:多线程冲突避免
    高德真题
  3. 多智能体系统核心技术难点
    美团真题
  4. 多轮 Agent RL 难在哪?
    美团真题
  5. Agent 怎么处理代码库数据?
    字节真题
  6. Agent 强化学习怎么训练?
    美团真题
  7. Agent 实现 AGI 面临哪些挑战?
    同花顺真题
  8. ReAct vs Plan-and-Execute 怎么选?
    美团真题
  9. Agent 长短期记忆如何分层?
    字节真题
  10. ReAct与Plan-and-Execute 上下文管理差异?
    美团真题
  11. ReAct vs Plan-and-Execute 推理效率对比?
    美团真题
  12. Agent 大模型优化三方向
    得物真题
  13. 大模型记忆机制怎么改进?
    得物真题
  14. Function Calling vs Toolformer 本质差异?
    高德真题
  15. Attention 在 Agent 多轮对话有哪些局限?
    字节真题
  16. 架构 vs 模块 vs 工具集成怎么选?
    淘天真题
  17. Tool Calling 参数格式怎么保?
    高德真题
  18. 主流 LLM 应用产品怎么选?
    阿里真题
  19. 海量历史记录怎么索引优化?
    字节真题
  20. Agent 长期记忆存储结构
    字节真题
  21. Agent 架构的取舍与适用条件
    字节真题
  22. Agent 技术演进与挑战?
    字节真题
  23. 多轮对话上下文状态管理机制
    蚂蚁真题
  24. 多 Agent 冲突怎么检测与协调?
    字节真题
  25. Agent模块协作机制与失败场景
    百度真题
  26. Agent 组件如何协同完成复杂任务?
    百度真题
  27. Agent 中 RAG 瓶颈怎么破?
    阿里真题
  28. Agent 外部工具怎么集成?
    阿里真题
  29. 生成式推荐系统有哪些改进方向?
    小红书真题
  30. 冷启动新用户怎么推荐?
    小红书真题
  31. Agent记忆分层:摘要与检索协同
    高德真题
  32. 旅行Agent怎么拆解任务?
    高德真题
  33. LLM 输出格式不规范怎么修?
    小红书真题
  34. Agent 规划记忆工具调用机制
    百度真题
  35. Agent记忆分层与RAG检索
    高德真题
  36. Agent 组件如何实现自主决策与学习?
    百度真题
  37. 模糊意图怎么补全?
    蚂蚁真题
  38. Agent 工具调用失败怎么处理?
    蚂蚁真题
  39. 多 Agent 协同如何分工?
    字节真题
  40. Function Calling 消息流
    百度真题
  41. Agent 核心模块怎么协同?
    百度真题
  42. LangChain vs LlamaIndex 在 RAG 中怎么选?
    阿里真题
  43. Agent API容错:重试降级与澄清
    高德真题
  44. 全局规划+局部避障怎么融合?
    vivo真题
  45. 最大重试次数怎么设?
    字节真题
  46. 多智能体系统怎么协同?
    高德真题
  47. ReAct 框架核心优势在哪?
    高德真题
  48. 多智能体系统 vs 单一 Agent 怎么选?
    高德真题
  49. Agent 推理链路延迟优化策略
    淘天真题
  50. Agent 架构怎么从零设计?
    百度真题
  51. RAG+Agent 延迟与准确率成因
    阿里真题
  52. Agent长期记忆Embedding检索策略
    高德真题
  53. Agent 调用链路容错机制
    蚂蚁真题
  54. Agent 系统哪个模块最不稳定?
    蚂蚁真题
  55. Single-Agent vs Multi-Agent 架构取舍
    百度真题
  56. 工具调用方法怎么选?
    百度真题
  57. Tool Use 实现方法有哪些?
    百度真题
  58. 多 Agent 调度策略总览
    阿里真题
  59. 多 Agent 调度模式选型
    阿里真题
  60. 多 Agent 协作一致性
    阿里真题
  61. 异步 Agent 最终一致性
    阿里真题
  62. 动态障碍物怎么检测与规避?
    vivo真题
  63. 多 Agent 协作复杂度
    高德真题
  64. LangChain vs LlamaIndex vs AutoGPT 架构差异?
    淘天真题
  65. 多轮对话上下文遗忘怎么解?
    字节真题
  66. 大模型输出怎么做真实性验证?
    美团真题
  67. 高并发下状态一致性怎么保证?
    蚂蚁真题
  68. 架构设计如何保障低延迟访问?
    蚂蚁真题
  69. Agent框架模块化与工具集成怎么比?
    阿里真题
  70. 长历史行为怎么处理?
    小红书真题
  71. Agent 工具选择:打分排序机制
    高德真题
  72. 旅行AI Agent 多智能体怎么搭?
    高德真题
  73. 多智能体系统如何分解旅行任务
    高德真题
  74. 多Agent协同机制与共享记忆原理
    字节真题
  75. Tool Calling 决策机制与执行流程
    百度真题
  76. Agent 重试次数怎么定?
    字节真题
  77. 传统 RAG 有哪些痛点?
    淘天真题
  78. 多用户Memory隔离:LangChain改造方案
    蚂蚁真题
  79. Agent 反思机制原理与实现
    百度真题
  80. 反思机制原理与失败场景
    百度真题
  81. 长序列行为数据怎么处理?
    小红书真题
  82. 长序列怎么压缩与摘要?
    小红书真题
  83. LangGraph 状态机与场景
    淘天真题
  84. LangGraph 优势场景有哪些?
    淘天真题
  85. Agent 工具执行用 Workflow 吗?
    阿里真题
  86. Workflow 编排复杂任务优劣?
    阿里真题
  87. 货物装载决策怎么定?
    拼多多真题
  88. 取餐流程中先打卡还是先取餐?
    拼多多真题
  89. Agent 核心定义与关键能力
    腾讯真题
  90. Function Calling 怎么解析用户指令?
    美团真题
  91. 多Agent协同怎么提升推理正确率?
    快手真题
  92. LangGraph 核心特性与设计理念
    商汤科技真题
  93. MCP vs Function Calling 怎么选?
    百度真题
  94. Agent 核心机制怎么工作?
    百度真题
  95. 多 Agent 任务拆解与分工
    百度真题
  96. Agent 规划记忆工具分工
    百度真题
  97. Agent 核心组件与工作流程?
    商汤科技真题
  98. Tool Calling 机制详解
    百度真题
  99. Agent 核心组件架构
    百度真题
  100. 多 Agent 协同为什么必要?
    百度真题
  101. ReAct 与 CoT 怎么选?
    商汤科技真题
  102. Agent 架构落地看哪些组件?
    商汤科技真题
  103. Reflection vs Memory 怎么分工?
    百度真题
  104. 多智能体协同关键策略
    小红书真题
  105. 为何拆解任务给多Agent协作?
    百度真题
  106. LangGraph 核心功能与设计理念
    商汤科技真题
  107. Agent 工具类型怎么选?
    百度真题
  108. 多智能体协同怎么保证?
    小红书真题
  109. 多智能体 Memory 机制怎么用?
    百度真题
  110. Agent 推理模式对比
    百度真题
  111. Agent 核心组件有哪些?
    百度真题
  112. DeepResearch Agent 怎么工作?
    美团真题
  113. Agent 系统可调用哪些工具?
    百度真题
  114. Tool Calling 工具集设计原则
    字节真题
  115. 多Agent系统框架怎么搭?
    同花顺真题
  116. Agent项目经验怎么突出亮点?
    蚂蚁真题
  117. 多Agent系统设计原则有哪些?
    同花顺真题
  118. 工具集设计关键因素?
    字节真题
  119. Agent 主流架构怎么选?
    美团真题
  120. Agent 开发框架对比
    淘天真题
  121. Agent 框架 vs LLM 怎么选?
    快手真题
  122. LangChain vs AutoGPT vs BabyAGI 怎么选?
    淘天真题
  123. Tool Calling 失败处理
    商汤科技真题
  124. Agent 开发技术栈怎么选?
    同花顺真题
  125. Agent 训练数据怎么获取?
    小米真题
  126. Agent 系统实现流程与核心组件
    快手真题
  127. Agent 项目经历完整复盘
  128. 工具集设计最佳实践?
    字节真题
  129. LangGraph 构建 Agent 有几种方式?
    淘天真题
  130. Agent 框架核心组件怎么搭?
    字节真题
  131. AI Agent 趋势与挑战怎么破?
    字节真题
  132. 通信 vs 角色分工怎么选?
    字节真题
  133. 多 Agent 协同选通信还是共识?
    字节真题
  134. 大量工具怎么选?
    字节真题
  135. Agent 长期记忆存哪里?
    字节真题
  136. Agent 长期记忆架构与更新策略
    字节真题
  137. Agent 工具集成与工作流编排
    字节真题
  138. AutoGen vs LangGraph 怎么选?
    字节真题
  139. LangGraph外还有哪些流程编排框架?
    字节真题
  140. Agent 记忆衰退:为何与如何实现
    字节真题
  141. Agent 必备基础能力有哪些?
    美团真题
  142. 闲聊误判为工具调用怎么防?
    阶跃星辰真题
  143. 哪类 Agent 最易大规模落地?
    美团真题
  144. 工具 Agent 训练环境设计
    美团真题
  145. Agent工具系统:注册与权限控制
    美团真题
  146. Agent vs Workflow 怎么选?
    得物真题
  147. Agent工具接口与错误处理
    美团真题
  148. Agent 系统性能优化陷阱
    百度真题
  149. Agent组件通信机制与架构模式对比
    美团真题
  150. Agent工具定义、注册与安全控制有哪些?
    美团真题
  151. 什么是 AI Agent?和聊天机器人有什么区别?
  152. Function Calling 是什么?
  153. ReAct 框架是什么?
  154. MCP 模型上下文协议是什么?

评估与监控(121题)

  1. LLM 准确性提升四大路径
    百度真题
  2. 评测数据集怎么选?
    商汤科技真题
  3. 大模型应用怎么保障可靠性?
    百度真题
  4. 自动 vs 人工评价怎么选?
    百度真题
  5. LLM 幻觉与安全风险怎么缓解?
    字节真题
  6. 判别式转生成式哪种方法更优?
    字节真题
  7. 验证集和测试集为何要分开?
    阿里真题
  8. 面试高频论文怎么选?
    百度真题
  9. NDCG 怎么计算?
    京东真题
  10. RAG多轮对话怎么防知识遗忘?
    蚂蚁真题
  11. 高并发 Agent 延迟卡在哪?
    高德真题
  12. 多Agent冲突怎么检测与缓解?
    字节真题
  13. 子任务价值怎么归因?
    字节真题
  14. Agent 训练链路怎么搭建?
    美团真题
  15. Agent 训练 vs RAG 怎么选?
    美团真题
  16. Agent部署关键环节与陷阱
    得物真题
  17. RAG 工作原理与局限怎么分析?
    美团真题
  18. 多路召回评估指标与RAG场景
    美团真题
  19. 搜索排序A/B测试权重设计陷阱
    OPPO真题
  20. Agent 多工具如何评分选路?
    高德真题
  21. Agent 如何防越权与隐私泄露?
    高德真题
  22. RAG 指标权衡与阈值
    美团真题
  23. Agent 系统优缺点怎么分析?
    字节真题
  24. RAG 缓解幻觉的机制
    美团真题
  25. Agent 系统哪些模块最易出问题?
    蚂蚁真题
  26. RAG 为何要二次生成?
    字节真题
  27. RAG 评测优化闭环
    字节真题
  28. RAG 评估指标与迭代陷阱
    字节真题
  29. RAG 仍会幻觉的原因
    美团真题
  30. RAG 怎么减少幻觉?
    淘天真题
  31. RAG 错误怎么定位到检索或生成?
    百度真题
  32. RAG 错误根源怎么定位?
    百度真题
  33. RAG 解决了 LLM 哪些局限?
    科大讯飞真题
  34. 专业领域 RAG 链路怎么搭?
    字节真题
  35. 召回策略怎么选? Recall@k 怎么看?
    字节真题
  36. RAG 召回评估指标对比
    字节真题
  37. RAG编码模型评估指标与对比
    淘天真题
  38. RAG 三大瓶颈与迭代策略
    字节真题
  39. LLM 幻觉治理方法对比
    美团真题
  40. RAG vs RLHF 幻觉治理
    京东真题
  41. 医疗法律RAG:评估陷阱
    字节真题
  42. Single-Agent vs Multi-Agent 怎么选?
    百度真题
  43. BGE-M3 vs BM25 怎么选?
    字节真题
  44. RAG 二次生成怎么减少幻觉?
    字节真题
  45. Agent 多工具怎么选?
    高德真题
  46. 召回阶段怎么评估质量?
    美团真题
  47. 粗排模型评估指标与离线在线方法
    哔哩哔哩真题
  48. 粗排模型评估指标与陷阱
    哔哩哔哩真题
  49. Chain/Agent/Tool 怎么分工?
    快手真题
  50. 主流Agent框架优缺点与场景怎么选?
    阿里真题
  51. 多工具评分排序机制
    高德真题
  52. LangChain 链式调用原理
    快手真题
  53. LangChain 关键组件与流程?
    快手真题
  54. RAG 缓解哪类幻觉?
    京东真题
  55. RAG 自动与人工评估
    字节真题
  56. 搜索排序权重怎么A/B测试?
    OPPO真题
  57. Agent 系统优缺点与发展前景
    字节真题
  58. 粗排冷启动指标与路径
    哔哩哔哩真题
  59. RAG向量数据库选型关键指标
    京东真题
  60. 知识型与行为型错误诊断
    京东真题
  61. 现代RAG架构有哪些改进?
    淘天真题
  62. 用户兴趣建模:数据与特征陷阱
    小红书真题
  63. Attention 在多轮对话中有什么局限?
    字节真题
  64. 偏好感知系统架构怎么选?
    淘天真题
  65. LLM 如何集成外部工具与记忆?
    快手真题
  66. Agent 工具调用用 Workflow 吗?
    阿里真题
  67. AI Agent 核心理解与未来趋势
    商汤科技真题
  68. RAG 检索语义相似但无关怎么解?
  69. Reflection 和 Memory 怎么协同?
    百度真题
  70. RAG 文档检索选型
    字节真题
  71. MRR vs NDCG vs Precision 怎么选?
    百度真题
  72. RAG 检索与生成评估
    蚂蚁真题
  73. RAG 有哪些主要缺陷?
    小红书真题
  74. RAG 上下文不准确怎么诊断?
    字节真题
  75. Reflection vs Memory 如何影响决策?
    百度真题
  76. 大模型怎么用于搜索检索?
    虾皮真题
  77. RAG 失败场景诊断
    小鹏真题
  78. 单 Agent 与多 Agent 选型
    快手真题
  79. RAG 线上效果评估
    淘天真题
  80. Agent项目背景与技术方案怎么写?
    蚂蚁真题
  81. 大模型客服评估:伪代码与指标
    蚂蚁真题
  82. 多Agent组件优化策略与架构权衡
    同花顺真题
  83. RAG 解决了哪些问题?
    美团真题
  84. Agent项目挑战与解决方案怎么讲?
    蚂蚁真题
  85. Agent 技术实际有效性怎么评?
    滴滴真题
  86. 意图识别在 RAG 中怎么用?
    OPPO真题
  87. RAG 核心指标优先级
    淘天真题
  88. 多Agent系统优化策略
    同花顺真题
  89. Agent 项目踩坑与恢复
    蚂蚁真题
  90. LangGraph 适用边界与替代
    淘天真题
  91. ReAct vs 传统规划怎么选?
    字节真题
  92. RG 系统效果差怎么排查?
  93. 训练/推理/知识增强怎么选?
    阿里真题
  94. Agent 中规划与执行怎么协同?
    字节真题
  95. RAG 效果差怎么排查?
  96. RAG效果差:检索vs生成怎么诊断?
  97. 检索准但生成差,怎么调优?
  98. LangChain vs AutoGPT vs MetaGPT 怎么选?
  99. Agent 人工干预 vs 自动处理怎么切换?
    字节真题
  100. RAG 架构怎么工作?
    百度真题
  101. Agent 建模方法怎么选?
    字节真题
  102. 大模型 Agent 优缺点怎么分析?
    字节真题
  103. 共识算法如何落地多Agent?
    字节真题
  104. ReAct vs Plan-and-Execute 错误恢复谁强?
    美团真题
  105. Agent 哪个方向最易落地?
    美团真题
  106. Agent 基础能力怎么定义?
    美团真题
  107. Agent/RAG 评估指标与挑战
    安克科技真题
  108. Agent 外部工具怎么封装?
    美团真题
  109. Agent三大能力评估陷阱
    美团真题
  110. Query改写怎么训练与评估?
    字节真题
  111. RAG 问答金标构建
    安克科技真题
  112. Agent/RAG 评估体系怎么搭?
    安克科技真题
  113. Agent/RAG 评估集构建
    安克科技真题
  114. Coding vs GUI vs Search 谁先落地?
    美团真题
  115. Agent 功能模块怎么分工?
    美团真题
  116. 评估集防泄漏与复现
    安克科技真题
  117. 知识库更新策略怎么选?
    字节真题
  118. AI Agent 四大瓶颈怎么破?
    得物真题
  119. AI Agent 核心能力现状与差距
    得物真题
  120. Multi-Agent 训练流程关键阶段
    美团真题
  121. MRR 在 RAG 中怎么定义?
    百度真题

Prompt 工程(77题)

  1. 什么是 Prompt 工程?
  2. System Prompt 和 User Prompt 有什么区别?
  3. Few-shot 和 Zero-shot 是什么意思?
  4. Agent系统架构怎么选?
    百度真题
  5. 大模型智能体系统架构设计思路
    百度真题
  6. Agent架构设计原则?
    字节真题
  7. Agent 能力怎么系统提升?
    字节真题
  8. 动态Prompt怎么保证策略对齐?
    字节真题
  9. 无标注时怎么训练 CoT?
    网易真题
  10. JSON 输出怎么保证格式稳定?
    阿里真题
  11. CoT vs ToT vs GoT 怎么选?
    高德真题
  12. JSON 输出怎么保证稳定可靠?
    阿里真题
  13. Prompt 怎么系统设计与优化?
    脉脉真题
  14. RAG Generator Prompt 整合原理
    字节真题
  15. Prompt Engineering 技巧怎么选?
    华为真题
  16. Few-shot 提示怎么用?
    华为真题
  17. RAG Generator 怎么构造 Prompt?
    字节真题
  18. RAG生成阶段Prompt整合策略
    字节真题
  19. Prompt 设计原则有哪些?
    科大讯飞真题
  20. ReAct vs 纯提示:为何更优?
    高德真题
  21. ReAct 核心思想与多步推理优势
    高德真题
  22. ReAct 如何结合推理与工具使用?
    高德真题
  23. ReAct 框架为什么优于纯提示?
    高德真题
  24. Agent Prompt优化评估指标
    阿里真题
  25. 思维链(CoT)什么时候用?
    华为真题
  26. RAG 生成阶段 Prompt 怎么构建?
    字节真题
  27. Prompt 系统设计原则与技巧
    阿里真题
  28. LangGraph 多轮对话优势在哪?
    美团真题
  29. Agent推理链路Prompt优化评估指标
    阿里真题
  30. Prompt优化评估指标有哪些?
    阿里真题
  31. Prompt优化怎么评估准确性与效率?
    阿里真题
  32. 怎么让模型稳定输出 JSON?
    阿里真题
  33. Agent任务规划+工具调用原理
    腾讯真题
  34. LLM 输出格式如何强校验?
    字节真题
  35. RAG 改写与 Prompt 链路
    百度真题
  36. 电商Prompt设计陷阱
    字节真题
  37. Prompt 工程最佳实践有哪些?
    百度真题
  38. 提示工程有哪些核心方法?
    小红书真题
  39. LLM Agent组件有哪些功能?
    百度真题
  40. Agent 核心组件怎么协作?
    百度真题
  41. AI Agent 架构与框架怎么选?
    百度真题
  42. Agent 行为模式有哪些?
    商汤科技真题
  43. AI Agent组件如何协同工作?
    百度真题
  44. Reflection 机制怎么提升协作?
    百度真题
  45. 意图识别 Prompt 设计要素?
    百度真题
  46. RAG Prompt 模板设计陷阱
    商汤科技真题
  47. ReAct 范式核心思想与工作流程
    商汤科技真题
  48. Agent系统Prompt设计:架构与机制
    字节真题
  49. Agent 系统架构与 Prompt 设计原则
    字节真题
  50. Prompt 设计方法论怎么用?
    美团真题
  51. AI Agent 项目实战经验
    蚂蚁真题
  52. ReAct 之外还有哪些规划方法?
    商汤科技真题
  53. AI Agent 核心概念与架构
  54. 意图识别 Prompt 最佳实践?
    百度真题
  55. ReAct 架构原理与失败场景
    字节真题
  56. ReAct 框架怎么实现推理+行动?
    美团真题
  57. ReAct 框架怎么工作?
    美团真题
  58. Coding Agent 表现差怎么排查?
    字节真题
  59. CoT 提示怎么写?
    哔哩哔哩真题
  60. Agent任务规划:分解与ReAct机制
    字节真题
  61. ReAct 框架核心思想与流程
    美团真题
  62. ReAct 框架怎么用?
    美团真题
  63. ReAct 如何提升复杂任务?
    美团真题
  64. CoT 思维链由哪些部分构成?
    哔哩哔哩真题
  65. AI Agent 核心特点与局限
    字节真题
  66. 封闭标签分类如何约束解码?
  67. Prompt 工程方法怎么选?
    字节真题
  68. AI Agent 三大组件原理
    百度真题
  69. ReAct 各模块输入输出是什么?
    阶跃星辰真题
  70. Agent 工具调用链路怎么搭?
    美团真题
  71. 判别式转生成式模板怎么选?
    字节真题
  72. Prompt 性能上限评估指标
    阿里真题
  73. Prompt 优化方法有哪些?
    阿里真题
  74. Agent 四大基础能力详解
    美团真题
  75. Prompt 优化策略有哪些?
    百度真题
  76. Policy 模型错误决策怎么防?
    字节真题
  77. Agent 性能优化:架构与推理陷阱
    百度真题

重排与优化(70题)

  1. 医疗法律 RAG 架构关键环节
    字节真题
  2. RAG检索质量提升5法
    字节真题
  3. RAG Retriever 工作流程详解
    字节真题
  4. 专业领域RAG链路优化陷阱
    字节真题
  5. 向量数据库怎么支撑 Agent 记忆?
    高德真题
  6. RAG 瓶颈在哪一步
    百度真题
  7. RAG 检索偏差怎么系统性解决?
    小红书真题
  8. RAG 为什么需要 Re-ranking?
    字节真题
  9. RAG 原理与核心架构
    字节真题
  10. RAG流程:检索到生成各阶段陷阱
    阿里真题
  11. RAG检索不准的失败场景与优化
    小红书真题
  12. RAG 系统迭代优化方向有哪些?
    字节真题
  13. 精排精度高,为何不跳过召回粗排?
    哔哩哔哩真题
  14. 直接精排所有候选,为何不可行?
    哔哩哔哩真题
  15. RAG 流程各阶段怎么拆?
    美团真题
  16. RAG 完整工作流程怎么跑?
    美团真题
  17. RAG 检索优化:重排序怎么用?
    字节真题
  18. RAG 为何还要重排?
    字节真题
  19. 记忆型Agent为何用向量数据库?
    高德真题
  20. RAG 重排序怎么选?
    字节真题
  21. RAG 中 Re-ranking 怎么用?
    字节真题
  22. 召回和粗排为什么不能跳过?
    哔哩哔哩真题
  23. RAG 重排收益与成本
    字节真题
  24. RAG 系统怎么持续迭代?
    字节真题
  25. RAG 重排作用与实现
    字节真题
  26. Naive RAG vs Advanced RAG 区别?
    淘天真题
  27. RAG 流程各环节优化陷阱
    AIlab真题
  28. RAG 流程:检索、融合、生成
    AIlab真题
  29. RAG 延迟与准确率优化
    快手真题
  30. RAG流程优化:三大层面策略
    AIlab真题
  31. RAG 为什么需要 Rerank?
    字节真题
  32. 两阶段检索 vs 直接重排?
    字节真题
  33. RAG 延迟准确率根因
    快手真题
  34. RAG Query 改写方法
    百度真题
  35. RAG增强与生成如何衔接?
    高德真题
  36. RAG 工作原理与核心组件
    百度真题
  37. RAG 技术实现流程怎么走?
    百度真题
  38. RAG 工作流程与关键技术组件
    百度真题
  39. RAG 文档处理与检索策略怎么搭?
    百度真题
  40. RAG 组件功能与数据流向?
    高德真题
  41. RAG检索方法选型原因?
    字节真题
  42. RAG 核心实现原理是什么?
    字节真题
  43. BM25/向量/混合检索选型
    字节真题
  44. 专业领域RAG数据与检索优化?
    字节真题
  45. RAG检索方法如何优化?
    字节真题
  46. RAG 架构组件与失败场景
    字节真题
  47. RAG 流程优化:检索与重排陷阱
    虾皮真题
  48. RAG 怎么解决大模型幻觉?
    京东真题
  49. RAG 架构:检索到生成全链路
    字节真题
  50. RAG 局限性怎么破?
    小红书真题
  51. RAG 系统实现:组件与流程
    字节真题
  52. 领域 RAG 架构如何控幻觉?
    字节真题
  53. RAG架构:检索器与重排序策略
    字节真题
  54. RAG 检索器与知识库怎么搭?
    美团真题
  55. RAG 两阶段架构:模块与数据流
    商汤科技真题
  56. RAG 架构怎么搭?
    美团真题
  57. RAG 系统核心组件怎么搭?
    美团真题
  58. BM25+向量+Cross-Encoder 怎么组合?
    网易真题
  59. RAG检索优化:向量检索与重排序
    小鹏真题
  60. Context vs Prompt Engineering 区别?
    OPPO真题
  61. RAG 检索器与生成器如何协同?
    美团真题
  62. RAG 系统有哪些常见陷阱?
    美团真题
  63. 推荐结果多样性怎么控制?
    美团真题
  64. RAG 系统实现流程怎么搭?
    高德真题
  65. 语义检索向量数据库构建流程
    高德真题
  66. 两阶段 vs 端到端怎么选?
    字节真题
  67. RAG 召回准确性:三大失败场景
    360真题
  68. RAG 为何需要重排序?
    字节真题
  69. 向量数据库 vs 传统数据库怎么选?
    安克科技真题
  70. RAG 三阶段原理与失败场景
    百度真题

RAG 基础(62题)

  1. 什么是 RAG?一句话讲清检索增强生成
  2. RAG 和微调怎么选?
  3. RAG 完整流程分几步?
  4. 大模型幻觉是什么?怎么缓解?
  5. 增量式向量索引怎么更新?
    蚂蚁真题
  6. 对话模型准确性怎么提?
    百度真题
  7. RAG 核心架构与工作流程
    淘天真题
  8. 分布漂移下外接数据库怎么增强模型?
    美团真题
  9. RAG vs 传统检索生成怎么选?
    淘天真题
  10. 垂直领域 RAG 完整架构
    字节真题
  11. RAG 怎么提升生成准确性?
    字节真题
  12. RAG 怎么提升生成质量?
    字节真题
  13. RAG 检索模块怎么提升相关性?
    字节真题
  14. 多目标优化权重怎么定?
    哔哩哔哩真题
  15. 地图避障方法有哪些局限?
    vivo真题
  16. RAG 索引构建管线
    百度真题
  17. LangChain vs LlamaIndex 架构差异?
    阿里真题
  18. RAG 查不到文档怎么降级?
    字节真题
  19. 高精度RAG系统设计陷阱
    字节真题
  20. 医疗法律RAG架构怎么搭?
    字节真题
  21. RAG 检索增强技术有哪些?
    字节真题
  22. 医疗 RAG 索引如何保合规?
    字节真题
  23. RAG 怎么提升事实准确性?
    字节真题
  24. LangChain vs LlamaIndex 场景怎么选?
    阿里真题
  25. CTR/CVR/ROI 冲突怎么协调?
    哔哩哔哩真题
  26. RAG 检索噪声怎么处理?
    小红书真题
  27. 豆包等产品多轮一致性挑战与方案?
    字节真题
  28. 新用户冷启动:生成式推荐与Embedding
    小红书真题
  29. RAG 知识库怎么增量更新?
    美团真题
  30. 搜索排序权重怎么动态调?
    OPPO真题
  31. 查询文档相关性怎么算?
    OPPO真题
  32. LLM怎么融入推荐系统?意图理解与生成
    快手真题
  33. 外挂数据库怎么提升大模型准确性?
    美团真题
  34. 多信号评分函数原理与陷阱
    OPPO真题
  35. 推荐不准的分层诊断
    OPPO真题
  36. 搜索评分如何融合点击与停留?
    OPPO真题
  37. RAG 模型分类有哪些?
    淘天真题
  38. 现代 RAG 架构怎么变?
    淘天真题
  39. 时间窗口对话系统:约束与取舍
    蚂蚁真题
  40. RAG 二次生成怎么提升安全性?
    字节真题
  41. 偏好数据如何收集与建模?
    淘天真题
  42. 生成式推荐的序列原理
    小红书真题
  43. 生成式推荐系统未来怎么发展?
    小红书真题
  44. 生成式与判别式推荐选型
    小红书真题
  45. 用户兴趣模型:数据与特征取舍
    小红书真题
  46. ROI 问题怎么影响推荐效果?
    小红书真题
  47. Query 改写有哪些创新方法?
    京东真题
  48. 动态增量更新怎么防检索偏差?
    美团真题
  49. 搜索排序中时效性特征量化方法
    OPPO真题
  50. 内容热门度怎么量化?
    OPPO真题
  51. 推荐不精准怎么诊断?
    OPPO真题
  52. 时间窗口对话管理机制
    蚂蚁真题
  53. 逻辑引导怎么用?
    华为真题
  54. 人工干预怎么控制 LLM 生成?
    快手真题
  55. 排序模型初始权重怎么设?
    OPPO真题
  56. 大模型输出怎么检测和过滤?
    字节真题
  57. RAG 技术原理与核心组件详解
    百度真题
  58. 上下文错误时怎么保证输出准确?
    字节真题
  59. RAG 项目指标化复盘
    百度真题
  60. RAG 检索准但回答差怎么调?
  61. LLM 封闭标签方法对比
  62. Deep Research vs RAG 怎么选?

向量检索(49题)

  1. 什么是 Embedding 向量嵌入?
  2. 向量数据库和普通数据库有什么区别?
  3. 混合检索怎么提升 RAG 召回?
    美团真题
  4. RAG Retriever 工作机制详解
    字节真题
  5. Embedding 怎么实现语义召回?
    字节真题
  6. BM25 原理与 TF-IDF 改进点
    美团真题
  7. 混合检索为什么优于单一检索?
    美团真题
  8. BM25 vs 向量检索 vs 混合检索怎么选?
    小红书真题
  9. 召回 vs 粗排怎么分工?
    哔哩哔哩真题
  10. 召回阶段怎么选方法?
    soul真题
  11. BM25公式参数含义与TF-IDF对比
    美团真题
  12. RAG 召回又快又准靠什么?
    阿里真题
  13. RAG检索器与索引结构怎么选?
    阿里真题
  14. 召回模型怎么搭建?
    字节真题
  15. 稀疏稠密与混合检索
    美团真题
  16. 混合检索为什么用 Sparse+Dense?
    美团真题
  17. 多路召回 vs 排序模型怎么分工?
    小红书真题
  18. RAG 工作流怎么应对时效衰减?
    字节真题
  19. RAG 向量库怎么处理时间衰减?
    字节真题
  20. Embedding升级后向量对齐方案
    字节真题
  21. LLM怎么融入推荐系统?特征提取与召回
    快手真题
  22. LLM怎么融入推荐系统?序列建模与排序
    快手真题
  23. 向量数据库选型关键因素有哪些?
    京东真题
  24. RAG 向量检索怎么高效召回?
    字节真题
  25. BM25 公式与 TF-IDF 对比
    美团真题
  26. Embedding + 向量数据库怎么搭?
    字节真题
  27. BM25 参数 k1/b 调优
    美团真题
  28. 中文知识库检索选型
    小红书真题
  29. 推荐不准的算法改进
    OPPO真题
  30. Embedding 模型结构选型
    美团真题
  31. Hard Search vs Soft Search 怎么选?
    阿里真题
  32. BM25原理、应用场景及与TF-IDF区别
    高德真题
  33. Embedding 相似性检索原理与索引构建
    美团真题
  34. 检索失败时 RAG 怎么兜底?
    百度真题
  35. Embedding 向量维度选型
    小米真题
  36. 向量召回实现方式有哪些?
    百度真题
  37. 向量召回原理与实现?
    百度真题
  38. 向量检索加速:有哪些陷阱
    字节真题
  39. 向量检索 4 种范式怎么选?
    百度真题
  40. RAG检索质量差:Embedding与Rerank调优
    字节真题
  41. RAG 技术实现怎么落地?
    字节真题
  42. RAG文本分段策略与重叠机制
    小鹏真题
  43. ANN 索引怎么构建?
    拼多多真题
  44. RAG 知识库怎么存?
    安克科技真题
  45. RAG向量匹配原理与ANN算法取舍
    安克科技真题
  46. RAG 向量匹配怎么高效实现?
    安克科技真题
  47. RAG 知识库存储怎么选?
    安克科技真题
  48. Embedding 相似性检索怎么工作?
    美团真题
  49. 向量检索基本原理是什么?
    百度真题

模型架构(49题)

  1. DDPM 闭式采样为何无需展开前向链?
    百度真题
  2. 大模型面临哪些核心挑战?
    得物真题
  3. Transformer 为何用 Layer Norm?
    美团真题
  4. 位置编码为什么重要?
    海尔真题
  5. LLaMA为何选RMSNorm?
    字节真题
  6. LayerNorm vs BatchNorm 怎么选?
    美团真题
  7. DDPM 为什么随机采样时间步?
    百度真题
  8. RMSNorm vs LayerNorm:训练效率怎么比?
    字节真题
  9. Transformer 为何要归一化?
    海尔真题
  10. CNN/RNN/Transformer 怎么选?
    OPPO真题
  11. 逻辑回归原理怎么理解?
    OPPO真题
  12. 主流图像生成模型有哪些?
    小红书真题
  13. 参数规模怎么影响大模型?
    高德真题
  14. Encoder vs Decoder 功能区别?
    海尔真题
  15. Layer Norm 怎么稳定训练?
    海尔真题
  16. MoE 怎么提升 Agent 能力?
    美团真题
  17. VQ-VAE 原理与完整结构
    百度真题
  18. RMSNorm vs LayerNorm:数值稳定性怎么比?
    字节真题
  19. 格式化输出 vs 思维链,怎么选?
    字节真题
  20. Transformer 为何用 LayerNorm 而非 BatchNorm?
    美团真题
  21. Transformer归一化方法有哪些?
    海尔真题
  22. VQ-VAE 码本塌缩治理
    百度真题
  23. 判别式转生成式有哪些方法?
    字节真题
  24. Encoder vs Decoder 核心区别?
    海尔真题
  25. LayerNorm 如何控制激活尺度?
    海尔真题
  26. Few-shot 推理为何有效?
    字节真题
  27. 自回归生成用 token id 还是概率分布?
    字节真题
  28. FFN 隐藏层维度为何扩 4 倍?
    字节真题
  29. AI 论文怎么读?核心思想+创新点
    百度真题
  30. 幻觉一致性延迟诊断
    商汤科技真题
  31. VQ-VAE 与传统 VAE 有何不同?
    百度真题
  32. LayerNorm 前向实现:数值稳定性陷阱
    百度真题
  33. Self-Attention 怎么计算 QKV?
    海尔真题
  34. Transformer 架构核心组件原理
    美团真题
  35. Multi-Head Attention 维度变化
    字节真题
  36. GPT vs BERT 核心区别在哪?
    安克科技真题
  37. Decoder-only 架构为何是主流?
    海尔真题
  38. Flow Matching 原理是什么?
    百度真题
  39. MLA 与 KV Cache 怎么用?
    京东真题
  40. BERT+CRF 怎么联合训练?
    360真题
  41. LayerNorm vs RMSNorm 原理差异?
    字节真题
  42. 多头注意力原理与QKV拆分陷阱
    美团真题
  43. 位置编码怎么选? RoPE vs ALiBi
    京东真题
  44. VQ-VAE 损失与码本更新
    百度真题
  45. DDPM vs Flow Matching: 建模与训练差异?
    百度真题
  46. RMSNorm推理效率更高吗?
    字节真题
  47. Transformer 是什么?为什么是大模型的基石?
  48. Token 是什么?为什么大模型按 Token 计费?
  49. 上下文窗口是什么?超了怎么办?

模型微调(47题)

  1. 300-500意图怎么召回?
    京东真题
  2. Agent 规划能力怎么训练?
    同花顺真题
  3. 架构与训练怎么提升多轮一致性?
    字节真题
  4. 大模型落地技术范式怎么选?
    滴滴真题
  5. RAG检索偏差怎么缓解?
    美团真题
  6. Tool Calling 技术路径怎么选?
    百度真题
  7. Reranker 训练数据怎么构造?
    美团真题
  8. Prompt 怎么设计和优化?
    科大讯飞真题
  9. RAG/蒸馏/微调怎么选?
    联通真题
  10. Agent 记忆怎么用向量库?
    高德真题
  11. RAG vs SFT 场景怎么选?
    美团真题
  12. RAG 为何比 SFT 更优?
    美团真题
  13. 意图识别结构化输出失败如何修复
    小红书真题
  14. Few-shot vs Zero-shot vs Fine-tuning 怎么选?
    华为真题
  15. 向量检索怎么保准又保真?
    美团真题
  16. RAG 检索精度提升的三大陷阱
    AIlab真题
  17. RAG Embedding 模型怎么选?
    字节真题
  18. RAG 工作原理与架构怎么搭?
    字节真题
  19. RAG 端到端工作流程
    百度真题
  20. RAG 技术原理与架构怎么搭?
    字节真题
  21. 领域 RAG 知识库构建
    字节真题
  22. RAG 技术流程怎么跑?
    商汤科技真题
  23. 领域RAG应用链路怎么搭?
    字节真题
  24. 大模型知识库怎么构建?
    百度真题
  25. 文本嵌入模型怎么选?
    百度真题
  26. Embedding 模型选型考虑哪些因素?
    百度真题
  27. RAG 向量模型怎么选?
    百度真题
  28. RAG 检索噪声 3 大策略
    字节真题
  29. RAG 深度与局限怎么破?
    美团真题
  30. RAG 检索与生成流程详解
    字节真题
  31. Agent 系统怎么调优优化?
    快手真题
  32. 大模型输出JSON怎么保正确?
    字节真题
  33. LLM 标签约束解码
  34. Prompt Engineering 关键原则有哪些?
    百度真题
  35. SFT vs RAG 知识更新
  36. RAG检索相关但生成差原因
  37. LLM 封闭标签如何强约束?
  38. 生成质量差怎么调优?
  39. 生成模型回答不准怎么调?
  40. 怎么提升对话模型事实一致性?
    百度真题
  41. 大模型准确性瓶颈在哪?
    百度真题
  42. 动态Prompt训练数据怎么构建?
    字节真题
  43. RAG 基本工作流程是什么?
    商汤科技真题
  44. RAG 解决了哪些核心问题?
    美团真题
  45. 什么是微调(SFT)?和预训练有什么区别?
  46. LoRA 是什么?为什么能省这么多资源?
  47. 全量微调和 LoRA 微调怎么选?

模型训练(43题)

  1. DDPM vs Flow Matching: 采样效率与优缺点?
    百度真题
  2. SFT 置信度下降影响
    网易真题
  3. PyTorch 动态图怎么自动微分?
    阿里真题
  4. Focal Loss 公式与作用机制
    商汤科技真题
  5. 训练数据清洗:规则 vs LLM
    美团真题
  6. LoRA 低秩分解 vs 全量微调怎么选?
    海尔真题
  7. 参数量增长如何影响模型能力?
    高德真题
  8. 二分类交叉熵损失函数怎么推导?
    OPPO真题
  9. MSE 损失函数怎么用?
    OPPO真题
  10. 训练曲线异常怎么排查?
    美团真题
  11. Prompt vs Seq2Seq,怎么转?
    字节真题
  12. 批量文本清洗如何自动质检?
    美团真题
  13. 合成数据怎么系统构建?
    美团真题
  14. SFT vs 预训练:核心区别在哪?
    字节真题
  15. LoRA 微调效果差怎么排查?
    得物真题
  16. LoRA 有哪些局限性?
    得物真题
  17. MSE vs 交叉熵损失怎么选?
    字节真题
  18. MSE vs Focal Loss 分类怎么选?
    字节真题
  19. 模型收敛怎么判断?
    阿里真题
  20. SFT 过拟合怎么判断和缓解?
    阿里真题
  21. SFT 后置信度下降怎么办?
    网易真题
  22. SFT 后置信度下降原因
    网易真题
  23. 大模型微调方法怎么选?
    安克科技真题
  24. SFT prompt 模板设计原则与结构
    阿里真题
  25. 模型收敛必须用验证集吗?
    阿里真题
  26. SFT 硬件资源怎么配?
    阿里真题
  27. SFT 复读机问题怎么解?
    字节真题
  28. LLM 训练哪步最难?
    美团真题
  29. 图像数据超参数怎么调?
    美团真题
  30. Flow Matching 线性目标速度
    百度真题
  31. LlamaFactory 怎么构造训练数据?
    阶跃星辰真题
  32. 无标注数据怎么构建高质量数据集?
    美团真题
  33. 数据难度分层怎么验证?
    字节真题
  34. LoRA 低秩分解的数学原理是什么?
    百度真题
  35. SFT 人工标注数据怎么构建?
    美团真题
  36. 重参数化技巧怎么解决梯度问题?
    百度真题
  37. 训练数据怎么采集和预处理?
    百度真题
  38. 全参数 vs 参数高效微调怎么选?
    得物真题
  39. KL散度本质与非对称性怎么用?
    字节真题
  40. GLoRA 比传统 LoRA 强在哪?
    美团真题
  41. CPT 后灾难性遗忘怎么防?
    字节真题
  42. DDPM 为什么不先加噪再端到端去噪?
    百度真题
  43. CPT数据清洗与时间序列一致性
    字节真题

知识图谱(35题)

  1. LLM 事实准确性怎么保证?
    澜舟真题
  2. 医疗法律 RAG 合规追溯
    字节真题
  3. GraphRAG 原理与构建方法
    字节真题
  4. 知识图谱更新:增量 vs 流式
    高德真题
  5. GraphRAG原理 vs 传统RAG 怎么选?
    字节真题
  6. GraphRAG 增量更新怎么保实时?
    淘天真题
  7. GraphRAG 最大技术挑战?
    淘天真题
  8. GraphRAG 怎么实现复杂查询?
    字节真题
  9. GraphRAG vs 传统 RAG 优势在哪?
    百度真题
  10. GraphRAG 架构原理与优势
    美团真题
  11. 伪多模态与原生多模态差在哪?
    淘天真题
  12. GraphRAG 技术难点有哪些?
    淘天真题
  13. GraphRAG 增量更新策略与挑战?
    淘天真题
  14. GraphRAG 知识图谱构建有哪些挑战?
    淘天真题
  15. GraphRAG 为何召回更精准?
    百度真题
  16. GraphRAG 精准召回三大依赖
    百度真题
  17. GraphRAG适用场景 vs 传统RAG 有哪些?
    腾讯真题
  18. RAG 系统痛点怎么破?
    淘天真题
  19. GraphRAG 如何保证时效性与一致性?
    淘天真题
  20. RAG+KG Agent 动态更新机制
    字节真题
  21. 知识图谱怎么动态更新?
    字节真题
  22. 不用图数据库能做 GraphRAG 吗?
    百度真题
  23. GraphRAG 必须用图数据库吗?
    百度真题
  24. GraphRAG创新点 vs 传统RAG 是什么?
    美团真题
  25. RAG 技术原理和实现流程
    字节真题
  26. GraphRAG 怎么提升检索质量?
    字节真题
  27. GraphRAG 怎么提升检索效果?
    字节真题
  28. 知识图谱更新怎么保证实时性与一致性?
    高德真题
  29. 知识图谱实时性怎么保证?
    高德真题
  30. GraphRAG 原理与实现方法
    字节真题
  31. GraphRAG 工作原理是什么?
    淘天真题
  32. 向量索引 vs 分层存储怎么选?
    字节真题
  33. 向量库 vs 知识库 vs 符号记忆?
    字节真题
  34. 数据/架构/推理/工具怎么选?
    海尔真题
  35. 训练/推理/外部知识怎么选?
    海尔真题

多模态(34题)

  1. 多模态大模型面临哪些挑战?
    小红书真题
  2. 扩散模型 SNR 怎么用?
    百度真题
  3. 多模态大模型有哪些技术挑战?
    小红书真题
  4. 固定间隔vs关键帧怎么选?
    快手真题
  5. 主流生成式模型有哪些?
    小红书真题
  6. 均匀采样vs关键帧如何影响模型?
    快手真题
  7. 高噪 vs 低噪专家怎么划分?
    百度真题
  8. 多模态异构数据怎么统一存储?
    得物真题
  9. 视频切帧方法怎么选?
    快手真题
  10. 视频切帧优化:语义+动态采样
    快手真题
  11. 多模态 vs 纯文本大模型怎么选?
    快手真题
  12. MoE 专家网络怎么动态路由?
    百度真题
  13. ViT 图像块嵌入原理与实现
    百度真题
  14. 多模态大模型怎么理解?
    得物真题
  15. 多模态架构与训练怎么改进?
    快手真题
  16. 多模态大模型网络结构怎么搭?
    得物真题
  17. VLM 基本原理怎么理解?
    京东真题
  18. 多模态融合与对齐怎么改进?
    快手真题
  19. Stable Diffusion 各版本怎么选?
    小红书真题
  20. Multi-modal RAG 原理与挑战
    阿里真题
  21. AI Agent 自主智能体实现陷阱
    美团真题
  22. 截图界面怎么用 RAG 解析?
    字节真题
  23. 多模态 RAG 与传统 RAG 差异在哪?
    快手真题
  24. 弱多模态+强文本模型怎么协同?
    美团真题
  25. 多模态 RAG 架构设计
    淘天真题
  26. 截图 RAG 怎么理解界面组件?
    淘天真题
  27. 截图组件功能怎么用 RAG 解释?
    淘天真题
  28. 多模态 RAG 实现方案
    淘天真题
  29. 伪 vs 真多模态 RAG 优劣在哪?
    淘天真题
  30. Multi-modal RAG 是什么?
    阿里真题
  31. RAG 中表格图片怎么处理?
    小鹏真题
  32. Agent 优势与局限怎么分析?
    字节真题
  33. RAG意图识别原理与检索协同
    哔哩哔哩真题
  34. Agent 发展路径分哪几个阶段?
    美团真题

项目与经历(31题)

  1. 大模型任务表现差怎么排查?
    字节真题
  2. 项目局限性与改进方向
    商汤科技真题
  3. 实习项目怎么介绍最加分?
    商汤科技真题
  4. ML项目流程:特征工程到评估
    OPPO真题
  5. 深度学习项目怎么介绍?
    OPPO真题
  6. Agent 商业落地评估框架
    美团真题
  7. 客服办公导购 Agent 选型
    美团真题
  8. 实习项目被追问哪些技术细节?
    百度真题
  9. 技术项目怎么讲给非技术人?
    京东真题
  10. 项目难题怎么定位与解决?
    美团真题
  11. 信息抽取:规则 vs LLM
    美团真题
  12. 大模型 vs 规则引擎怎么选?
    百度真题
  13. 验证集分布:以部署目标为准
    字节真题
  14. Coding/GUI/Search 商业化先后
    美团真题
  15. 面试反问怎么问才加分?
    京东真题
  16. 扫描PDF怎么解析内容?
    360真题
  17. 成就感经历 STAR 回答
    京东真题
  18. Agent 哪项能力最先商业化?
    美团真题
  19. Agent 未来规模化方向
    美团真题
  20. 数据预处理关键步骤与目的
    商汤科技真题
  21. 实习项目业务场景怎么讲?
    商汤科技真题
  22. 大规模数据清洗自动化关键步骤
    美团真题
  23. 大模型项目缺陷修复
    商汤科技真题
  24. 训练数据来源怎么选?
    百度真题
  25. 普通经历如何讲成就感
    京东真题
  26. LLM 应用场景价值怎么分析?
    阿里真题
  27. 技术项目怎么讲出亮点?
    美团真题
  28. 面试反问环节怎么准备?
    美团真题
  29. 自我介绍怎么突出大模型?
    美团、小红书真题
  30. 大模型 vs 搜推小样本特征怎么融合?
    字节真题
  31. 运筹学最优化 vs 机器学习最优化
    OPPO真题

文档处理(29题)

  1. 长文档 Chunking 怎么选?
    字节真题
  2. 文本块怎么转向量并建索引?
    字节真题
  3. Chunking 策略怎么选?
    百度真题
  4. RAG 向量索引构建流程详解
    字节真题
  5. RAG 数据处理与索引流程?
    字节真题
  6. Chunk 向量化与索引怎么选?
    字节真题
  7. Embedding+向量库怎么做语义匹配?
    字节真题
  8. RAG 文本分块与向量索引流程
    字节真题
  9. RAG ANN 索引优化
    百度真题
  10. Chunking 策略怎么平衡上下文与精度?
    京东真题
  11. RAG 长文档怎么切块?
    字节真题
  12. RAG 数据清洗与 Chunking 怎么选?
    字节真题
  13. Embedding 模型选型 vs 落地流程?
    字节真题
  14. RAG 知识库搭建流程?
    美团真题
  15. RAG知识库构建流程详解
    美团真题
  16. 医学论文与法律条文切块
    字节真题
  17. 医疗法律文档切块
    字节真题
  18. 专业领域文档怎么清洗?
    字节真题
  19. RAG 文档 Chunk 划分策略怎么选?
    腾讯真题
  20. RAG 分块策略选型
    京东真题
  21. RAG分块策略:粒度、重叠与写入
    蔚来真题
  22. RAG 分块参数调优
    百度真题
  23. 分块策略怎么影响检索?
    百度真题
  24. 常用分块方法有哪些?
    百度真题
  25. RAG 分块长度与重叠如何取舍?
    小鹏真题
  26. RAG向量化流程:预处理到归一化
    安克科技真题
  27. RAG向量化:分块与Embedding
    安克科技真题
  28. RAG 文档怎么存储和向量化?
    安克科技真题
  29. RAG文本向量化:分块与嵌入陷阱
    安克科技真题

RLHF 与对齐(27题)

  1. PPO vs DPO vs GRPO 怎么选?
    京东真题
  2. DPO vs PPO 怎么选?
    阿里真题
  3. Reward 函数设计关键因素?
    美团真题
  4. 长周期 Agent 如何建模与规划?
    美团真题
  5. 奖励函数设计与投机陷阱
    美团真题
  6. 长视野任务的信用分配与 Option
    美团真题
  7. Agent 奖励如何对齐目标并防作弊?
    美团真题
  8. 长视界任务怎么结合环境训练?
    美团真题
  9. 稀疏与延迟奖励的塑形与权衡
    美团真题
  10. RL 训练环境与 Sim2Real
    美团真题
  11. Agent 工具调用奖励设计
    美团真题
  12. 环境训练 vs 监督学习怎么选?
    美团真题
  13. PPO vs GRPO 怎么选?
    字节真题
  14. GSPO 与 SFT、PPO、GRPO 区别
    美团真题
  15. 环境训练方法怎么选?
    美团真题
  16. 模拟器与 World Model 的偏差和迁移
    美团真题
  17. RLHF 中 Reference Model 不训练?
    虾皮真题
  18. Environment-based 训练怎么用?
    美团真题
  19. GSPO 序列级比率与裁剪
    美团真题
  20. Reward Model 训练流程详解
    网易真题
  21. TRL Agent 组件交互机制
    阶跃星辰真题
  22. On-policy、Off-policy 与 DPO 怎么选?
    网易真题
  23. PPO vs GRPO vs DPO 适用场景?
    快手真题
  24. PPO vs GRPO vs DPO 原理区别?
    快手真题
  25. Agent 工具调用训练数据怎么构建?
    阶跃星辰真题
  26. SFT、偏好优化与 RL 怎么衔接?
    网易真题
  27. Long Horizon 训练环境怎么搭?
    美团真题

推理优化(23题)

  1. Flash Attention 原理怎么理解?
  2. 模型优化方法有哪些?
    百度真题
  3. vLLM vs TensorRT-LLM 怎么选?
    京东真题
  4. LLM 推理框架综合选型
    京东真题
  5. 13B模型INT8/INT4量化后多大?
    百度真题
  6. 推理框架硬件支持对比
    京东真题
  7. FAISS 怎么实现高效 ANN 搜索?
    字节真题
  8. 超长上下文怎么处理?
    得物真题
  9. PyTorch 计算图怎么支持自动微分?
    阿里真题
  10. MoE 怎么增强 Agent 能力?
    美团真题
  11. 可视化怎么诊断训练问题?
    美团真题
  12. 数据分层为何不用大模型?
    字节真题
  13. 视频切帧怎么平衡效率与信息?
    快手真题
  14. 工程化核心目标是什么?
    商汤科技真题
  15. VecEnv 怎么加速强化学习训练?
    美团真题
  16. 显存优化技术原理与对比
    海尔真题
  17. KV-Cache 空间复杂度怎么算?
    字节真题
  18. DeepSpeed 核心特性与架构怎么用?
    京东真题
  19. ZeRO 与 FlashAttention 各优化什么?
    字节真题
  20. 视频生成加速有哪些方法?
    百度真题
  21. LoRA 微调比全量微调更慢吗?
    百度真题
  22. Hive SQL 熟练度评估指标
    OPPO真题
  23. KV Cache 是什么?为什么能加速推理?