美团大模型面试题(125题)
美团大模型面试题共 125 道,覆盖评估与监控 18 题、Agent 17 题、RLHF 与对齐 16 题、向量检索 11 题,含书面答案、口语版讲法与不同面试官问法。大模型落地工程为主,Agent 与评估监控题量大
大模型落地工程为主,Agent 与评估监控题量大
高频方向
难度分布
基础 3 题、中等 81 题、进阶 41 题
美团代表题目
- Reward 函数设计关键因素?
RLHF 与对齐 · 进阶 - 长周期 Agent 如何建模与规划?
RLHF 与对齐 · 进阶 - Transformer 为何用 Layer Norm?
模型架构 · 中等 - 奖励函数设计与投机陷阱
RLHF 与对齐 · 中等 - 长视野任务的信用分配与 Option
RLHF 与对齐 · 进阶 - LayerNorm vs BatchNorm 怎么选?
模型架构 · 中等 - Agent 奖励如何对齐目标并防作弊?
RLHF 与对齐 · 中等 - 长视界任务怎么结合环境训练?
RLHF 与对齐 · 进阶 - 训练数据清洗:规则 vs LLM
模型训练 · 中等 - 训练曲线异常怎么排查?
模型训练 · 中等 - MoE 怎么提升 Agent 能力?
模型架构 · 中等 - 稀疏与延迟奖励的塑形与权衡
RLHF 与对齐 · 中等 - RL 训练环境与 Sim2Real
RLHF 与对齐 · 进阶 - Transformer 为何用 LayerNorm 而非 BatchNorm?
模型架构 · 中等 - 批量文本清洗如何自动质检?
模型训练 · 中等 - Agent 商业落地评估框架
项目与经历 · 中等 - 客服办公导购 Agent 选型
项目与经历 · 中等 - 合成数据怎么系统构建?
模型训练 · 中等 - 项目难题怎么定位与解决?
项目与经历 · 中等 - 信息抽取:规则 vs LLM
项目与经历 · 中等 - Agent 工具调用奖励设计
RLHF 与对齐 · 中等 - Coding/GUI/Search 商业化先后
项目与经历 · 中等 - 环境训练 vs 监督学习怎么选?
RLHF 与对齐 · 中等 - LLM 训练哪步最难?
模型训练 · 中等 - GSPO 与 SFT、PPO、GRPO 区别
RLHF 与对齐 · 进阶 - Agent 哪项能力最先商业化?
项目与经历 · 中等 - 环境训练方法怎么选?
RLHF 与对齐 · 中等 - 模拟器与 World Model 的偏差和迁移
RLHF 与对齐 · 进阶 - Agent 未来规模化方向
项目与经历 · 中等 - 图像数据超参数怎么调?
模型训练 · 中等 - 大规模数据清洗自动化关键步骤
项目与经历 · 中等 - MoE 怎么增强 Agent 能力?
推理优化 · 进阶 - 可视化怎么诊断训练问题?
推理优化 · 中等 - Environment-based 训练怎么用?
RLHF 与对齐 · 中等 - 无标注数据怎么构建高质量数据集?
模型训练 · 进阶 - VecEnv 怎么加速强化学习训练?
推理优化 · 中等 - GSPO 序列级比率与裁剪
RLHF 与对齐 · 进阶 - Transformer 架构核心组件原理
模型架构 · 中等 - 技术项目怎么讲出亮点?
项目与经历 · 中等 - SFT 人工标注数据怎么构建?
模型训练 · 进阶 - 多头注意力原理与QKV拆分陷阱
模型架构 · 中等 - 面试反问环节怎么准备?
项目与经历 · 基础 - GLoRA 比传统 LoRA 强在哪?
模型训练 · 中等 - Long Horizon 训练环境怎么搭?
RLHF 与对齐 · 进阶 - 多智能体系统核心技术难点
Agent · 进阶 - 多轮 Agent RL 难在哪?
Agent · 进阶 - Agent 强化学习怎么训练?
Agent · 进阶 - ReAct vs Plan-and-Execute 怎么选?
Agent · 进阶 - ReAct与Plan-and-Execute 上下文管理差异?
Agent · 进阶 - ReAct vs Plan-and-Execute 推理效率对比?
Agent · 进阶 - 大模型输出怎么做真实性验证?
Agent · 进阶 - Function Calling 怎么解析用户指令?
Agent · 中等 - DeepResearch Agent 怎么工作?
Agent · 中等 - Agent 主流架构怎么选?
Agent · 中等 - Agent 必备基础能力有哪些?
Agent · 中等 - 哪类 Agent 最易大规模落地?
Agent · 中等 - 工具 Agent 训练环境设计
Agent · 中等 - Agent工具系统:注册与权限控制
Agent · 中等 - Agent工具接口与错误处理
Agent · 中等 - Agent组件通信机制与架构模式对比
Agent · 中等 - Agent工具定义、注册与安全控制有哪些?
Agent · 中等 - RAG 知识库搭建流程?
文档处理 · 进阶 - RAG知识库构建流程详解
文档处理 · 进阶 - Agent 训练链路怎么搭建?
评估与监控 · 进阶 - Agent 训练 vs RAG 怎么选?
评估与监控 · 进阶 - RAG 工作原理与局限怎么分析?
评估与监控 · 中等 - 多路召回评估指标与RAG场景
评估与监控 · 进阶 - RAG 指标权衡与阈值
评估与监控 · 进阶 - RAG 缓解幻觉的机制
评估与监控 · 进阶 - RAG 仍会幻觉的原因
评估与监控 · 进阶 - LLM 幻觉治理方法对比
评估与监控 · 进阶 - 召回阶段怎么评估质量?
评估与监控 · 进阶 - RAG 解决了哪些问题?
评估与监控 · 中等 - ReAct vs Plan-and-Execute 错误恢复谁强?
评估与监控 · 中等 - Agent 哪个方向最易落地?
评估与监控 · 中等 - Agent 基础能力怎么定义?
评估与监控 · 中等 - Agent 外部工具怎么封装?
评估与监控 · 中等 - Agent三大能力评估陷阱
评估与监控 · 中等 - Coding vs GUI vs Search 谁先落地?
评估与监控 · 中等 - Agent 功能模块怎么分工?
评估与监控 · 中等