LLM INTERVIEW QUESTION BANK

大模型面试题,
一道一道讲明白。

覆盖模型原理、训练对齐、RAG、Agent、推理部署、评测安全、数学编程与项目行为面。每题包含答题提示、参考说法和常见追问。

232 道当前可见题目
47 道核心必会 · 185 道岗位专项 · 232 道已有解答
一个题库 · 两种可见性

全部题目

公开题所有人都能看到;标有“私人”的题只保存在当前浏览器。选择公开并保存后,题目会立即出现在这里。

+ 增加题目

私人题只在当前浏览器显示。

正在读取大家直接发布的公开题目…

001
训练与对齐 中等 岗位专项 ✓ 资料核验

Xavier 与 He 初始化分别基于什么方差推导,应该如何选择?

Xavier InitializationHe Initialization训练稳定性
002
NLP 与机器学习 简单 岗位专项 ✓ 资料核验

CBOW、Skip-gram 与 Negative Sampling 有什么区别?

Word2VecCBOWNegative Sampling
003
预训练与数据 简单 岗位专项 ✓ 资料核验

网页预训练数据如何做质量过滤而不过度损失多样性?

Web 数据质量过滤数据偏差
004
多模态 困难 岗位专项 ✓ 资料核验

VLM 如何用坐标 Token 实现短语定位与视觉 Grounding?

Visual GroundingCoordinate TokenVLM
005
多模态 困难 岗位专项 ✓ 资料核验

VLM 为什么会产生对象幻觉,POPE 如何评估?

VLM HallucinationPOPEFaithfulness
006
工程实践 中等 岗位专项 ✓ 资料核验

vLLM 与 SGLang 的设计侧重点有什么不同,应该如何选择?

vLLMSGLang推理框架
007
多模态 简单 岗位专项 ✓ 资料核验

Vision Encoder 与 LLM 之间为什么通常需要 Projector?

ProjectorVision EncoderVLM
008
NLP 与机器学习 中等 岗位专项 ✓ 资料核验

梯度消失和爆炸为什么发生,如何诊断与缓解?

梯度初始化残差连接
009
LLM 基础 简单 岗位专项 ✓ 资料核验

Transformer 为什么比 RNN 更适合训练大模型?

TransformerRNN并行计算
010
LLM 基础 中等 岗位专项 ✓ 资料核验

如何手算 Transformer 参数量与训练 FLOPs?

参数量FLOPsTransformer
011
训练与对齐 困难 岗位专项 ✓ 资料核验

数据并行、张量并行和流水线并行如何组成 3D 并行?

数据并行张量并行流水线并行3D Parallelism
012
训练与对齐 困难 岗位专项 ✓ 资料核验

大模型训练出现 Loss 为 NaN,应该如何排查?

NaN训练稳定性调试
013
训练工程 中等 岗位专项 ✓ 资料核验

MFU、HFU 与 Tokens/s 应如何衡量训练效率?

MFUHFU训练性能
014
训练与对齐 困难 岗位专项 ✓ 资料核验

如何估算大模型训练显存,Gradient Checkpointing 省了什么?

训练显存AdamWGradient Checkpointing
015
系统设计 困难 岗位专项 ✓ 资料核验

GPU 集群如何做拓扑感知调度并减少资源碎片?

GPU 调度拓扑感知资源碎片
016
推理与部署 简单 岗位专项 ✓ 资料核验

流式生成如何处理背压、断连和请求取消?

流式输出背压SSE
017
LLM 基础 中等 岗位专项 ✓ 资料核验

Teacher Forcing 是什么,为什么会产生 Exposure Bias?

Teacher ForcingExposure Bias自回归生成
018
数学基础 中等 岗位专项 ✓ 资料核验

SVD 如何得到最佳低秩近似,它与大模型低秩压缩有什么关系?

SVD低秩近似矩阵分解
019
NLP 与机器学习 简单 岗位专项 ✓ 资料核验

静态词向量和上下文表示有什么区别?

Embedding上下文表示BERT
020
训练与对齐 中等 岗位专项 ✓ 资料核验

Softmax 与 LogSumExp 如何避免数值溢出?

SoftmaxLogSumExp数值稳定性
021
LLM 基础 困难 岗位专项 ✓ 资料核验

语言模型的 Softmax Bottleneck 是什么?

Softmax Bottleneck矩阵秩LM Head
022
LLM 基础 中等 岗位专项 ✓ 资料核验

滑动窗口注意力与全局注意力如何降低长序列复杂度?

Sliding Window AttentionGlobal Attention长上下文
023
训练与对齐 中等 岗位专项 ✓ 资料核验

SimPO 如何在没有 Reference Model 时做偏好优化?

SimPOReference-free偏好优化
024
NLP 与机器学习 困难 岗位专项 ✓ 资料核验

SimCSE 如何用对比学习训练句向量?

SimCSE对比学习Sentence Embedding
025
多模态 困难 岗位专项 ✓ 资料核验

SigLIP 与 CLIP 的损失函数有什么区别?

SigLIPCLIPSigmoid Loss
026
训练与对齐 困难 岗位专项 ✓ 资料核验

SFT 模型不收敛时应该如何定位问题?

SFTChat TemplateLoss Mask
027
预训练与数据 中等 岗位专项 ✓ 资料核验

Sequence Packing 如何用 Block-diagonal Mask 提速并避免样本污染?

Sequence PackingAttention Mask训练吞吐
028
NLP 与机器学习 中等 岗位专项 ✓ 资料核验

句向量的 CLS、Mean Pooling 和加权池化如何选择?

Sentence EmbeddingPoolingCLS
029
预训练与数据 简单 岗位专项 ✓ 资料核验

Self-Instruct 如何生成、筛选并迭代合成指令数据?

Self-Instruct合成数据指令微调
030
LLM 基础 困难 核心必会 ✓ 资料核验

RoPE 如何表示相对位置,为什么会遇到长上下文外推问题?

RoPE位置编码长上下文
031
训练工程 简单 岗位专项 ✓ 资料核验

如何让大模型训练尽可能可复现?

可复现性随机种子确定性
032
预训练与数据 困难 岗位专项 ✓ 资料核验

高质量数据有限时,重复训练多少轮才合理?

数据重复Scaling Laws预训练
033
评测与安全 中等 岗位专项 ✓ 资料核验

安全模型如何平衡拒答与过度拒答,XSTest 评测什么?

RefusalOverrefusalXSTest
034
RAG 困难 岗位专项 ✓ 资料核验

Self-RAG 与 CRAG 如何让检索链路具备自反思和纠错能力?

Self-RAGCRAG自反思
035
RAG 困难 岗位专项 ✓ 资料核验

RAPTOR 如何构建层次化 RAG,什么时候比平铺 Chunk 检索更合适?

RAPTOR层次检索摘要树
036
RAG 中等 岗位专项 ✓ 资料核验

RAG 中 Query Rewrite 与 HyDE 分别解决什么问题,如何选择?

Query RewriteHyDE查询变换
037
系统设计 中等 岗位专项 ✓ 资料核验

项目复盘:RAG 上线后答案质量下降,应该如何定位?

项目复盘RAG故障定位
038
RAG 中等 岗位专项 ✓ 资料核验

向量检索中的 Metadata Filter 应该前置、后置还是迭代执行?

Metadata FilterANN权限过滤
039
RAG 困难 岗位专项 ✓ 资料核验

ColBERT 的 Late Interaction 为什么兼顾检索效果与效率?

ColBERTLate InteractionMaxSim
040
RAG 困难 岗位专项 ✓ 资料核验

GraphRAG 为什么要构建社区摘要,适合解决什么问题?

GraphRAG知识图谱社区摘要
041
RAG 中等 岗位专项 ✓ 资料核验

Embedding 模型升级时,如何重建索引、双写并无损切换?

Embedding索引迁移双写
042
RAG 中等 岗位专项 ✓ 资料核验

RAG 文档入库时如何处理 PDF 版面、表格、页眉页脚与 OCR?

文档解析OCR表格
043
RAG 困难 岗位专项 ✓ 资料核验

RAG 如何在 Token 预算内打包证据,证据顺序为什么重要?

Context PackingLost in the Middle证据排序
044
多模态 困难 岗位专项 ✓ 资料核验

Q-Former 如何用 Learnable Query 压缩视觉信息?

Q-FormerBLIP-2Visual Token Compression
045
LLM 基础 中等 核心必会 ✓ 资料核验

从输入 Prompt 到生成第一个 Token,模型内部经历了什么?

TransformerPrefill自回归生成
046
工程实践 困难 岗位专项 ✓ 资料核验

Prompt Compression 如何减少 Token 又尽量保留指令和证据?

Prompt CompressionToken 预算LLMLingua
047
训练与对齐 中等 岗位专项 ✓ 资料核验

过程监督与结果监督有什么区别?

Process SupervisionReward Model推理
048
预训练与数据 困难 岗位专项 ✓ 资料核验

DoReMi 如何自动优化预训练领域配比?

DoReMi数据配比Group DRO
049
预训练与数据 中等 岗位专项 ✓ 资料核验

万亿 Token 预训练语料如何做精确与近似去重?

预训练数据MinHash去重
050
推理与部署 中等 岗位专项 ✓ 资料核验

Prefix KV Cache 如何复用公共前缀并保证租户隔离?

Prefix CacheKV Cache多租户
051
工程实践 中等 岗位专项 ✓ 资料核验

Prefill 与 Decode 的计算和访存特征有什么不同?

S级必答PrefillDecode
052
推理与部署 困难 岗位专项 ✓ 资料核验

Prefill/Decode 分离部署如何设计与扩缩容?

Prefill Decode 分离Goodput分布式推理
053
训练与对齐 困难 岗位专项 ✓ 资料核验

强化对齐中策略熵为什么会下降,如何识别与缓解模式坍缩?

Policy Entropy模式坍缩RLHF
054
训练工程 困难 岗位专项 ✓ 资料核验

GPipe、1F1B 与交错流水线如何影响 Bubble?

Pipeline Parallel1F1BBubble
055
评测与安全 困难 岗位专项 ✓ 资料核验

两个模型效果接近时,如何做成对评测与显著性检验?

显著性检验Bootstrap成对评测
056
工程实践 困难 岗位专项 ✓ 资料核验

PagedAttention 如何管理 KV Cache,它解决了什么问题?

S级必答PagedAttentionKV Cache
057
训练与对齐 中等 岗位专项 ✓ 资料核验

ORPO 如何把 SFT 与偏好优化合并为一个阶段?

ORPOOdds Ratio偏好优化
058
系统设计 中等 岗位专项 ✓ 资料核验

如何设计可恢复、可去重的大模型离线批量推理系统?

Batch Inference幂等Kubernetes Job
059
训练工程 困难 岗位专项 ✓ 资料核验

NCCL 集合通信超时或 Hang 应如何排查?

NCCLCollective分布式排障
060
LLM 基础 困难 岗位专项 ✓ 资料核验

μP 为什么能把小模型超参数迁移到大模型?

μP超参数迁移参数化
061
评测与安全 困难 岗位专项 ✓ 资料核验

恶意图片如何劫持 VLM 指令,视觉 Prompt Injection 怎样防御?

Visual Prompt InjectionImage HijackVLM Security
062
多模态 中等 岗位专项 ✓ 资料核验

多模态大模型通常分哪些阶段训练?

多模态训练视觉语言对齐指令微调
063
多模态 困难 岗位专项 ✓ 资料核验

Chameleon 式离散早融合如何把图像与文本统一成 Token 序列?

Early FusionDiscrete Image TokenMultimodal Generation
064
NLP 与机器学习 困难 岗位专项 ✓ 资料核验

多语言 Embedding 如何对齐不同语言的语义空间?

多语言Embedding对比学习
065
系统设计 困难 岗位专项 ✓ 资料核验

多模型共享 GPU 时如何管理加载、驻留与淘汰?

Multi-model ServingGPU Residency模型淘汰
066
推理与部署 困难 岗位专项 ✓ 资料核验

S-LoRA 如何用分页 Adapter 内存高效服务数百个 LoRA?

LoRA Serving多租户调度
067
多模态 困难 岗位专项 ✓ 资料核验

多图与视频输入相比单图 VLM 增加了哪些困难?

Multi-ImageVideo VLMTemporal Modeling
068
LLM 基础 困难 岗位专项 ✓ 资料核验

MoE 中 Shared Expert 与 Routed Expert 有什么区别?

MoEShared ExpertExpert Parallel
069
推理与部署 困难 岗位专项 ✓ 资料核验

MoE 推理中的 Expert Parallel 如何工作,为什么容易被 All-to-All 和热点专家拖慢?

MoEExpert ParallelAll-to-All
070
评测与安全 中等 岗位专项 ✓ 资料核验

模型权重、Tokenizer 与 Adapter 的供应链风险如何治理?

Supply ChainSafetensorsArtifact Security
071
数学基础 中等 岗位专项 ✓ 资料核验

最大似然估计 MLE 与最大后验估计 MAP 有什么区别?

MLEMAP贝叶斯
072
工程实践 中等 岗位专项 ✓ 资料核验

为什么 max_model_len 越大,可用并发可能越低?

vLLM长上下文并发
073
NLP 与机器学习 困难 岗位专项 ✓ 资料核验

Matryoshka Embedding 如何支持可变向量维度?

Matryoshka Embedding向量维度表示学习
074
训练与对齐 中等 岗位专项 ✓ 资料核验

LoRA 应该挂在哪些 Target Modules?

LoRATarget ModulesAttention
075
训练与对齐 中等 岗位专项 ✓ 资料核验

LoRA 的 Rank 和 Alpha 如何影响容量与更新尺度?

LoRARankAlpha
076
训练与对齐 困难 核心必会 ✓ 资料核验

LoRA、QLoRA 与全参数微调应该如何选择?

LoRAQLoRANF4
077
训练与对齐 中等 核心必会 ✓ 资料核验

LoRA 的低秩更新原理是什么,为什么一个矩阵常零初始化?

LoRA低秩微调参数高效微调
078
评测与安全 中等 岗位专项 ✓ 资料核验

为什么标称上下文长度不等于有效上下文长度,RULER 如何评测?

Long ContextRULEREvaluation
079
评测与安全 困难 岗位专项 ✓ 资料核验

大模型为什么会记忆并泄露训练数据,如何评估提取风险?

MemorizationData ExtractionPrivacy
080
推理与部署 中等 岗位专项 ✓ 资料核验

Tokenizer 为什么会成为大模型服务的 CPU 瓶颈,如何优化?

TokenizerCPU性能优化
081
系统设计 中等 岗位专项 ✓ 资料核验

如何为 LLM 服务定义 SLO、错误预算与过载策略?

SLO错误预算过载保护
082
推理与部署 中等 岗位专项 ✓ 资料核验

大模型服务为什么会冷启动,怎样设计加载、预热与就绪检查?

Cold StartWarmupReadiness
083
推理与部署 中等 岗位专项 ✓ 资料核验

如何设计可信的 LLM Serving 压测并计算 Goodput?

压测GoodputSLO
084
评测与安全 困难 岗位专项 ✓ 资料核验

如何按风险等级设计大模型发布门禁?

风险分级发布门禁治理
085
系统设计 困难 岗位专项 ✓ 资料核验

线上缺少即时标签时如何监控模型质量漂移?

质量漂移模型监控延迟标签
086
评测与安全 困难 核心必会 ✓ 资料核验

生产大模型应用如何防止 PII 泄露?

PII隐私数据最小化
087
系统设计 困难 核心必会 ✓ 资料核验

大模型上线如何设计 A/B 测试并避免护栏指标退化?

A/B 测试在线评测灰度发布
088
系统设计 困难 岗位专项 ✓ 资料核验

项目复盘:模型升级后 P99 延迟翻倍,应该如何排查?

项目复盘延迟性能分析
089
评测与安全 中等 核心必会 ✓ 资料核验

LLM-as-a-Judge 有哪些位置、长度和自增强偏差,如何校准?

LLM JudgeBiasCalibration
090
评测与安全 困难 岗位专项 ✓ 资料核验

如何系统评估越狱攻击,并建立分层防御而不是只靠系统提示词?

JailbreakRed TeamDefense in Depth
091
系统设计 中等 岗位专项 ✓ 资料核验

大模型线上事故如何止损、定位、复盘与演练?

Incident ResponseRunbookGame Day
092
评测与安全 困难 岗位专项 ✓ 资料核验

如何评测大模型的群体偏见与公平性?

公平性偏见评测切片分析
093
系统设计 困难 岗位专项 ✓ 资料核验

如何设计一个可复现的大模型评测平台?

评测平台可复现系统设计
094
评测与安全 中等 核心必会 ✓ 资料核验

如何设计能代表真实流量的 LLM 离线评测集?

评测集数据切片置信区间
095
系统设计 中等 岗位专项 ✓ 资料核验

项目案例题:如何讲清一次质量不降、成本下降的优化?

项目案例成本优化模型路由
096
评测与安全 困难 岗位专项 ✓ 资料核验

如何评估大模型置信度、校准误差与选择性回答能力?

CalibrationUncertaintyAbstention
097
系统设计 中等 岗位专项 ✓ 资料核验

大模型 API 网关如何按 Token 做限流、配额、预留与用量结算?

API GatewayToken QuotaRate Limiting
098
NLP 与机器学习 中等 岗位专项 ✓ 资料核验

为什么大模型训练常用 Warmup,常见学习率调度如何选择?

Warmup学习率优化
099
训练与对齐 中等 岗位专项 ✓ 资料核验

Label Smoothing 如何修改训练目标,为什么可能改善泛化却损害校准或蒸馏?

Label Smoothing交叉熵校准
100
推理与部署 困难 岗位专项 ✓ 资料核验

KV Cache 量化与 CPU/NVMe Offload 应如何取舍?

KV Cache量化Offload
101
训练与对齐 困难 岗位专项 ✓ 资料核验

KTO 如何用非成对的好坏反馈做偏好对齐?

KTO非成对反馈偏好对齐
102
NLP 与机器学习 中等 岗位专项 ✓ 资料核验

知识蒸馏如何用 Teacher 训练 Student,温度参数有什么作用?

知识蒸馏Teacher Student模型压缩
103
数学基础 困难 岗位专项 ✓ 资料核验

Forward KL 与 Reverse KL 有什么区别,为什么会分别表现为覆盖模式与寻找模式?

KL Divergence概率分布变分推断
104
数学基础 困难 岗位专项 ✓ 资料核验

Jacobian、Hessian 分别描述什么,为什么大模型训练很少显式构造 Hessian?

JacobianHessian二阶优化
105
LLM 基础 简单 核心必会 ✓ 资料核验

In-Context Learning 与参数微调有什么本质区别?

In-Context Learning微调Few-shot
106
NLP 与机器学习 简单 岗位专项 ✓ 资料核验

类别不平衡时 Precision、Recall、F1、ROC-AUC 与 PR-AUC 怎么选?

分类指标类别不平衡PR-AUC
107
多模态 简单 岗位专项 ✓ 资料核验

一张图片如何转换成视觉 Token?

Vision TransformerVisual TokenPatch Embedding
108
评测与安全 中等 岗位专项 ✓ 资料核验

Chatbot Arena 如何用成对偏好、Elo 或 Bradley–Terry 排名模型?

Human PreferenceEloBradley Terry
109
训练与对齐 困难 岗位专项 ✓ 资料核验

GRPO 中 πθ、πold 与 Rollout 策略分别是什么,如何同步?

GRPORollout策略陈旧
110
训练与对齐 困难 岗位专项 ✓ 资料核验

Gradient Noise Scale 与 Critical Batch Size 是什么?

Gradient Noise ScaleBatch Size分布式训练
111
训练工程 中等 岗位专项 ✓ 资料核验

梯度裁剪为什么常按 Global Norm 做,应该在训练流程的哪个位置执行?

Gradient ClippingGlobal Norm训练稳定性
112
训练工程 简单 岗位专项 ✓ 资料核验

梯度累积如何影响有效 Batch、学习率与分布式同步?

梯度累积DDP有效 Batch
113
推理与部署 中等 岗位专项 ✓ 资料核验

为什么 GPU 还有空闲显存却 OOM,如何分析分配器碎片与内存池?

GPU OOM内存碎片CUDA Allocator
114
训练与对齐 困难 岗位专项 ✓ 资料核验

PPO 中 GAE 如何估计 Advantage 并权衡偏差与方差?

GAEPPOAdvantage
115
工程实践 中等 岗位专项 ✓ 资料核验

FP8 推理与 INT8、INT4 推理有什么区别?

FP8INT8量化
116
NLP 与机器学习 中等 岗位专项 ✓ 资料核验

类别不平衡除了换指标,还可以怎样训练,Focal Loss 有什么作用?

Focal Loss类别不平衡重采样
117
LLM 基础 中等 岗位专项 ✓ 资料核验

Few-shot 示例的选择与顺序为什么会影响结果?

Few-shot示例选择Prompt
118
训练与对齐 中等 岗位专项 ✓ 资料核验

训练中维护参数 EMA 有什么作用,它与 Polyak Averaging 有何区别?

EMA参数平均优化稳定性
119
NLP 与机器学习 简单 岗位专项 ✓ 资料核验

Embedding 检索中余弦、点积和欧氏距离如何选择?

Embedding相似度向量检索
120
LLM 基础 简单 岗位专项 ✓ 资料核验

输入 Embedding 与 LM Head 为什么常共享权重?

EmbeddingLM HeadWeight Tying
121
NLP 与机器学习 困难 岗位专项 ✓ 资料核验

训练 Embedding 时如何选择 Hard Negative 而不引入假负例?

Hard NegativeEmbedding对比学习
122
NLP 与机器学习 困难 岗位专项 ✓ 资料核验

Embedding 的各向异性与 Hubness 是什么,如何诊断?

各向异性HubnessEmbedding
123
训练工程 困难 岗位专项 ✓ 资料核验

弹性分布式训练如何在 Worker 故障或扩缩容后恢复并保持状态一致?

Elastic Training容错Rendezvous
124
NLP 与机器学习 中等 岗位专项 ✓ 资料核验

Early Stopping 如何使用,为什么反复看验证集也会过拟合?

Early Stopping模型选择验证集
125
多模态 中等 岗位专项 ✓ 资料核验

Dynamic Resolution 与 AnyRes 为什么对 VLM 很重要?

Dynamic ResolutionAnyRes高分辨率
126
NLP 与机器学习 简单 岗位专项 ✓ 资料核验

Dropout 为什么能正则化,训练和推理时有何不同?

Dropout正则化训练推理
127
训练与对齐 中等 岗位专项 ✓ 资料核验

领域继续预训练与 SFT 应该如何选择和衔接?

Continued PretrainingDAPTSFT
128
多模态 中等 岗位专项 ✓ 资料核验

文档 VLM 中 OCR-first 与 OCR-free 路线如何选择?

Document VLMOCRLayout
129
训练工程 中等 岗位专项 ✓ 资料核验

分布式训练的数据加载、分片与断点续训如何设计?

DataLoader数据分片断点续训
130
训练工程 困难 岗位专项 ✓ 资料核验

分布式训练如何保存、重分片并精确恢复 Checkpoint?

Distributed Checkpoint断点续训Reshard
131
LLM 基础 困难 岗位专项 ✓ 资料核验

DeepNorm 如何让超深 Transformer 稳定训练?

DeepNorm残差连接训练稳定性
132
NLP 与机器学习 简单 核心必会 ✓ 资料核验

训练、验证、测试集如何划分,哪些做法会造成数据泄漏?

数据切分数据泄漏评测
133
推理与部署 中等 岗位专项 ✓ 资料核验

CUDA Graph、模型编译与 Kernel Fusion 分别优化什么?

CUDA Graphtorch.compileKernel Fusion
134
NLP 与机器学习 中等 岗位专项 ✓ 资料核验

交叉验证与超参数搜索如何避免选择偏差和数据泄漏?

交叉验证超参数搜索数据泄漏
135
LLM 基础 中等 核心必会 ✓ 资料核验

交叉熵、负对数似然与 Perplexity 有什么关系?

交叉熵NLLPerplexity
136
推理与部署 中等 岗位专项 ✓ 资料核验

Continuous Batching 如何在逐迭代调度中平衡 Token 预算、抢占与公平性?

Continuous Batching调度推理服务
137
训练与对齐 中等 岗位专项 ✓ 资料核验

Constitutional AI 与 RLAIF 如何减少人工偏好标注?

Constitutional AIRLAIF安全对齐
138
评测与安全 简单 岗位专项 ✓ 资料核验

代码模型的 pass@k 应该如何计算,为什么不能只看 pass@1?

Code Evaluationpass@kHumanEval
139
多模态 中等 岗位专项 ✓ 资料核验

CLIP 如何用对比学习对齐图像与文本?

CLIP对比学习图文对齐
140
推理与部署 中等 岗位专项 ✓ 资料核验

Chunked Prefill 如何兼顾 TTFT 与 TPOT?

Chunked PrefillTTFTTPOT
141
LLM 基础 中等 岗位专项 ✓ 资料核验

Chain-of-Thought 与 Self-Consistency 为什么能改善复杂推理?

Chain-of-ThoughtSelf-Consistency推理
142
推理与部署 困难 岗位专项 ✓ 资料核验

多副本推理如何在 Prefix Cache 命中与负载均衡间取舍?

Cache-aware Routing负载均衡Prefix Cache
143
NLP 与机器学习 简单 核心必会 ✓ 资料核验

偏差与方差如何解释欠拟合和过拟合?

泛化偏差方差过拟合
144
预训练与数据 中等 岗位专项 ✓ 资料核验

预训练数据如何做 Benchmark Decontamination?

Benchmark数据污染评测
145
工程实践 中等 岗位专项 ✓ 资料核验

Beam Search 为什么会有长度偏置,Length Penalty 如何处理?

Beam Search长度偏置解码
146
LLM 基础 中等 岗位专项 ✓ 资料核验

BatchNorm 与 LayerNorm 的归一化维度有何不同,为什么 Transformer 更常用 LayerNorm?

BatchNormLayerNormTransformer
147
NLP 与机器学习 中等 核心必会 ✓ 资料核验

反向传播和自动微分有什么区别,计算图如何得到梯度?

反向传播自动微分计算图
148
LLM 基础 中等 岗位专项 ✓ 资料核验

自回归语言模型的训练目标与 Label Shift 是什么?

自回归训练Label ShiftCausal LM
149
多模态 困难 岗位专项 ✓ 资料核验

语音大模型如何把音频变成 Token,并同时支持理解与生成?

Audio LLMSpeech TokenCodec
150
LLM 基础 中等 岗位专项 ✓ 资料核验

多头注意力的 Head 是否都必要,如何分析与剪枝?

Attention Head剪枝模型压缩
151
LLM 基础 中等 岗位专项 ✓ 资料核验

ALiBi 如何用线性偏置表示位置并外推长度?

ALiBi位置编码长上下文
152
Agent 中等 核心必会 ✓ 资料核验

怎样为 Agent 设计易调用、可校验且安全的工具接口?

Tool SchemaJSON SchemaAPI 设计
153
Agent 困难 岗位专项 ✓ 资料核验

允许 Agent 执行代码时,如何设计 Sandbox、网络和资源隔离?

SandboxCode ExecutionIsolation
154
Agent 中等 岗位专项 ✓ 资料核验

Reflexion 如何让 Agent 从失败轨迹中学习而不更新模型参数?

Reflexion反思轨迹学习
155
Agent 中等 岗位专项 ✓ 资料核验

MCP 的 Host、Client、Server 如何协作,安全边界在哪里?

MCP协议安全边界
156
Agent 困难 岗位专项 ✓ 资料核验

Agent 如何设计 Human-in-the-Loop 审批、中断与可恢复执行?

Human in the LoopInterruptDurable Execution
157
Agent 困难 岗位专项 ✓ 资料核验

Computer-Use Agent 如何完成屏幕感知、动作落点与闭环纠错?

Computer UseVisual GroundingGUI Agent
158
Agent 困难 岗位专项 ✓ 资料核验

A2A 协议如何支持 Agent 发现、任务生命周期与跨系统协作?

A2AAgent InteroperabilityTask Lifecycle
159
训练与对齐 中等 岗位专项 ✓ 资料核验

AdamW 为什么要把 Weight Decay 与梯度更新解耦?

AdamWWeight Decay优化器
160
训练工程 中等 岗位专项 ✓ 资料核验

Activation Checkpointing 如何用重计算换显存,切分点应该怎样选择?

Activation CheckpointingRematerialization训练显存
161
训练与对齐 困难 岗位专项 ✓ 资料核验

ZeRO-2、ZeRO-3 与 FSDP 如何切分训练显存?

ZeROFSDP分布式训练
162
训练与对齐 简单 核心必会 ✓ 资料核验

大模型微调数据应该如何清洗、去重和配比?

数据清洗SFT数据配比
163
LLM 基础 简单 核心必会 ✓ 资料核验

BPE、WordPiece、Unigram 和 SentencePiece 有什么区别?

TokenizerBPESentencePiece
164
工程实践 中等 核心必会 ✓ 资料核验

如何让大模型稳定输出结构化数据,并安全地驱动业务动作?

Structured OutputsJSON Schema工具调用
165
工程实践 中等 岗位专项 ✓ 资料核验

推测解码为什么能加速生成,什么时候反而收益不大?

推测解码推理优化延迟
166
训练与对齐 简单 岗位专项 ✓ 资料核验

SFT 为什么常只计算回答部分的损失?

SFTLoss MaskCausal LM
167
LLM 基础 困难 岗位专项 ✓ 资料核验

Scaling Laws 与计算最优训练说明了什么?

Scaling LawsChinchilla预训练
168
工程实践 简单 核心必会 ✓ 资料核验

temperature、top_p 和 max_tokens 分别有什么作用?

Sampling解码生成参数
169
训练与对齐 中等 核心必会 ✓ 资料核验

经典 RLHF 路线与标准离线 DPO 有什么区别?

RLHFDPO偏好学习
170
训练与对齐 中等 岗位专项 ✓ 资料核验

奖励模型如何用成对偏好数据训练?

Reward ModelBradley-TerryRLHF
171
训练与对齐 困难 岗位专项 ✓ 资料核验

如何识别并缓解奖励黑客和能力退化?

Reward Hacking过度优化能力回归
172
RAG 简单 核心必会 ✓ 资料核验

RAG 与微调应该如何选择?

RAG微调技术选型
173
RAG 困难 岗位专项 ✓ 资料核验

向量检索中如何选择 Flat、HNSW、IVF 和 PQ?

ANNHNSWFaiss
174
RAG 简单 核心必会 ✓ 资料核验

稀疏检索和稠密向量检索有什么区别?

BM25Dense RetrievalEmbedding
175
RAG 中等 核心必会 ✓ 资料核验

如何用 Recall@K、MRR 和 nDCG 评估 RAG 检索?

Recall@KMRRnDCG
176
RAG 困难 岗位专项 ✓ 资料核验

RAG 如何处理需要多跳证据的问题?

Multi-hop RAGQuery DecompositionIterative Retrieval
177
RAG 中等 岗位专项 ✓ 资料核验

如何让 RAG 支持增量更新、权限过滤和引用溯源?

增量索引权限过滤引用溯源
178
RAG 中等 核心必会 ✓ 资料核验

RAG 中如何组合 BM25 与向量检索?

Hybrid SearchBM25RRF
179
RAG 困难 核心必会 ✓ 资料核验

为什么用了 RAG 仍会产生幻觉,如何治理?

HallucinationFaithfulnessGrounding
180
RAG 中等 核心必会 ✓ 资料核验

为什么 RAG 常用 Cross-Encoder 做重排?

RerankerCross-Encoder两阶段检索
181
RAG 简单 核心必会 ✓ 资料核验

RAG 中如何选择 Chunk 大小和重叠长度?

Chunking文档解析上下文
182
RAG 简单 核心必会 ✓ 资料核验

一个完整的 RAG 流水线包含哪些步骤?

RAG检索生成
183
训练与对齐 简单 核心必会 ✓ 资料核验

预训练、SFT 和偏好对齐分别解决什么问题?

预训练SFT对齐
184
训练与对齐 简单 岗位专项 ✓ 资料核验

偏好数据中的 chosen / rejected 样本应该如何构造?

偏好数据Reward ModelDPO
185
LLM 基础 困难 岗位专项 ✓ 资料核验

Pre-Norm 与 Post-Norm 有什么区别?

TransformerLayerNorm
186
训练与对齐 困难 岗位专项 ✓ 资料核验

LLM 的 PPO 对齐流程中,Clip、KL 和四个模型分别做什么?

PPORLHFKL Penalty
187
LLM 基础 简单 核心必会 ✓ 资料核验

Transformer 为什么通常需要显式位置信息?

Transformer位置编码
188
系统设计 困难 岗位专项 ✓ 资料核验

如何设计多租户大模型平台的权限、成本与可观测性?

多租户权限成本治理
189
系统设计 困难 岗位专项 ✓ 资料核验

如何为大模型平台设计跨地域容灾与降级?

多地域RTO RPO灾难恢复
190
LLM 基础 困难 岗位专项 ✓ 资料核验

MoE 如何路由 token,并解决专家负载不均?

MoERouter负载均衡
191
训练与对齐 中等 岗位专项 ✓ 资料核验

大模型训练中 FP16、BF16 和 FP32 应该如何配合?

Mixed PrecisionBF16FP16
192
LLM 基础 中等 核心必会 ✓ 资料核验

MHA、MQA 和 GQA 的区别是什么?

MHAMQAGQA
193
工程实践 中等 岗位专项 ✓ 资料核验

微调模型上线时,LoRA 适配器应动态加载还是合并权重?

LoRA Serving模型合并微调部署
194
系统设计 简单 岗位专项 ✓ 资料核验

如何对大模型在线服务做容量估算?

容量估算Token ThroughputSLO
195
系统设计 中等 岗位专项 ✓ 资料核验

大模型语义缓存应该怎样设计,如何避免错误命中和数据越权?

语义缓存Cache Invalidation权限隔离
196
工程实践 简单 岗位专项 ✓ 资料核验

大模型量化中的 INT8、INT4、PTQ 和 QAT 应该如何理解与选择?

模型量化INT8INT4
197
工程实践 简单 核心必会 ✓ 资料核验

线上大模型应用应该观测哪些指标,怎样做到可排障又不泄露数据?

可观测性Tracing隐私
198
系统设计 简单 核心必会 ✓ 资料核验

如何设计多模型路由、升级与故障降级?

模型路由Fallback成本质量权衡
199
工程实践 困难 岗位专项 ✓ 资料核验

如何定位大模型推理中的显存、算力与内存带宽瓶颈?

性能分析RooflineGPU 推理
200
系统设计 困难 岗位专项 ✓ 资料核验

如何设计大模型反馈数据闭环,并避免隐私、偏差和评测泄漏?

数据闭环数据血缘评测泄漏
201
工程实践 困难 核心必会 ✓ 资料核验

如何构建可复现的大模型应用评估与回归测试?

Evals回归测试LLM Judge
202
工程实践 简单 核心必会 ✓ 资料核验

如何估算大模型功能的成本,并在不明显降质的前提下降本?

成本优化TokenPrompt Caching
203
系统设计 简单 核心必会 ✓ 资料核验

多轮大模型应用的会话状态应该如何存储与裁剪?

会话状态上下文管理数据隐私
204
工程实践 困难 岗位专项 ✓ 资料核验

模型或 Prompt 变更如何做灰度评测、发布与快速回滚?

灰度发布在线评测回滚
205
系统设计 中等 岗位专项 ✓ 资料核验

模型、Prompt、数据和索引如何统一版本化并支持回滚?

版本治理数据血缘Model Registry
206
LLM 基础 简单 核心必会 ✓ 资料核验

Encoder-Only、Decoder-Only 和 Encoder-Decoder 架构如何选择?

TransformerDecoder-Only模型架构
207
系统设计 简单 核心必会 ✓ 资料核验

一个线上大模型应用通常包含哪些核心模块?

系统架构LLM 应用可观测性
208
LLM 基础 中等 岗位专项 ✓ 资料核验

LayerNorm 与 RMSNorm 有什么区别?

LayerNormRMSNorm归一化
209
工程实践 中等 核心必会 ✓ 资料核验

KV Cache 为什么能加速推理,又带来什么代价?

KV Cache推理优化显存
210
系统设计 中等 岗位专项 ✓ 资料核验

如何为高并发 LLM 服务设计批处理、排队和限流?

Continuous Batching限流SLO
211
训练与对齐 困难 岗位专项 ✓ 资料核验

GRPO 的核心思想是什么,与 PPO、DPO 如何比较?

GRPOPPODPO
212
系统设计 困难 岗位专项 ✓ 资料核验

GPU 大模型服务应该根据什么信号自动扩缩容?

AutoscalingGPUQueue
213
LLM 基础 困难 岗位专项 ✓ 资料核验

FlashAttention 为什么更快,它改变了注意力复杂度吗?

FlashAttentionIO AwarenessAttention
214
LLM 基础 中等 核心必会 ✓ 资料核验

Transformer 中的 FFN 有什么作用,SwiGLU 为什么常见?

FFNSwiGLUTransformer
215
工程实践 困难 岗位专项 ✓ 资料核验

大模型多 GPU 推理中,张量、流水线和数据并行应该如何组合?

Tensor ParallelPipeline Parallel分布式推理
216
训练与对齐 中等 岗位专项 ✓ 资料核验

领域微调时如何识别并缓解灾难性遗忘?

灾难性遗忘领域微调能力回归
217
LLM 基础 简单 核心必会 ✓ 资料核验

Causal Mask、Padding Mask 和样本边界 Mask 分别解决什么问题?

Attention MaskCausal LM数据打包
218
系统设计 中等 岗位专项 ✓ 资料核验

如何设计可取消、可恢复的异步大模型长任务系统?

异步任务Checkpoint幂等性
219
Agent 简单 核心必会 ✓ 资料核验

LLM Agent 与固定 Workflow 有什么区别?

AgentWorkflow技术选型
220
Agent 中等 核心必会 ✓ 资料核验

Agent 的工具调用失败后应该如何恢复?

RetryIdempotencyFailure Recovery
221
Agent 简单 核心必会 ✓ 资料核验

LLM 的 Tool Calling 是怎样工作的?

Tool CallingFunction CallingJSON Schema
222
Agent 简单 岗位专项 ✓ 资料核验

ReAct 如何把推理与工具行动结合起来?

ReActReasoningAction
223
Agent 困难 核心必会 ✓ 资料核验

如何防御 Agent 的间接 Prompt Injection 和工具滥用?

Prompt InjectionLeast PrivilegeTool Security
224
Agent 中等 岗位专项 ✓ 资料核验

Agent 常见的规划策略有哪些,如何选择?

PlanningPlan-and-ExecuteTree of Thoughts
225
Agent 困难 岗位专项 ✓ 资料核验

什么时候应该使用多 Agent,如何设计协作机制?

Multi-AgentOrchestratorCoordination
226
Agent 中等 岗位专项 ✓ 资料核验

Agent 的短期记忆与长期记忆应该如何设计?

AgentMemory上下文管理
227
Agent 困难 核心必会 ✓ 资料核验

如何系统评估一个有工具调用的 Agent?

Agent EvaluationToolSandboxtau-bench
228
Agent 简单 核心必会 ✓ 资料核验

一个 LLM Agent 通常由哪些核心组件组成?

Agent执行循环状态
229
Agent 中等 岗位专项 ✓ 资料核验

长任务中的 Agent 上下文应该如何管理?

Context EngineeringCompactionCheckpoint
230
Agent 困难 岗位专项 ✓ 资料核验

怎样提高 LLM Agent 的可靠性?

Tool CallingGuardrailsObservability
231
RAG 困难 岗位专项 ✓ 资料核验

如何系统地提升 RAG 的召回质量?

检索Rerank评估
232
LLM 基础 中等 核心必会 ✓ 资料核验

Self-Attention 为什么要除以 √dₖ?

TransformerAttention

正在整理当前可见题目…