大模型基础面试题25 题
- 01 大模型处理长文本摘要时应该如何切分、压缩和校验?
- 02 大模型的记忆和上下文有什么区别?为什么不能把历史一直塞进窗口?
- 03 大模型工具调用的基本原理是什么?为什么需要函数调用格式?
- 04 大模型能力边界如何判断?哪些任务不适合直接交给 LLM?
- 05 大模型生成时 logits、概率和 token 之间是什么关系?
- 06 大模型为什么需要 Tokenization?BPE 是如何工作的?
- 07 大模型应用如何管理 Token 预算?
- 08 函数调用和直接 JSON 输出有什么区别?
- 09 什么是 Lost in the Middle?长上下文为什么不一定更好?
- 10 什么是大模型的上下文窗口?长度越长越好吗?
- 11 什么是大模型幻觉?产生原因和缓解方法有哪些?
- 12 系统提示词和指令遵循在大模型里起什么作用?
- 13 GPT 和 BERT 的架构及训练目标有什么区别?
- 14 Temperature、Top-k 和 Top-p 如何影响大模型生成?
- 15 Temperature、Top-p、Top-k 如何影响大模型生成?
- 16 大模型能否估计自己的置信度?
- 17 大模型输出长度如何控制?
- 18 大模型做结构化信息抽取要注意什么?
- 19 上下文压缩会损失哪些信息?
- 20 推理型输出和普通生成有什么区别?
- 21 大模型 JSON 输出失败时如何修复?
- 22 大模型回答为什么需要 Grounding 来源?
- 23 大模型如何判断什么时候该调用工具?
- 24 多轮对话为什么容易发生指令漂移?
- 25 Self-Consistency 为什么能提升推理稳定性?
没有符合条件的题目。