主动回忆题¶
先回答,再打开对应教程。
共享基础¶
- 一个模糊系统问题应该按哪八步拆解?
- TCP 保证什么,又不保证什么?
- 请求超时为什么不能证明对方没有执行?
- 并发、并行和异步有什么区别?
- 异步任务取消为什么需要状态机?
- 联合索引顺序与查询模式有什么关系?
- OFFSET 深分页为什么变慢?
- Redis String、Hash、Set、ZSet 分别适合什么?
- MGET 快在哪里,边界在哪里?
- Publisher Confirm 与 Consumer Ack 分别证明什么?
- 至少一次投递为什么要求幂等?
- 锁、事务和幂等有什么区别?
- 状态机为什么比散落的 if/else 更可靠?
- 日志、指标和 Trace 分别回答什么问题?
- 高基数指标为什么危险?
- 认证和授权有什么区别?
IoT / AIoT¶
- QoS 1 为什么可能重复?
- Session、Retain、Will 分别解决什么?
- device_id 为什么不是身份凭据?
- 在线状态的事实和查询视图分别是什么?
- TTL 为什么不能自动维护在线 Set?
- desired 和 reported 有什么区别?
- Broker 收到命令为什么不等于设备执行成功?
- 如何估算十万设备的消息和存储量?
- 告警如何去重、抑制和恢复?
- OTA 为什么要分批次状态和设备状态?
- 突发重连与平均吞吐有什么区别?
- 哪些 IoT 场景不适合使用 Agent?
AI Agent¶
- 降低 temperature 为什么不能消除幻觉?
- JSON Schema 合法为什么不代表业务正确?
- 模型和后端在 Tool Calling 中分别负责什么?
- RAG 的检索失败和生成失败如何区分?
- 哪些步骤应该使用固定 Workflow?
- Checkpoint 和幂等分别解决什么?
- 对话历史、任务状态和业务事实为什么分开?
- Agent Eval 应该有哪些分层指标?
- LLM-as-Judge 有什么风险?
- Agent 总成本除了 Token 还有什么?
- MCP 与普通业务 API 的关系是什么?
- Prompt Injection 为什么不能只靠 Prompt 防护?
综合题¶
- 设计一个设备故障诊断 Agent,哪些工具只读,哪些需要审批?
- Agent 创建工单超时后如何安全重试?
- Redis 丢失与 Agent Worker 重启分别怎样恢复?
- 如何证明新模型更便宜但没有显著降低任务成功率?
- 如果一万设备同时离线,系统如何避免告警风暴?