场景设计
方法论域:五步通法与 toB 硬约束,场景题在拷哪些概念由关联边给出。 共 6 个知识点,对应题库第 8 章。
深水6 个
日活涨一千倍,架构要变的不是「加机器」:容量规划看 goodput 而不是 throughput, KV Cache 决定并发上限,长尾请求要有兜底策略(限流、降级、排队),网关与多 key 摊配额。答题时先说哪个环节先崩,再说各环节的触发信号。
门禁不能装在出口:权限要在检索前过滤(前置过滤),不能让模型看完再决定说不说。权限有四个落点缺一个就漏 —— 文档入库、检索过滤、缓存分桶、答案引用;三种隔离级别各有取舍;真难点是权限会变,一致性(他在那个时间点有没有权限)比隔离本身更难。
场景题考的不是会做多少菜,是会不会点菜。五步:澄清需求(四类问题、只花两分钟)、给基线(最土的方案能到什么水平)、加挂并说代价、谈评测(三条线,只在掉分时下沉)、谈演进(给触发信号不给时间表)。四张随身表把决策树、评测线、成本三刀、四道闸随身带着。
对着私有仓库问,两条检索路线不是谁对谁错:索引检索(embedding + 符号索引)快但有新鲜度问题,代理式检索(agentic grep)新鲜但每次都要走一遍。仓库权限是前置过滤的又一个落点,代码的结构(符号、调用关系)比自然语言更值得建索引。
预算砍一半不是均摊,是按降本九步的顺序走:从「不影响正确性」的动作(缓存、裁剪、批处理)走到「影响正确性」的动作(降档位、换小模型、砍功能),最后一步是承认做不到。每一步都要说边际收益与代价,压力追问考的是取舍能不能说清。
工单 Agent 的分类、查询、升级三段里,转人工的触发按不可逆程度分级,不按置信度 —— 模型不确定就转人工会把人工淹没。转人工率是一个被低估的零成本信号:它同时反映模型能力、需求分布与阈值设置,是场景题里最好谈的评测指标。