调用策略设计——在业务流中寻找 AI 的最佳切入点
- 不可能三角的权衡:在内网开发中平衡 Latency(延迟)、Accuracy(精度)与 Cost(算力成本)
- 调用时机判别矩阵:必须调(非结构化转结构化)、辅助调(内容润色与风格统一)、严禁调(精确数值计算、强安规判定)
- 案例:华为技术评审系统如何在 5000 页文档审查中,仅在语义模糊处调用 AI,将算力消耗降低 60%
- 互动:红黑牌游戏,基于电力三跨场景判断环节是否应调用大模型
- Router(路由)模式:前端意图识别分发给不同的 Agent(生成/审查/检索)
- Pipeline(流水线)模式:文件切片、大模型提参、模板填充、大模型润色
- 内网环境下的 RAG 策略:800+ 份材料的混合检索(向量相似度 + 关键词匹配 BM25)
- 如何处理 Context Overflow:当检索到的规范超过模型 Token 限制时,采用 Refine 还是 Map-Reduce 策略