ARTICLEAgent 架构
销售部 Agent 绝不能看到 HR 薪资:企业级 Agent 的权限过滤与套话防御
全员共享一个知识 Agent 时,权限必须在 RAG 检索层用 Metadata Filtering 落地,而不是靠 Prompt 让模型"别看";配合 System Message 动态注入与不确认不否认的拒答,堵住多轮套话。
TOPIC
共 12 篇文章
全员共享一个知识 Agent 时,权限必须在 RAG 检索层用 Metadata Filtering 落地,而不是靠 Prompt 让模型"别看";配合 System Message 动态注入与不确认不否认的拒答,堵住多轮套话。
用 LLM-as-a-Judge 自动打分、决策树自动归因、Golden Dataset 做 CI 回归,把每天几千条"答非所问"的日志变成可治理的流水线。
用意图识别、三路召回、RRF 融合和 cross-encoder 重排,破解制造业知识库里"手册说正常但实际过热"这类矛盾问题。
从成本、延迟、准确性、可解释性、更新频率五维给出决策矩阵,并说清为什么合同审查最终要三者混合。
KnowFlow 复盘——模块化单体、三层存储分工、RRF 去重、ClickHouse 连不上的坑,以及一个开源项目该有的诚实边界。
组合摘要、去重、结构化记忆和分层检索,避免把整库内容塞进上下文窗口。
设计面向合同、制度和手册的文档问答产品,保证回答可引用、可追溯、可拒答。
建立可重复的 RAG 评测集,拆解检索和生成误差,避免只看一个模糊的满意度分数。
设计租户隔离、文档 ACL、向量索引和缓存键,避免相似度检索把别的客户资料带进回答。
设计语义相似阈值、租户隔离、答案新鲜度和缓存失效,让缓存真正适合业务问答。
知识库场景下用 RediSearch 替代 Elasticsearch 的五条理由,以及它扛不住的边界。
从文档切分、权限过滤、混合检索到引用评估,搭建可持续更新的 RAG 知识库。