外观
共享记忆环境中的 Honeytoken 可区分性边界
摘要
该研究讨论多个短生命周期 Agent 通过共享存储传递信息时,Honeytoken 能否只欺骗攻击者而不影响可信 Agent。形式化结果显示:如果攻击者能观察并复制可信策略,任何让可信 Agent 区分真凭据与诱饵的公开规则也可能被复制;共享记忆还允许多次探测汇聚微弱指纹。
这是一项形式化研究和架构提案,不是新的多 Agent Honeytoken 实验。结论约束的是特定信息结构,不能外推为 Honeytoken 普遍无效。
方法的独特价值
论文使用总变差、Bayes 分类误差和有限样本界,区分“检测到 token 被触发”与“可靠覆盖攻击”。它把 Honeytoken 的价值从万能识别器收缩为特定策略违例的传感器。
适用范围
适用于 Agent 可共享记忆、攻击者能够学习防守响应或复用可信策略的系统。攻击者无法观察响应、没有足够存活时间或每次部署规则独立时,界限可能不同。
方法与实施流程
分析首先证明可复制策略下的不可区分性,再研究重复非触发探测如何降低分类误差,最后给出私有控制面构造:token 注册表留在参考监视器中,可信 Agent 只从来源代理获得短期能力。
质量控制
部署评估应分别测量接触、绕过、激活和真实入侵,并公开攻击者可见信息。不能把一次诱饵触发直接解释为完整攻击覆盖率。
局限与待验证问题
形式模型依赖条件独立、稳定响应分布等假设,尚无作者实现或生产实测。共享存储事件只提供动机,不构成 Honeytoken 性能证据。