AgentLock 首跑不要先测“能否拦截”:先验证 ALLOW、DENY、DEFER 与版本边界

发布时间:2026/7/23 21:51:02

AgentLock 首跑不要先测“能否拦截”:先验证 ALLOW、DENY、DEFER 与版本边界
很多 Agent 安全测试一上来就塞一段提示注入然后看工具有没有被拦住。这个顺序不可靠如果你没有记录安装的版本、策略文件、上下文来源和最终决策测试结果无法复现。我在 AgentLock 的首跑里先做四件事。第一分清证据版本。Doramagic manual 当前写的是 AgentLock v1.2.1说明了 ALLOW、DENY、DEFER 三态、签名 receipt 和 hash-chained contextupstream README 当前已经列到 v1.5.0并新增 grant basis、execution confirmation、provenance on denials 和 deferred-resolution logging。两者不能混成一个版本结论。先执行~~~bashpython -m pip install agentlockpython -m pip show agentlock~~~把版本、安装来源和 extras 记录下来。需要 Ed25519 receipt 时再安装~~~bashpython -m pip install agentlock[crypto]~~~第二先验证三态决策而不是只验证拒绝。ALLOW 表示策略允许动作DENY 表示动作被拒绝DEFER 表示风险信号无法由当前策略自动决定需要人工或更高等级处理。一个好的最小测试矩阵至少包含明确允许的低风险工具、命中 deny 规则的工具、第一次调用中风险工具以及策略无法判断的参数。第三给上下文来源做标记。upstream README 把来源分成 authoritative、derived 和 untrusted并用 session write-gate、parameter lineage、deferred commit 约束后续动作。同一个 send_email 调用如果参数看起来完全相同但它是在用户指令之后还是网页内容之后形成的决策应该分别回读。测试时不要只比较字符串。第四验证 receipt 是否真的能解释结果。至少保存 request hash、policy hash、verdict、session ID 和异常类型。DENY 不等于系统崩溃如果调用方把 AuthorizationDenied、RateLimitExceeded 和 ContextIntegrityError 都吞成一个“失败”后续审计仍然无法定位原因。AgentLock 的关键价值不是“让模型变得更安全”而是把工具调用前的授权变成可重放的规则判断。它也有明确边界模型只在文本里完成了说服不产生工具调用时write-gate 无法拦截只读操作造成的风险也不是写门可以全部覆盖工具的 authority 标记错误时策略会建立在错误输入上。因此首跑验收的结论应该写成安装了哪个版本、哪些来源被标记为 untrusted、哪些动作进入了 DEFER、receipt 能否重放以及 benign workflow 的通过率是多少。不要只写“成功拦截提示注入”。来源- Doramagic manualhttps://doramagic.ai/en/projects/agentlock/manual/- upstream READMEhttps://github.com/webpro255/agentlock

相关新闻

【免费赠书活动】吃透大模型底层数学,从公式原理到产业实战,打通AI进阶全链路

【免费赠书活动】吃透大模型底层数学,从公式原理到产业实战,打通AI进阶全链路

2026/7/23 21:51:02

人工智能大模型数学基础从数学公式到智能模型,打通AI底层逻辑——线性代数、微积分、概率与统计三大支柱,结合BERT、GPT、Stable Diffusion等前沿实战,带你从理论推导到代码落地,真正掌握大模型的数学引擎。本书特点基础→进阶→A…

TVA驱动的具身智能迭代逻辑(3)

TVA驱动的具身智能迭代逻辑(3)

2026/7/23 21:51:02

前沿技术探索:AI智能体视觉(TVA,Transformer-based Vision Agent)是依托Transformer架构与“因式智能体”理论所构建的颠覆性工业视觉技术,是集深度强化学习(DRL)、卷积神经网络(CNN…

2026年ERP实施服务指南

2026年ERP实施服务指南

2026/7/23 21:41:01

在数字经济与智能制造深度融合的2026年,企业资源规划(ERP)系统已不再是大型企业的专属奢侈品,而是决定中小型制造企业生存与发展的核心基础设施。面对日益复杂的供应链、激烈的市场竞争以及不断攀升的合规成本,一套契合…

爆款标题生成器失效了?揭秘抖音/小红书/B站2024Q2最新AI内容权重算法(附可落地的prompt调优表)

爆款标题生成器失效了?揭秘抖音/小红书/B站2024Q2最新AI内容权重算法(附可落地的prompt调优表)

2026/7/23 22:51:04

更多请点击: https://codechina.net 第一章:爆款标题生成器失效了?揭秘抖音/小红书/B站2024Q2最新AI内容权重算法(附可落地的prompt调优表) 近期大量创作者反馈:同一套标题模板在抖音、小红书、B站的CTR与…

【思维导图AI化革命】:2024最新GPT-4o+XMind Copilot深度整合方案,效率提升3.8倍(附压测数据报告)

【思维导图AI化革命】:2024最新GPT-4o+XMind Copilot深度整合方案,效率提升3.8倍(附压测数据报告)

2026/7/23 22:51:04

更多请点击: https://codechina.net 第一章:AI驱动思维导图的范式变革与技术演进 传统思维导图工具长期受限于静态结构、人工建模与线性编辑范式,而大语言模型(LLM)与多模态理解能力的突破,正推动思维导图…

小草数字(874667)发布智地AI:AI种地如何变成一门“数据生意”

小草数字(874667)发布智地AI:AI种地如何变成一门“数据生意”

2026/7/23 22:51:04

近日,新三板创新层挂牌企业小草数字(874667)正式发布农业垂类AI大模型——“智地”,聚焦玉米全生命周期管理。这是该公司从硬件集成向“数据算法”驱动的农业AI服务商转型的关键落子,也标志着其智慧农业业务从“卖设备…

2026年北京周边宠物训练基地推荐:专业可靠选择指南

2026年北京周边宠物训练基地推荐:专业可靠选择指南

2026/7/23 22:51:04

随着养宠家庭的不断增多,宠物训练和寄养的需求也日益增长。在北京及其周边地区,如何选择一个专业可靠的宠物训练基地成为了很多宠物主人关心的问题。本文将为大家推荐一家值得信赖的宠物训练基地——北京宠爱到家宠物服务有限公司,并通过具体…

沁园春·数智潮

沁园春·数智潮

2026/7/23 22:51:04

沁园春数智潮 万里云网,数据奔流,智算万千。 望代码内外,逻辑森严;算法上下,星火燎原。 模型吞吐,参数如海,欲与天公试比高。 须晴日,看智能万象,分外妖娆。 时代如此多娇…

一位直博生的 AI 编程困境,会语法,却写不出项目?|AI悦创VibeCoding/Python一对一辅导分享

一位直博生的 AI 编程困境,会语法,却写不出项目?|AI悦创VibeCoding/Python一对一辅导分享

2026/7/23 22:41:04

你好,我是悦创。 会 C、Python 语法,为什么一遇到真实项目,还是不知道从哪里下手? 这场会议里,一位 985 大三、已直博清华的同学也遇到了同样的问题:局部代码能看懂,自己写却一片空白&#xff1…

微服务进阶:服务网格与Istio

微服务进阶:服务网格与Istio

2026/7/23 3:40:08

541|微服务进阶:服务网格与Istio 上篇文章我们聊了微服务的基本概念和拆分方法。 但微服务多了,问题也多了: 服务之间怎么通信? 怎么监控每个服务的调用链路? 熔断、限流、重试怎么做? 安全认证怎么统一? 以前这些都靠SDK库(比如Hystrix、Feign),每个服务都要集成…

零售超级终端全域协同:ShareKit 碰一碰商品流转业务落地案例

零售超级终端全域协同:ShareKit 碰一碰商品流转业务落地案例

2026/7/23 4:40:05

一、零售门店全域协同业务背景与行业痛点 1.1 门店超级终端设备矩阵(连锁便利店/商超标准配置) 自助收银Kiosk一体机:顾客结算、自助核销优惠券、商品素材预览;运营折叠平板:店长后台商品上新、图片录入、活动配置、…

噗叽短视频界面分析

噗叽短视频界面分析

2026/7/23 1:54:13

1 和小红书类似,可以采用类似判断方法------------其实他比小红书好判断,因为他没有图片,控件位置几乎是固定的,都不用判断------------2 因为他没有点赞按钮------------而且几乎所有控件位置都是完全一样的,所以我就…

企业级AI搜索落地选型实战手册(含LLM+RAG+Hybrid架构对比矩阵与ROI测算模板)

企业级AI搜索落地选型实战手册(含LLM+RAG+Hybrid架构对比矩阵与ROI测算模板)

2026/7/23 0:09:56

更多请点击: https://kaifayun.com 第一章:企业级AI搜索落地选型实战手册(含LLMRAGHybrid架构对比矩阵与ROI测算模板) 企业级AI搜索系统落地成败,核心在于技术选型与业务价值的精准对齐。盲目堆砌大模型能力或过度依赖…

TM4C129LNCZAD外设实战:LCD、比较器与PWM寄存器配置详解

TM4C129LNCZAD外设实战:LCD、比较器与PWM寄存器配置详解

2026/7/23 0:09:56

1. 项目概述与核心价值在嵌入式系统开发,尤其是基于ARM Cortex-M内核的微控制器项目中,深入理解并熟练配置芯片的片上外设,是从“点亮LED”迈向“实现复杂系统功能”的关键一步。Tiva™ TM4C129LNCZAD作为TI公司Cortex-M4F家族中的高性能成员…

AtomCode `fmt_dur` 争议溯源:两个函数、三段演进、四个事实

AtomCode `fmt_dur` 争议溯源:两个函数、三段演进、四个事实

2026/7/23 0:09:56

一、快速声明与争议背景本文是对 AtomCode 终端 spinner 时长显示 fmt_dur 相关说法的事实性核验。2026 年 7 月 CSDN 上出现两篇互相矛盾的博文,近期又有 AI 在对话中输出格式描述 XhYm / YmZs / Zs。本文基于 AtomCode 仓库 main4677ddfa 及全分支 Git 历史给出可…