微软开源 Agent Governance Toolkit:用确定性代码拦截 AI Agent 的每一次工具调用
当 AI Agent 可以自主调用工具、查询数据库、发送邮件甚至编写代码时,一个绕不开的问题浮出水面:怎么确保它不做不该做的事? 微软开源的 Agent Governance Toolkit(AGT)给出的答案是:别指望提示词约束,用确定性代码在应用层拦截每一次工具调用。 2026 年 3 月创建至今,这个项目在 GitHub 收获 5,392 个 Star…
当 AI Agent 可以自主调用工具、查询数据库、发送邮件甚至编写代码时,一个绕不开的问题浮出水面:怎么确保它不做不该做的事? 微软开源的 Agent Governance Toolkit(AGT)给出的答案是:别指望提示词约束,用确定性代码在应用层拦截每一次工具调用。 2026 年 3 月创建至今,这个项目在 GitHub 收获 5,392 个 Star…
一位用户在 Reddit r/ClaudeAI 社区发布了对 Claude Code 的逆向分析,声称自 2026 年 4 月发布的 v2.1.91 起,Claude Code 在启用代理时会隐蔽检查用户环境信息,并将结果编码进发往 Anthropic API 的 system prompt。 Claude 这段代码检查两项内容:系统时区是否匹配 Asia/…
Linux 内核曝 DirtyClone 高危漏洞,本地用户可静默提权至 root DirtyClone CVE-2026-43503 JFrog 安全研究团队披露了 Linux 内核本地提权漏洞 DirtyClone(CVE-2026-43503),CVSS 评分 8.8。该漏洞属于 DirtyFrag 家族的新变种,因 pskbcopyfclone()…
Anthropic 工程师季度代码产出变化 6 月 4 日,Anthropic 在官网发布了一份题为《When AI Builds Itself》的长篇报告,由联合创始人 Jack Clark 和内部研究所负责人 Marina Favaro 联合署名。报告首次披露了一批此前从未公开的内部运营数据,核心结论是:AI 正在加速参与自身的开发过程,最快可能在两年内…
2026 年 5 月 13 日,安全研究机构 depthfirst 与 F5 联合披露了 NGINX 中一个编号为 CVE-2026-42945 的严重漏洞,CVSS v4.0 评分达 9.2。该漏洞属于堆缓冲区溢出类型,存在于 ngxhttprewritemodule 模块中,最早可追溯至 2008 年引入的代码逻辑,在代码库中潜伏长达 18 年。Dept…
2026 年 5 月 11 日 19:20–19:26 UTC,攻击者向 42 个 @tanstack/ npm 包发布 84 个恶意版本。攻击链组合利用了 GitHub Actions 的三个机制——pullrequesttarget Pwn Request、Actions 缓存投毒、以及从 runner 内存提取 OIDC token——在不窃取任何 n…
Dirty Frag 漏洞示意图 韩国安全研究员 Hyunwoo Kim(@v4bel)公开披露了一个被命名为"Dirty Frag"的 Linux 内核本地权限提升漏洞,允许普通用户无需密码即可获得 root 权限。PoC 已在 GitHub 公开,Ubuntu、RHEL、Fedora、openSUSE 等所有主流发行版目前均无可用补丁。 漏洞原理 Dir…
挪威安全研究员 Tom Jøran Sønstebyseter Rønning 发现,Microsoft Edge 启动时会将所有已保存的密码解密并以明文形式加载到进程内存,在整个会话期间持续保留——即使用户从未访问需要这些凭证的网站。微软回应称此行为是"by design"(有意为之)。 发现过程 Rønning 在 X 上发布了 proof-of-con…
2026年4月30日,深度学习框架 PyTorch Lightning 的 PyPI 包 lightning 的 2.6.2 和 2.6.3 版本被植入恶意代码,import lightning 即触发窃取行为。月下载量约 800 万的包被劫持,波及大量 ML 训练管线和 CI 环境。 事件时间线 UTC 12:45 — lightning 2.6.2 发布…