标签: Agent

清除筛选

微软开源 Agent Governance Toolkit:用确定性代码拦截 AI Agent 的每一次工具调用

当 AI Agent 可以自主调用工具、查询数据库、发送邮件甚至编写代码时,一个绕不开的问题浮出水面:怎么确保它不做不该做的事? 微软开源的 Agent Governance Toolkit(AGT)给出的答案是:别指望提示词约束,用确定性代码在应用层拦截每一次工具调用。 2026 年 3 月创建至今,这个项目在 GitHub 收获 5,392 个 Star…

腾讯网盘上线:不是存文件的,是给 AI 当长期记忆的

腾讯近日上线了腾讯网盘官网(drive.tencent.com),页面标注 COMING SOON。和百度网盘、阿里云盘截然不同,这款产品定位的是一类全新的用户——AI 应用和 Agent。 不是给人存文件的,是给 AI 当长期记忆的 官网首屏的文案说明了一切:「连接多个 AI 应用,共享存储,聚合上下文。生态内所有 AI 应用的数据产物聚合沉淀,持续形成长…

DeepSeek-V4 正式上线:1M 上下文标配,Flash 输入 0.2 元/百万 token

DeepSeek 今日正式发布 V4 系列模型预览版,同步开源。两个版本——V4-Pro 和 V4-Flash——均支持 1M 上下文长度,并在 Agent 能力上进行了专项优化。 V4-Pro 与顶级闭源模型评测对比 两个版本,两个定位 V4-Pro 是性能旗舰。在数学、STEM、竞赛型代码的评测中,V4-Pro 超越了当前所有已公开评测的开源模型,成绩追…

小米 MiMo-V2.5 公测:4.3 小时从零写完编译器,Token 效率领先竞品

小米正式发布 MiMo-V2.5 系列大模型并开启公测。最直观的 demo 来自代码生成领域:MiMo-V2.5-Pro 用 4.3 小时(672 次工具调用)从零写了一个完整的 SysY 编译器(Rust 实现),233 个测试全部通过。 SysY 是南京大学编译原理课的教学语言,涵盖词法分析、语法树构建、Koopa IR 中间代码生成、RISC-V 后端…

谷歌第八代 TPU 发布:训练推理芯片分离,Gemini Enterprise 升级全栈 Agent 平台

在 Google Cloud Next 大会上,谷歌发布第八代 TPU,首次采用训练(TPU 8t)和推理(TPU 8i)双芯片架构。同时 Gemini Enterprise 升级为端到端 Agent 平台,涵盖开发、编排和治理全流程。 TPU 第八代 TPU 8t:为训练而生 TPU 8t 针对大规模计算密集型训练负载设计,核心规格: 单集群扩展至 9,6…

OpenAI 开始给内部编码代理配“监工”,数千万轨迹里未见最高风险失调

OpenAI 内部编码代理监控系统配图 OpenAI 最近公开了一套它们内部已经在运行的编码代理监控系统。 按官方说法,这套系统会在一次代理交互结束后 30 分钟内回看完整轨迹,范围包括对话、工具调用、动作,以及模型的思考链,重点筛查两类问题:一类是是否偏离用户原始意图,另一类是是否触碰内部安全、合规和权限边界。 这件事之所以值得看,不只是因为它披露了一组看…

小米三款大模型齐发:MiMo-V2-Pro、Omni、TTS 完整解读

2026年3月19日,小米在 MiMo 开放平台同步上线三款大模型——MiMo-V2-Pro、MiMo-V2-Omni、MiMo-V2-TTS。这是小米首次以模型矩阵而非单一模型的方式对外亮相,三款产品分别对准 Agent 应用的不同核心能力:推理、全模态感知、语音合成。 小米三款大模型齐发:MiMo-V2-Pro、Omni、TTS 完整解读 MiMo-V2…

智谱发布 GLM-5-Turbo:面向 OpenClaw 场景优化,价格较 GLM-5 上调约一到两成

智谱发布 GLM-5-Turbo:面向 OpenClaw 场景优化,价格较 GLM-5 上调约一到两成 智谱在 3 月 16 日上线了新模型 GLM-5-Turbo。和常规的 Turbo 命名不同,这次官方给出的定位非常明确:它是一个“面向 OpenClaw 龙虾场景深度优化的基座模型”。与此同时,BigModel 官网还同步上线了“龙虾套餐 · 团队协作版…