Shieldstral:Mistral 开源 3B 安全分类器,如何用问答范式重塑内容审核
AI 产品上线前必须回答一个问题:用户输入和模型输出的内容是否安全?但「安全」的定义取决于产品定位、受众和使用场景。同一段文字在网络安全研究工具中完全合规,到了心理健康平台就成了有害内容。传统护栏模型(guardrail model)把固定的伤害类别烘焙进权重,想换个部署场景就得重新训练。 Mistral 在 2026 年 8 月 4 日发布了 Shield…
AI 产品上线前必须回答一个问题:用户输入和模型输出的内容是否安全?但「安全」的定义取决于产品定位、受众和使用场景。同一段文字在网络安全研究工具中完全合规,到了心理健康平台就成了有害内容。传统护栏模型(guardrail model)把固定的伤害类别烘焙进权重,想换个部署场景就得重新训练。 Mistral 在 2026 年 8 月 4 日发布了 Shield…
一台 16GB 内存的 Mac mini 跑 80B 参数的大模型,一台 iPhone 17 跑 35B 参数的模型——而且不是靠云端中转,全部在本地完成。开源项目 Swiftlet 用一种叫做「专家流式推理」(Expert Streaming)的技术做到了这一点,峰值内存占用分别只有 4.3GB 和 2.5GB。 Swiftlet 项目主页 Swiftle…
DeepSeek-Reasonix GitHub 仓库 终端 AI 编程助手赛道又添一名选手。DeepSeek-Reasonix 是一个围绕 DeepSeek 模型构建的开源命令行编码代理,由 esengine 团队以 MIT 协议在 GitHub 开源,目前积累了超过 3 万 star。项目从 TypeScript 实现迁移到了 Go 单二进制架构,核心设…
MiniMax H3 7 月 31 日,MiniMax 发布了第三代视频生成模型 H3。这不是又一个文生视频工具:H3 将文本、图像、视频、音频作为统一上下文输入,生成带原生立体声音轨、最高 2K 分辨率、最长 15 秒的视频片段。两天后,模型权重在 HuggingFace 上线,ComfyUI 完成首日适配。 核心规格 | 参数 | 规格 | |---|-…
一张 2021 年面向加密货币挖矿的 NVIDIA CMP 170HX,最近重新进入 AI 硬件讨论。亚利桑那州立大学研究者 Jon Pry 在 Zenodo 发布论文,分析了这张卡的 GPU 安全协处理器,并展示了一条从主机侧触发 Falcon HS 模式漏洞的解锁路径。论文给出的结果包括:计算吞吐提升约 31 至 62 倍、可见显存容量提升 8 倍、PC…
Agent Reach 是一个面向 AI Agent 的互联网能力层。它负责选择、安装、检查和路由上游工具,真正读取网页、调用 GitHub、提取视频字幕的动作交给 gh、yt-dlp、OpenCLI、bili-cli、feedparser、Jina Reader 等工具完成。这个分工让项目保持轻量,也让每个平台的登录态、代理和风控差异集中在独立渠道文件中。…
AirLLM 是一个面向 Hugging Face 大语言模型的推理库,项目的核心目标是降低推理阶段的显存占用。官方 README 给出的典型配置是:70B 模型使用单张 4GB GPU,Llama 3.1 405B 使用 8GB,DeepSeek-V3 671B 使用约 12GB。它依靠分层拆分、按需加载和权重释放完成这件事,模型参数总量与显存容量之间的关…
Agent 的记忆问题,常见表现是两种:长任务里工具日志不断膨胀,跨会话后又丢掉项目背景、操作习惯和输出要求。TencentDB Agent Memory 试图用同一套分层模型处理这两类压力,并提供了 OpenClaw 插件和 Hermes Gateway 适配。 TencentDB Agent Memory 的 L0-L3 分层架构 L0 到 L3:记忆先…
苹果正在面对一个新的安全运营问题:AI 工具让漏洞候选的发现速度明显提高,但漏洞报告的审核、复现和修复速度没有同步扩张。Financial Times 报道称,苹果在 2026 年 6 月开始限制研究人员同时提交的漏洞报告数量,并设置 30 天冷却期,用来应对大量低质量、未经验证的 AI 生成报告。 这项措施已经影响到意大利安全初创公司 Bynario。该公…