Claude Fable 5.1 发布:1M 上下文、缓存价格降至四分之一、双版本安全策略
Anthropic 于 2026 年 9 月 1 日发布 Claude Fable 5.1,定位长时程智能体与复杂推理任务,同步推出仅限邀请的 Claude Mythos 5.1。这次发布有三个值得展开的信息点:1M token 上下文配合结构性降价(缓存读取价格降至四分之一)、对上一代 Fable 5 的全面 benchmark 提升,以及"同一个模型、两…
Anthropic 于 2026 年 9 月 1 日发布 Claude Fable 5.1,定位长时程智能体与复杂推理任务,同步推出仅限邀请的 Claude Mythos 5.1。这次发布有三个值得展开的信息点:1M token 上下文配合结构性降价(缓存读取价格降至四分之一)、对上一代 Fable 5 的全面 benchmark 提升,以及"同一个模型、两…
ARC-AGI-1 公开评测集上出现了一个新的低成本纪录:独立研究者 Mithil Vakde 训练的 75M 参数小模型 mdlARC 拿到 44% 的解题率,总训练成本约 0.67 美元,用时 1.5 小时,硬件是一张在 vast.ai 上租来的 RTX 5090。这组数字来自作者发布的技术博客与开源仓库 mdlARC,代码、数据构建脚本和复现步骤全部公…
训练一个大语言模型要花多少钱?行业里公开的数字通常以百万美元计。GitHub 上的开源项目 minimind 给出了另一个量级的答案:单卡 RTX 3090,预训练加微调合计约 2.31 小时,成本约 3.0 元人民币,就能从零训练出一个可以对话的 64M 参数语言模型。这个仓库目前拿下 55,894 star、7,301 fork,采用 Apache-2.…
Scientific Agent Skills 仓库卡片 一个 AI agent 会查文献、跑单细胞测序分析、做分子对接、筛药物候选、写带引用溯源的研究报告。支撑这些能力的,是 163 个 Markdown 文件加配套脚本,背后没有一个专门训练的科研大模型。 GitHub 上的 [K-Dense-AI/scientific-agent-skills](htt…
一个开源项目把"听网课"这件事整个重做了:老师在讲,同学在举手,白板上有推导,你随时插话提问 OpenMAIC 技术解读:清华团队开源多智能体课堂,一键把任何主题变成能对话的网课 OpenMAIC 官方横幅 8 月 27 日,清华 THU-MAIC 团队发布了 OpenMAIC v1.0.0,并在 GitHub Trending 上冲到榜首,日增 star…
Linux 内核官方 Git 服务器 git.kernel.org 每天收到约 600 万次查看随机 commit 的请求,其中合法流量只占约 2%。kernel.org 基础设施负责人 Konstantin Ryabitsev 在官方博客发文披露了这组数字,并完整复盘了这场持续一年多的攻防。文首结论只算了一笔账:五个地理分布式节点共 90 个 CPU 核心…
28.9k star 的 Heretic 把"去掉模型审查"做成了一键命令行工具,产出质量超过了多数人工调参的同类模型 大模型拒绝回答敏感问题的行为,在技术社区里有个专门的名词:safety alignment,安全对齐。2024 年以来,一类名为 abliteration(方向消融)的方法证明,这种拒绝行为在模型内部对应着一个可以定位、也可以直接移除的方向…