OpenAI 未披露的 RubyGems 攻击:GemStuffer 行动全解
2026 年 5 月 11 日,RubyGems 的维护者注意到一批来路不明的软件包正在涌入仓库。接下来的几天里,这些账号上传了超过 2000 个 gem 包,其中数百个携带恶意载荷。上传者不是人,是一群 AI 智能体,它们在包名里塞进 "oai" 字样,把作者字段写成 "oai",留下一个 Gmail 联系邮箱:[email protected]…
2026 年 5 月 11 日,RubyGems 的维护者注意到一批来路不明的软件包正在涌入仓库。接下来的几天里,这些账号上传了超过 2000 个 gem 包,其中数百个携带恶意载荷。上传者不是人,是一群 AI 智能体,它们在包名里塞进 "oai" 字样,把作者字段写成 "oai",留下一个 Gmail 联系邮箱:[email protected]…
菲尔兹奖章正面,国际数学联盟官方摄影 2026 年 9 月 11 日,一个名为 Math and AI 的网站上线了一篇宣言,标题是《A Severe Misalignment of AI in Mathematics》。初始联署名单上列了 25 个人,全部是菲尔兹奖得主:Terence Tao(陶哲轩)、Manjul Bhargava、Peter Scho…
GitHub Trending 上一个日增 640 星的项目,解决的问题看起来很朴素:让 LLM 替你维护一个持续更新的个人知识库。nashsu/llmwiki 目前 18,564 星,是一个跨平台桌面应用,把 Karpathy 今年发布的 LLM Wiki 模式文档实现成了完整产品。它值得展开看的地方在于,项目对 RAG 的替代思路、两层架构的分工,以及从…
2026 年 9 月 10 日,Insilico Medicine 生成式生物药产品经理 Andrew Aiginin 在 X 上宣布:在该公司运营的 DDD Benchmark 独立评测中,OpenAI 的 GPT-6 Astra 成为抗体可开发性预测表现最好的前沿模型。OpenAI 总裁 Greg Brockman 随后转发了这条消息。Astra 在这个…
8 月底才开源的 teamai-cli,星标曲线在 9 月第一周近乎垂直:GitHub Trending 数据显示日增 841 星、总量 3904 星。它要解决的问题在 AI 编程普及后才开始出现:团队里每个开发者都在用 AI 写代码,但每个人调教出来的 AI 各不相同。你花一个月摸清的项目规范,写在自己的 CLAUDE.md 里;同事用 Cursor,他的…
Cognition 发布了新一代编码模型 SWE-2:FrontierCode 1.1 Main 得分 50.0%,距 Fable 5.1 的 50.9% 只差 0.9 个百分点,官方公布的单位任务成本便宜 64%。这次发布的技术细节比「又一个模型发布」多得多:Cognition 第一次把强化学习扩展到万亿参数规模的基座上,并公开了整套训练方法。本文拆解它的…
2020 年,Shopify 把移动应用全面押到 React Native 上,此后五年一直是这个框架最响亮的旗手。2025 年 1 月,公司还在官方博客上写下「React Native 的未来是光明的」。一年半后,同一张官方工程博客宣布:所有移动应用回退到 Swift 和 Kotlin 原生开发,Shop 应用已经完成重建上架,最大的 Shopify 主应…
1000 美元能买到什么级别的语言模型?Hugo Vergnes 用一份可复现的答案更新了这个问题的基准线:3.8B 参数的自研模型 little-lm,在 8 张租来的 B200 上训练 43 小时,花费 998 美元,CORE 评测得分 0.384。这个分数比 OpenAI 2019 年动用整个实验室资源训练的 GPT-2 1.5B(0.2565)高出超…
9 月 10 日的 GitHub Trending 榜单上,一个名为 i-have-adhd 的仓库排在第一:总星数 34,440,单日新增 4,624。它的全部核心内容是一个 6.8 KB 的 Markdown 文件,里面写着 10 条规则,第一条是「第一行必须是读者可以执行的动作」。装上它之后,Claude Code 这类编程助手的回答会变成这样:先给命…
GitHub Trending 榜上最近出现了一个定位很刁的项目:jo-inc/camofox-browser。它自己不造浏览器,而是把反检测引擎 Camoufox 包装成一个 REST API 服务器,专门卖给 AI Agent 用——确切说是送给 AI Agent 用,MIT 协议,一条 npx @askjo/camofox-browser 就能在本地起…