标签: 大模型
清除筛选Kimi K2.6 发布:开源模型在编码基准上全面追平闭源第一梯队
月之暗面(Moonshot AI)发布了 Kimi K2.6 模型,在多项主流 Agent 和编码基准测试中取得开源 SOTA,多项指标追平甚至超越 GPT-5.4、Claude Opus 4.6 等闭源模型。 Kimi K2.6 Benchmark 基准表现 与 GPT-5.4 (xhigh)、Claude Opus 4.6 (max effort)、Ge…
阿里上线 Qwen3.6-Max-Preview 预览版:智能体编程能力大幅提升
阿里发布 Qwen3.6-Max-Preview 预览版,旗舰模型聚焦智能体编程与世界知识能力的迭代。 核心提升 相比 Qwen3.6-Plus,预览版在智能体编程方面取得显著提升:SciCode +10.8、SkillsBench +9.9、NL2Repo +5.0、Terminal-Bench 2.0 +3.8。在六项编程基准上登顶首位:SWE-benc…
千问测试引证功能:AI回答做信源核查,绿色可信红色存疑
千问(Qwen)近日上线了一项名为"引证"的测试功能。当用户提问涉及新闻时事、政策动态等需要参考网络信息的话题时,回答末尾会出现一个"引证"按钮。点击后,系统对回答中的关键信息做自动核查:有权威信源支持的内容标绿色,来源模糊或尚未被主流媒体证实的内容标红色,并提示"需进一步核查"。 千问引证功能界面 该功能目前仅在特定场景触发,并非所有对话都会出现。当问题需…
Google Research 推出 TurboQuant,测试中将大模型 KV 缓存压到 3 比特
Google Research 公布了 TurboQuant,并同时介绍 QJL 与 PolarQuant。三套方法都围绕同一个问题:高维向量太占内存,长上下文大模型里的 KV 缓存和向量搜索系统都会被带宽与容量拖住。 TurboQuant 给出的结果很激进:在无需训练或微调的情况下,它能把 KV 缓存量化到 3 比特。在 long-context 的 ne…
腾讯撤销 AI Lab,密集引入字节 Seed 骨干推进混元升级
腾讯撤销 AI Lab,密集引入字节 Seed 骨干推进混元升级 腾讯这轮 AI 调整,已经从继续加码走到重新排兵布阵。 据《智能涌现》报道,腾讯近期持续重组大模型研发体系:一边撤销 AI Lab,原团队部分人员转入大语言模型部;另一边,则把多位原字节 Seed 技术骨干集中补到 AI Infra 与 RL 相关岗位。结合腾讯管理层在财报电话会上的表态来看,…
我国日均词元调用量突破140万亿,AI 进入规模化调用阶段
国家数据局披露,我国日均词元调用量今年3月已经突破140万亿。对比来看,2024年初这一数字还是1000亿,到2025年底升至100万亿,两年增长超过千倍。 我国日均词元调用量配图 这组数据首先说明,大模型调用已经不再停留在少数产品的试水阶段。调用量能在短时间内跨过多个数量级,背后通常意味着越来越多应用、平台和企业流程,开始把 AI 能力真正接进日常业务里。…
Kimi 员工指称 MiniMax 沿用其 Office Skill 代码始末
3月19日晚,知乎上一个ID为"error"的用户发布了一篇回答,指控MiniMax在M2.5模型中复用了Kimi Office Skill的相关代码,在AI开发者社区引发关注。 Kimi 员工指称 MiniMax 沿用其 Office Skill 代码始末 发生了什么 据这位自称参与Kimi Office Skill开发的用户描述,MiniMax于2026…
小米三款大模型齐发:MiMo-V2-Pro、Omni、TTS 完整解读
2026年3月19日,小米在 MiMo 开放平台同步上线三款大模型——MiMo-V2-Pro、MiMo-V2-Omni、MiMo-V2-TTS。这是小米首次以模型矩阵而非单一模型的方式对外亮相,三款产品分别对准 Agent 应用的不同核心能力:推理、全模态感知、语音合成。 小米三款大模型齐发:MiMo-V2-Pro、Omni、TTS 完整解读 MiMo-V2…
MiniMax 发布 M2.7:国内首个公开的模型自我进化方案
2026年3月18日,MiniMax 稀宇科技正式发布新一代 Agent 旗舰大模型 M2.7。这款模型的亮点不仅是性能提升,更是首次对外展示了「模型自我进化」的完整路径。 MiniMax 发布 M2.7:国内首个公开的模型自我进化方案 Agent Harness 体系:让模型参与自己的训练 M2.7 的核心突破在于引入了 Agent Harness 体系。…









