MiniMax M3 发布:1M 上下文 + 原生多模态 + 前沿 Coding
MiniMax M3 Benchmark MiniMax 今日正式发布 M3 模型。这是一个同时具备前沿 Coding 能力、百万级上下文和原生多模态的模型——国内第一个,也是目前全球唯一达成这一配置的开源模型。 M3 采用 MiniMax 自研的 MSA(MiniMax Sparse Attention)稀疏注意力架构,最高支持 1M 上下文窗口。在 10…
MiniMax M3 Benchmark MiniMax 今日正式发布 M3 模型。这是一个同时具备前沿 Coding 能力、百万级上下文和原生多模态的模型——国内第一个,也是目前全球唯一达成这一配置的开源模型。 M3 采用 MiniMax 自研的 MSA(MiniMax Sparse Attention)稀疏注意力架构,最高支持 1M 上下文窗口。在 10…
DeepSeek 今日正式发布 V4 系列模型预览版,同步开源。两个版本——V4-Pro 和 V4-Flash——均支持 1M 上下文长度,并在 Agent 能力上进行了专项优化。 V4-Pro 与顶级闭源模型评测对比 两个版本,两个定位 V4-Pro 是性能旗舰。在数学、STEM、竞赛型代码的评测中,V4-Pro 超越了当前所有已公开评测的开源模型,成绩追…
月之暗面(Moonshot AI)发布了 Kimi K2.6 模型,在多项主流 Agent 和编码基准测试中取得开源 SOTA,多项指标追平甚至超越 GPT-5.4、Claude Opus 4.6 等闭源模型。 Kimi K2.6 Benchmark 基准表现 与 GPT-5.4 (xhigh)、Claude Opus 4.6 (max effort)、Ge…
Google Research 公布了 TurboQuant,并同时介绍 QJL 与 PolarQuant。三套方法都围绕同一个问题:高维向量太占内存,长上下文大模型里的 KV 缓存和向量搜索系统都会被带宽与容量拖住。 TurboQuant 给出的结果很激进:在无需训练或微调的情况下,它能把 KV 缓存量化到 3 比特。在 long-context 的 ne…
腾讯撤销 AI Lab,密集引入字节 Seed 骨干推进混元升级 腾讯这轮 AI 调整,已经从继续加码走到重新排兵布阵。 据《智能涌现》报道,腾讯近期持续重组大模型研发体系:一边撤销 AI Lab,原团队部分人员转入大语言模型部;另一边,则把多位原字节 Seed 技术骨干集中补到 AI Infra 与 RL 相关岗位。结合腾讯管理层在财报电话会上的表态来看,…
3月19日晚,知乎上一个ID为"error"的用户发布了一篇回答,指控MiniMax在M2.5模型中复用了Kimi Office Skill的相关代码,在AI开发者社区引发关注。 Kimi 员工指称 MiniMax 沿用其 Office Skill 代码始末 发生了什么 据这位自称参与Kimi Office Skill开发的用户描述,MiniMax于2026…
2026年3月19日,小米在 MiMo 开放平台同步上线三款大模型——MiMo-V2-Pro、MiMo-V2-Omni、MiMo-V2-TTS。这是小米首次以模型矩阵而非单一模型的方式对外亮相,三款产品分别对准 Agent 应用的不同核心能力:推理、全模态感知、语音合成。 小米三款大模型齐发:MiMo-V2-Pro、Omni、TTS 完整解读 MiMo-V2…
2026年3月18日,MiniMax 稀宇科技正式发布新一代 Agent 旗舰大模型 M2.7。这款模型的亮点不仅是性能提升,更是首次对外展示了「模型自我进化」的完整路径。 MiniMax 发布 M2.7:国内首个公开的模型自我进化方案 Agent Harness 体系:让模型参与自己的训练 M2.7 的核心突破在于引入了 Agent Harness 体系。…
乐天正式开放了日语大模型 Rakuten AI 3.0。按官方说法,这是一款作为日本经济产业省与 NEDO 推动的 GENIAC 项目成果之一、面向日语优化的超大规模模型,并且在多项日语基准上跑出了高于 gpt-4o 的成绩。 乐天开放 Rakuten AI 3.0:日语成绩单很亮眼,DeepSeek V3 架构标签也把争议一起带了出来 但这条消息真正引发讨…