标签: 大模型

清除筛选

MiniMax M3 发布:1M 上下文 + 原生多模态 + 前沿 Coding

MiniMax M3 Benchmark MiniMax 今日正式发布 M3 模型。这是一个同时具备前沿 Coding 能力、百万级上下文和原生多模态的模型——国内第一个,也是目前全球唯一达成这一配置的开源模型。 M3 采用 MiniMax 自研的 MSA(MiniMax Sparse Attention)稀疏注意力架构,最高支持 1M 上下文窗口。在 10…

DeepSeek-V4 正式上线:1M 上下文标配,Flash 输入 0.2 元/百万 token

DeepSeek 今日正式发布 V4 系列模型预览版,同步开源。两个版本——V4-Pro 和 V4-Flash——均支持 1M 上下文长度,并在 Agent 能力上进行了专项优化。 V4-Pro 与顶级闭源模型评测对比 两个版本,两个定位 V4-Pro 是性能旗舰。在数学、STEM、竞赛型代码的评测中,V4-Pro 超越了当前所有已公开评测的开源模型,成绩追…

小米 MiMo-V2.5 公测:4.3 小时从零写完编译器,Token 效率领先竞品

小米正式发布 MiMo-V2.5 系列大模型并开启公测。最直观的 demo 来自代码生成领域:MiMo-V2.5-Pro 用 4.3 小时(672 次工具调用)从零写了一个完整的 SysY 编译器(Rust 实现),233 个测试全部通过。 SysY 是南京大学编译原理课的教学语言,涵盖词法分析、语法树构建、Koopa IR 中间代码生成、RISC-V 后端…

腾讯撤销 AI Lab,密集引入字节 Seed 骨干推进混元升级

腾讯撤销 AI Lab,密集引入字节 Seed 骨干推进混元升级 腾讯这轮 AI 调整,已经从继续加码走到重新排兵布阵。 据《智能涌现》报道,腾讯近期持续重组大模型研发体系:一边撤销 AI Lab,原团队部分人员转入大语言模型部;另一边,则把多位原字节 Seed 技术骨干集中补到 AI Infra 与 RL 相关岗位。结合腾讯管理层在财报电话会上的表态来看,…

Kimi 员工指称 MiniMax 沿用其 Office Skill 代码始末

3月19日晚,知乎上一个ID为"error"的用户发布了一篇回答,指控MiniMax在M2.5模型中复用了Kimi Office Skill的相关代码,在AI开发者社区引发关注。 Kimi 员工指称 MiniMax 沿用其 Office Skill 代码始末 发生了什么 据这位自称参与Kimi Office Skill开发的用户描述,MiniMax于2026…

小米三款大模型齐发:MiMo-V2-Pro、Omni、TTS 完整解读

2026年3月19日,小米在 MiMo 开放平台同步上线三款大模型——MiMo-V2-Pro、MiMo-V2-Omni、MiMo-V2-TTS。这是小米首次以模型矩阵而非单一模型的方式对外亮相,三款产品分别对准 Agent 应用的不同核心能力:推理、全模态感知、语音合成。 小米三款大模型齐发:MiMo-V2-Pro、Omni、TTS 完整解读 MiMo-V2…

MiniMax 发布 M2.7:国内首个公开的模型自我进化方案

2026年3月18日,MiniMax 稀宇科技正式发布新一代 Agent 旗舰大模型 M2.7。这款模型的亮点不仅是性能提升,更是首次对外展示了「模型自我进化」的完整路径。 MiniMax 发布 M2.7:国内首个公开的模型自我进化方案 Agent Harness 体系:让模型参与自己的训练 M2.7 的核心突破在于引入了 Agent Harness 体系。…

乐天开放 Rakuten AI 3.0:日语成绩单很亮眼,DeepSeek V3 架构标签也把争议一起带了出来

乐天正式开放了日语大模型 Rakuten AI 3.0。按官方说法,这是一款作为日本经济产业省与 NEDO 推动的 GENIAC 项目成果之一、面向日语优化的超大规模模型,并且在多项日语基准上跑出了高于 gpt-4o 的成绩。 乐天开放 Rakuten AI 3.0:日语成绩单很亮眼,DeepSeek V3 架构标签也把争议一起带了出来 但这条消息真正引发讨…