千问首次开源Max级权重:Qwen3.8-2.4T-A95B架构与benchmark解读
Qwen 首次开源 Max 级权重 千问团队在 HuggingFace 上发布了 Qwen3.8-2.4T-A95B 的完整模型权重。这是 Qwen 系列第一次将 Max 级旗舰模型以开放权重形式释出。此前 Qwen3.5 和 Qwen3.6 系列虽然广泛开源,但 Max 级旗舰始终只通过 API 提供。 Qwen3.8-2.4T-A95B 开源仓库包含完整…
Qwen 首次开源 Max 级权重 千问团队在 HuggingFace 上发布了 Qwen3.8-2.4T-A95B 的完整模型权重。这是 Qwen 系列第一次将 Max 级旗舰模型以开放权重形式释出。此前 Qwen3.5 和 Qwen3.6 系列虽然广泛开源,但 Max 级旗舰始终只通过 API 提供。 Qwen3.8-2.4T-A95B 开源仓库包含完整…
LTX-2.5 开源视频模型:单卡 RTX 5090 本地运行,瑕疵率评测十款模型登顶 视频生成模型的开源阵营再添一员。LTX(Lightricks 旗下的视频 AI 品牌)发布了 LTX-2.5 视频生成基础模型,22B 参数,权重、训练代码和推理管线全部开放下载。单张 RTX 5090 即可本地部署,最低 16GB 显存即可运行。年收入低于 1000 万…
Muse Glimmer 2026 年 8 月 10 日,Meta 超级智能实验室(Meta Superintelligence Labs)发布 Muse Glimmer,一款拥有 300 亿参数的稠密语言模型。模型权重以 Apache 2.0 许可证开放,目前已在 Hugging Face 提供下载。 Muse Glimmer 的定位很明确:面向本地智能体…
7月9日,蚂蚁灵波开源了LingBot-Video,全球第一个基于MoE(混合专家)架构、面向具身智能的视频生成基础模型。在北京大学联合字节跳动发布的RBench评测基准上,LingBot-Video总分0.620排名第一,超过了Wan 2.6(0.607)、Seedance 1.5 Pro(0.584)、Cosmos 3 Super(0.581)和Veo…
NVIDIA Nemotron 3 Nano Omni:一个开放模型统一视觉、音频和语言 4 月 28 日,NVIDIA 发布 Nemotron 3 Nano Omni,一个开放权重的全模态理解模型,将视觉、音频和语言处理统一到单一架构中。模型采用 30B-A3B 混合专家(MoE)架构,总参数 300 亿,每个 token 仅激活 35 亿参数,支持 25…
小米正式开源 MiMo-V2.5 系列模型,采用 MIT 协议,支持免授权商业部署、持续训练和微调。该系列包含两款模型:MiMo-V2.5-Pro 专注于复杂 Agent 和代码任务,MiMo-V2.5 为原生全模态模型。两款模型均支持 1M token 上下文窗口。 Benchmark 对比分析 Benchmark Results 官方公布的 benchm…
腾讯混元正式发布并开源 Hy3 preview,这是混元团队今年 2 月重建预训练和强化学习基础设施后训练的第一个模型,也是迄今最智能的混元模型。 Hy3 preview Logo 模型规格 | 项目 | 参数 | |------|------| | 架构 | 混合专家模型(MoE),快慢思考融合 | | 总参数 | 295B | | 激活参数 | 21B…
阿里通义千问团队发布 Qwen3.6-27B,一个 270 亿参数的稠密多模态模型。仅凭 27B 参数,在所有主要编程基准上全面超越上一代开源旗舰 Qwen3.5-397B-A17B(3970 亿参数 MoE,170 亿激活)。 Qwen3.6-27B 编程能力:Agent 实操提升最显著 Qwen3.6-27B 与前代旗舰的对比数据: | 基准 | Qwe…
Google 发布了 Gemma 4 开放模型家族,提供 E2B、E4B、26B MoE 和 31B Dense 四种规格,以 Apache 2.0 许可证开放,全系列覆盖从 Android 手机到开发工作站的硬件范围。 四种规格,各有侧重 Gemma 4 的四个模型定位明确: E2B 和 E4B 面向端侧设备,可在 Android 手机、笔记本甚至 Ras…