标签
热门推荐
- Anthropic 洽谈由三星代工自研 AI 芯片7/2/2026
- 长鑫存储拿下腾讯200亿DRAM大单:IPO前的战略绑定6/29/2026
- 苹果 A20 Pro 改用 WMCM 封装,内存移至芯片侧面改善散热6/27/2026
- 美国政府要求 OpenAI 分阶段发布 GPT-5.66/26/2026
- OPPO 整合一加与真我系统,全球统一启用 ColorOS7/3/2026
- Anthropic 获美国政府批准,恢复 Mythos 5 模型对关键基础设施组织的部署6/27/2026
- 腾讯玄武阿图因AI在CyberGym测试中超越Mythos7/3/2026
- 华为开源 920 亿参数 openPangu-2.0-Flash 模型6/30/2026
标签: Qwen 清除筛选
Qwen 开源高性能线性注意力内核库 FlashQLA,速度提升 2-3 倍
Qwen 团队正式开源 FlashQLA——一个基于 TileLang 实现的高性能线性注意力算子库,专为 Gated Delta Network(GDN)打造。该项目将 GDN Chunked Prefill 的前向和反向进行了合理的算子融合与代数优化,在 NVIDIA Hopper 上实现多场景相较于 FLA Triton Kernel 2-3× 前向加速和 2× 反向加速。
背景自 Qwen3-Next 发布以来,Gated Delta Network 已成为 Qwen 全系列的主力注意力层,覆盖 Qwen3-Next、Qwen3.5、Qwen3.6 等系列。
Qwen3.6-27B 开源发布,27B 稠密模型编程能力全面超越前代 397B 旗舰
阿里通义千问团队发布 Qwen3.6-27B,一个 270 亿参数的稠密多模态模型。仅凭 27B 参数,在所有主要编程基准上全面超越上一代开源旗舰 Qwen3.5-397B-A17B(3970 亿参数 MoE,170 亿激活)。
编程能力:Agent 实操提升最显著Qwen3.6-27B 与前代旗舰的对比数据:
| 基准 | Qwen3.6-27B | Qwen3.5-397B-A17B
阿里上线 Qwen3.6-Max-Preview 预览版:智能体编程能力大幅提升
阿里发布 Qwen3.6-Max-Preview 预览版,旗舰模型聚焦智能体编程与世界知识能力的迭代。
核心提升相比 Qwen3.6-Plus,预览版在智能体编程方面取得显著提升:SciCode +10.8、SkillsBench +9.9、NL2Repo +5.0、Terminal-Bench 2.0 +3.8。在六项编程基准上登顶首位:SWE-bench Pro、Terminal-Bench 2.0、SkillsBench、QwenClawBench、QwenWebBench 和 SciCode。


