DeepSeek 开源 TileKernels:面向 Blackwell 架构的高性能 LLM 算子库
DeepSeek 于 4 月 23 日在 GitHub 上开源了高性能 GPU 算子库 TileKernels,基于 TileLang 框架开发。该库针对大语言模型的训练与推理场景进行了深度优化,算子性能已接近硬件计算强度与内存带宽的极限。 核心特性 TileKernels 的算子覆盖范围相当广泛: Gating — Top-k 专家选择与评分,用于 Mix…
DeepSeek 于 4 月 23 日在 GitHub 上开源了高性能 GPU 算子库 TileKernels,基于 TileLang 框架开发。该库针对大语言模型的训练与推理场景进行了深度优化,算子性能已接近硬件计算强度与内存带宽的极限。 核心特性 TileKernels 的算子覆盖范围相当广泛: Gating — Top-k 专家选择与评分,用于 Mix…
据财联社援引媒体消息,腾讯控股和阿里集团正在洽谈投资 DeepSeek,这家 AI 公司首次公开筹资的估值目标超过 200 亿美元。消息援引四位知情人士,目前尚未获官方确认。 DeepSeek 200 亿美元意味着什么 200 亿美元放在当前中国 AI 投资市场里,超过绝大多数 AI 公司的估值总和。DeepSeek 凭借开源大模型路线在全球 AI 圈站稳脚…
中国人工智能初创公司 DeepSeek 拟以 100 亿美元估值开展新一轮融资,计划筹资至少 3 亿美元。该公司此前曾多次拒绝中国顶级风投及科技巨头的入股邀约。 DeepSeek 拟以 100 亿美元估值融资至少 3 亿美元 此次融资旨在支持先进推理模型的开发,应对日益增长的算力与研发资本需求。DeepSeek 曾利用英伟达高性能芯片完成模型训练,尽管面临美…
DeepSeek 发布 DeepGEMM 重大更新:Mega MoE 融合算子与 FP4 精度支持 DeepSeek发布DeepGEMM重大更新:MegaMoE融合算子与FP4精度支持 4 月 16 日,DeepSeek 开源了其高性能 CUDA 算子库 DeepGEMM 的重大更新(PR #304),新增 Mega MoE 融合算子、FP8×FP4 GEM…
2026年4月13日,斯坦福大学以人为本人工智能研究所(Stanford HAI)发布了备受瞩目的《2026年AI指数报告》。这份年度报告是全球AI领域最权威的综合性数据盘点之一,覆盖模型能力、投资趋势、就业影响、地缘政治等多个维度。 今年报告最具冲击力的核心发现:中美两国在最顶级AI模型上的性能差距已经几乎消失。截至2026年3月,排名第一的美国模型仅领先…
据新浪科技 4 月 10 日报道,DeepSeek 创始人梁文锋在内部沟通中透露,DeepSeek V4 将于今年 4 月下旬正式发布。这距离 DeepSeek-R1 的爆火仅过去数月,迭代速度令人瞩目。 DeepSeek V4 即将发布:万亿参数、百万上下文、全面适配国产芯片 核心参数:万亿级规模 + 百万级上下文 DeepSeek V4 将达到万亿参数规…
DeepSeek 服务中断 2026 年 3 月 29 日晚至 30 日凌晨,DeepSeek 出现大规模服务中断。网页端和 App 反复提示"服务器繁忙""请检查网络后重试",大量用户无法登录、正在进行的对话中断、部分用户报告内容丢失。"DeepSeek 崩了"迅速登上微博热搜。 两次应急,问题未解 根据 DeepSeek 官方事件报告: 29 日 21:…
乐天正式开放了日语大模型 Rakuten AI 3.0。按官方说法,这是一款作为日本经济产业省与 NEDO 推动的 GENIAC 项目成果之一、面向日语优化的超大规模模型,并且在多项日语基准上跑出了高于 gpt-4o 的成绩。 乐天开放 Rakuten AI 3.0:日语成绩单很亮眼,DeepSeek V3 架构标签也把争议一起带了出来 但这条消息真正引发讨…