DeepSeek Harness RC.8:多模态输入与子代理编排
DeepSeek Harness 在 8 月 17 日发布 RC.7 两天后,8 月 19 日 23 点左右放出了 RC.8。这个 8 月 13 日才创建的 GitHub 仓库,star 数已超过 17.1 万,dsh-plugin 话题下的生态仓库接近 9000 个。RC.8 的更新横跨多模态输入、子代理、工具调用、Windows 终端和底层存储,官方 c…
DeepSeek Harness 在 8 月 17 日发布 RC.7 两天后,8 月 19 日 23 点左右放出了 RC.8。这个 8 月 13 日才创建的 GitHub 仓库,star 数已超过 17.1 万,dsh-plugin 话题下的生态仓库接近 9000 个。RC.8 的更新横跨多模态输入、子代理、工具调用、Windows 终端和底层存储,官方 c…
2026 年 8 月 13 日,DeepSeek 在官网 API 文档页悄然更新了一行模型版本号:deepseek-v4-pro 的 fingerprint 从预览版变为 fpv4pro20260812。没有发布会,没有直播,从 4 月 24 日预览版上线到正式版发布,中间隔了 111 天。 在这 111 天里,Kimi K3 高调发布抢走开源头条,同门的…
DeepSeek-Reasonix GitHub 仓库 终端 AI 编程助手赛道又添一名选手。DeepSeek-Reasonix 是一个围绕 DeepSeek 模型构建的开源命令行编码代理,由 esengine 团队以 MIT 协议在 GitHub 开源,目前积累了超过 3 万 star。项目从 TypeScript 实现迁移到了 Go 单二进制架构,核心设…
DeepSeek 完成首轮外部融资 510 亿元后,创始人梁文锋在一场近 4 小时的投资者交流会上,用 118 条回答系统阐述了对 AGI、开源、国产芯片和商业化的判断。这是这家公司成立以来,创始人对外最完整的一次思想输出。 梁文锋 4 小时投资人会议:DeepSeek 的 AGI 路线图与克制哲学 融资轮的出资方阵容本身就是一道信号:梁文锋个人出资 200…
DeepSeek 联合北大开源 DSpark:半自回归推测解码,推理速度提升 60% 至 85% 大语言模型生成文本时逐 token 串行计算,推理延迟随输出长度线性增长,这是 AI 对话系统响应偏慢的根本原因之一。推测解码是一条已知的加速路径:用轻量草稿模型快速生成若干候选 token,再由完整规模的大模型通过单次并行前向传播批量验证,接受符合目标分布的连…
NIST 下属人工智能标准与创新中心(CAISI)发布了对 DeepSeek V4 Pro 的评估报告。结论:DeepSeek V4 Pro 是 CAISI 迄今评估的最强中国 AI 模型,但综合能力比美国前沿模型落后约 8 个月。 核心结论 CAISI 使用了受项目反应理论(IRT)启发的聚合评估方法,在网络安全、软件工程、自然科学、抽象推理和数学五个领域…
2026 年 4 月 30 日,DeepSeek 公开技术报告《Thinking with Visual Primitives》,提出一种新的多模态推理范式——将点(point)和框(bounding box)等视觉基元作为思维的最小单元,交错嵌入推理链中。 问题:Reference Gap 当前多模态大模型虽然在「感知差距」(Perception Gap)…
DeepSeek 今日正式发布 V4 系列模型预览版,同步开源。两个版本——V4-Pro 和 V4-Flash——均支持 1M 上下文长度,并在 Agent 能力上进行了专项优化。 V4-Pro 与顶级闭源模型评测对比 两个版本,两个定位 V4-Pro 是性能旗舰。在数学、STEM、竞赛型代码的评测中,V4-Pro 超越了当前所有已公开评测的开源模型,成绩追…