梁文锋 4 小时投资人会议:DeepSeek 的 AGI 路线图与克制哲学
DeepSeek 完成首轮外部融资 510 亿元后,创始人梁文锋在一场近 4 小时的投资者交流会上,用 118 条回答系统阐述了对 AGI、开源、国产芯片和商业化的判断。这是这家公司成立以来,创始人对外最完整的一次思想输出。 梁文锋 4 小时投资人会议:DeepSeek 的 AGI 路线图与克制哲学 融资轮的出资方阵容本身就是一道信号:梁文锋个人出资 200…
DeepSeek 完成首轮外部融资 510 亿元后,创始人梁文锋在一场近 4 小时的投资者交流会上,用 118 条回答系统阐述了对 AGI、开源、国产芯片和商业化的判断。这是这家公司成立以来,创始人对外最完整的一次思想输出。 梁文锋 4 小时投资人会议:DeepSeek 的 AGI 路线图与克制哲学 融资轮的出资方阵容本身就是一道信号:梁文锋个人出资 200…
DeepSeek 联合北大开源 DSpark:半自回归推测解码,推理速度提升 60% 至 85% 大语言模型生成文本时逐 token 串行计算,推理延迟随输出长度线性增长,这是 AI 对话系统响应偏慢的根本原因之一。推测解码是一条已知的加速路径:用轻量草稿模型快速生成若干候选 token,再由完整规模的大模型通过单次并行前向传播批量验证,接受符合目标分布的连…
DeepSeek 首轮外部融资:目标超 500 亿 The Information 援引两名直接知情人士消息称,DeepSeek 正推进成立以来的首轮外部融资,目标募集规模超过 500 亿元人民币。若本轮融资顺利落地,将刷新中国 AI 公司单笔融资纪录。 核心信息 融资规模与结构 目标总融资额超 500 亿元(约合 70 亿美元) 创始人梁文锋计划在此轮中顶…
NIST 下属人工智能标准与创新中心(CAISI)发布了对 DeepSeek V4 Pro 的评估报告。结论:DeepSeek V4 Pro 是 CAISI 迄今评估的最强中国 AI 模型,但综合能力比美国前沿模型落后约 8 个月。 核心结论 CAISI 使用了受项目反应理论(IRT)启发的聚合评估方法,在网络安全、软件工程、自然科学、抽象推理和数学五个领域…
2026 年 4 月 30 日,DeepSeek 公开技术报告《Thinking with Visual Primitives》,提出一种新的多模态推理范式——将点(point)和框(bounding box)等视觉基元作为思维的最小单元,交错嵌入推理链中。 问题:Reference Gap 当前多模态大模型虽然在「感知差距」(Perception Gap)…
DeepSeek 在其 API 定价页面更新公告,将 deepseek-v4-pro 模型的 2.5 折优惠期延长至北京时间 2026 年 5 月 31 日 23:59。 DeepSeek 将 V4-Pro 模型 2.5 折优惠延长至 5 月底 优惠价格 | 计费项 | 优惠价(2.5折) | 原价 | | --- | --- | --- | | 输入(缓存…
DeepSeek 今日公布 V4 系列模型的正式定价。目前提供两个模型:Flash(轻量快速)和 Pro(旗舰能力),均支持 1M 上下文长度、最大 384K 输出。 价格对比 | 项目 | Flash | Pro(限时 2.5 折) | Pro 原价 | |------|-------|-------------------|----------| | 输…
DeepSeek 今日正式发布 V4 系列模型预览版,同步开源。两个版本——V4-Pro 和 V4-Flash——均支持 1M 上下文长度,并在 Agent 能力上进行了专项优化。 V4-Pro 与顶级闭源模型评测对比 两个版本,两个定位 V4-Pro 是性能旗舰。在数学、STEM、竞赛型代码的评测中,V4-Pro 超越了当前所有已公开评测的开源模型,成绩追…