DeepSeek-V4 正式上线:1M 上下文标配,Flash 输入 0.2 元/百万 token
DeepSeek 今日正式发布 V4 系列模型预览版,同步开源。两个版本——V4-Pro 和 V4-Flash——均支持 1M 上下文长度,并在 Agent 能力上进行了专项优化。 V4-Pro 与顶级闭源模型评测对比 两个版本,两个定位 V4-Pro 是性能旗舰。在数学、STEM、竞赛型代码的评测中,V4-Pro 超越了当前所有已公开评测的开源模型,成绩追…
DeepSeek 今日正式发布 V4 系列模型预览版,同步开源。两个版本——V4-Pro 和 V4-Flash——均支持 1M 上下文长度,并在 Agent 能力上进行了专项优化。 V4-Pro 与顶级闭源模型评测对比 两个版本,两个定位 V4-Pro 是性能旗舰。在数学、STEM、竞赛型代码的评测中,V4-Pro 超越了当前所有已公开评测的开源模型,成绩追…
Anthropic 发布了一篇详细的事后分析报告,承认 Claude Code 在过去一个月中经历的严重性能退化,根源在于三个彼此独立的技术问题。这些问题在时间线上交错叠加,导致用户感受到的是整体能力的全面下滑。 Claude Code 性能退化分析 问题一:推理力度下调 时间范围:2025年3月4日 — 4月7日 今年2月 Opus 4.6 发布时,Ant…
一个不存在的人,收割了美国保守派数千美元 据 WIRED 和多家媒体报道,一名22岁的印度医学生利用 AI 技术构建了一个虚假的政治网红账号"Emily Hart",精准投放亲 Trump、反移民的保守派内容,成功从美国 MAGA 群体中获利数千美元。 从普通美女照到 MAGA 网红的转型 这名化名为 Sam 的学生最初只是在 Instagram 上发布普通…
Anthropic 上周发布了一个名为 Mythos 的顶级网络安全模型,号称具备批量发现零日漏洞、渗透主流操作系统的能力。出于安全考虑,Anthropic 仅在极小范围内向 Apple、Amazon、Cisco 等企业开放封闭测试,项目代号 Glasswing。 但彭博社 4 月 22 日披露,一个规模不大的 Discord 私人社群在 Mythos 发布…
特斯拉一季度交出了一份明显超出华尔街预期的季报:总营收同比增长 16%,毛利率升至 21% 创三年新高,自由现金流翻倍。但管理层在电话会上预告今年资本支出将超过 250 亿美元,远超此前指引的逾 200 亿,股价盘后由涨超 4% 转跌超 2%。 营收与利润 一季度总营收 223.87 亿美元,同比增长 16%,扭转了去年四季度同比下滑 3% 的势头,创 20…
阿里通义千问团队发布 Qwen3.6-27B,一个 270 亿参数的稠密多模态模型。仅凭 27B 参数,在所有主要编程基准上全面超越上一代开源旗舰 Qwen3.5-397B-A17B(3970 亿参数 MoE,170 亿激活)。 Qwen3.6-27B 编程能力:Agent 实操提升最显著 Qwen3.6-27B 与前代旗舰的对比数据: | 基准 | Qwe…
据财联社援引媒体消息,腾讯控股和阿里集团正在洽谈投资 DeepSeek,这家 AI 公司首次公开筹资的估值目标超过 200 亿美元。消息援引四位知情人士,目前尚未获官方确认。 DeepSeek 200 亿美元意味着什么 200 亿美元放在当前中国 AI 投资市场里,超过绝大多数 AI 公司的估值总和。DeepSeek 凭借开源大模型路线在全球 AI 圈站稳脚…
特斯拉中国车机接入豆包与 DeepSeek:双模型架构完成网信备案 据网信上海消息,特斯拉车机语音大模型服务于 4 月 20 日完成备案。据《科创板日报》从知情人士处获悉,特斯拉车机语音服务将接入豆包大模型。 此前特斯拉中国官网更新的《车机语音助手使用条款》已经透露了更多细节:Model Y L 车型将同时搭载豆包大模型与 DeepSeek 模型,两款模型均…