标签: AI

清除筛选

华为开源 920 亿参数 openPangu-2.0-Flash 模型

华为 6 月 30 日正式开源 openPangu-2.0-Flash 模型,首批上线内容包括模型权重、基础推理代码和训推算子。 openPangu 2.0 发布会现场 openPangu-2.0-Flash 总参数量 920 亿,激活参数量 60 亿,采用 MoE(混合专家)架构,稀疏比达到 28:1,支持 512K 上下文窗口。该模型全链路基于华为自研昇…

开源AI华为

DeepSeek 联合北大开源 DSpark:半自回归推测解码,推理速度提升 57% 至 85%

DeepSeek 联合北大开源 DSpark:半自回归推测解码,推理速度提升 60% 至 85% 大语言模型生成文本时逐 token 串行计算,推理延迟随输出长度线性增长,这是 AI 对话系统响应偏慢的根本原因之一。推测解码是一条已知的加速路径:用轻量草稿模型快速生成若干候选 token,再由完整规模的大模型通过单次并行前向传播批量验证,接受符合目标分布的连…

Anthropic 获美国政府批准,恢复 Mythos 5 模型对关键基础设施组织的部署

Anthropic 获美国政府批准,恢复 Mythos 5 模型对关键基础设施组织的部署 Anthropic Claude Mythos 5 6 月 27 日,Anthropic 宣布美国政府在经过两周审查后,已正式批准其最强网络安全模型 Claude Mythos 5 重新部署给一批运营和防御美国关键基础设施的机构。这是自 6 月 12 日美国政府以国家安…

Cursor 研究:越强的 AI 模型越会"作弊"应对编程基准测试

Cursor 团队发布研究,揭示了 AI 编程基准测试中普遍存在的"奖励作弊"现象:模型越强,越擅长绕过测试本意,通过检索已知答案来刷高分。 SWE-bench Multilingual 标准与严格环境得分对比 研究让审计模型审查了 731 条 Opus 4.8 Max 在 SWE-bench Pro 上的运行轨迹,发现 63% 的成功案例并非模型自行推导,…

Xcode 26.6 正式版新增 Google Gemini 编程助手

Apple 发布 Xcode 26.6 正式版,在 IDE 的编程助手功能中新增了 Google Gemini 作为 AI 提供商选项。此前 Xcode 已支持 Anthropic Claude Agent 和 OpenAI Codex,Gemini 的加入使编程助手选项扩展到三个。 Xcode 26.6 Xcode 26.6 包含 Swift 6.3.3,…

AppleAIXcode

美国政府要求 OpenAI 分阶段发布 GPT-5.6

6月25日,The Information 报道,OpenAI CEO Sam Altman 在周三的员工问答会上透露,GPT-5.6 将根据联邦政府要求,先向少数合作伙伴开放限量预览,而非直接公开发布。预览期间,政府将逐个客户批准访问权限。 Altman 在一份内部备忘录中表示,这是通向大规模发布的最快路径。如果审查顺利,他希望"几周后"能更大范围推出。…

字节 Seed 2.1 Pro Preview 杀入 Code Arena 前端前十

字节跳动的 Seed 2.1 Pro Preview 在 Arena.ai 的 Code Arena 前端排行榜上冲到第 8,得分 1539,和 Claude Opus 4.6(1538)几乎并驾齐驱。 Code Arena Frontend 排行榜 这个成绩在七个分项中的五个进了前十。在这些领域里,排在它前面的只有 GLM-5.2 和 Claude 两家。…

实测运营商Token套餐:一句你好烧5万Token,开发者直呼用不起

"9.9元买千万Token""1元体验AI算力套餐",三大运营商集体推出了Token(词元)套餐,把AI算力包装成类似流量包的产品售卖。《每日经济新闻》记者实测发现,输入一句"你好"就烧掉约5万Token,15元的套餐不到一小时就见底。有开发者折算后表示,月成本是主流AI订阅的五六倍。 一句"你好"烧5万Token 记者分别购买了联通云15元套餐(含600万…