
英伟达表示,DeepSeek-R1 让 Blackwell 架构的性能大升级!相比四周前的 NVIDIA H100,不仅能带来 25 倍的收益提升,每个 Token 的成本还降低了 20 倍,性价比拉满![威武]
这一切都得益于 TensorRT DeepSeek 的优化,尤其是 FP4 计算,在保持超高精度的同时,在 MMLU 通用智能测试 中达到了 FP8 版本 99.8% 的得分,可谓既快又准!

现在,FP4 优化版 DeepSeek checkpoint 已正式上线 Huggface。

英伟达表示,DeepSeek-R1 让 Blackwell 架构的性能大升级!相比四周前的 NVIDIA H100,不仅能带来 25 倍的收益提升,每个 Token 的成本还降低了 20 倍,性价比拉满![威武]
这一切都得益于 TensorRT DeepSeek 的优化,尤其是 FP4 计算,在保持超高精度的同时,在 MMLU 通用智能测试 中达到了 FP8 版本 99.8% 的得分,可谓既快又准!

现在,FP4 优化版 DeepSeek checkpoint 已正式上线 Huggface。

Google DeepMind 发布基于认知科学的 AGI 评估框架,将通用智能分解为感知、学习、推理等 10 项核心认知能力,并设计三级评估协议将 AI 与人类能力对标。同步启动 Kaggle 黑客松竞赛,总奖金 20 万美元。该框架标志着 AGI 评估从“能力展示”转向“认知溯源”,但认知能力边界界定等挑战仍待解决。

OpenAI CEO Altman 位于旧金山的住宅遭燃烧弹袭击,警方在其总部逮捕嫌疑人。袭击前,《纽约客》发表长文批评 Altman 是“近乎偏执的权力追逐者”。 Altman 随后发博客承认自己“回避冲突”的性格带来诸多问题,向被伤害者致歉,同时呼吁行业降低对抗性。该事件折射出 AI 行业对“控制 AGI”的偏执渴望。当技术权力被神话化,冲突似乎难以避免。

OpenAI 正在推进重大产品整合计划,将 ChatGPT 、 Atlas 浏览器及代码工具统一到基于 Codex 的桌面应用中。 Codex 客户端中发现的“心跳系统”暗示其正在构建托管智能体能力,支持自主进程后台运行和多步骤工作流执行。此举被视为对 Anthropic 旗下 Conway 项目的直接回应。 Codex 同时测试的 Scratchpad 功能支持并行对话执行。若整合成功,将重新定义“AI 操作系统”边界,行业竞争也已转向由自主智能体驱动的全能桌面应用。
围绕《DeepSeek-R1 让 Blackwell 架构的性能大升级》展开交流,未登录用户可浏览评论,登录后可参与讨论。