能自主运行数天的神话级模型 Claude Fable 5 正式发布

Anthropic 发布最强模型 Claude Fable 5 并向公众开放。针对此前预览版存在的安全隐患,该模型引入安全路由机制,将高风险请求自动分流至 Opus 4.8 处理,在保障安全的同时释放通用能力。Fable 5 具备超高自主性,可连续数天独立处理金融、法律及科研等领域的复杂项目,无需人工干预。这种长周期、高自主性的任务处理能力,有望彻底改变现有工作流。

发布于2026年6月13日 21:22
编辑小创
评论0
阅读23

Anthropic 正式发布了目前最强大的模型 Claude Fable 5 并且向公众开放。这款被称为神话级的模型在发布前经历了一段曲折。此前由于预览版模型(Mythos)能轻易找出数千个网络安全漏洞,出于安全隐患,没有直接公开,转而将其提供给安全防御人员。为了让大家都能用上这款顶级模型,开发团队设计了一套很有意思的安全路由机制。当用户提交涉及网络安全或生物学等高风险领域的请求时,系统会自动将请求重定向到较温和的 Opus 4.8 处理。这种分流设计在保障安全底线的同时,最大化释放了 Fable 5 的通用能力。在实际应用中,这款模型最强的地方在于超高的自主性。它不仅能写代码,还能处理金融、法律、科学研究等领域的复杂项目,甚至可以连续自主运行数天而不需要人工干预。这种长周期、高自主性的任务处理能力,可能会彻底改变我们日常的工作流。

相关文章

GPT-5.6 发布当天 OpenAI 自曝 SWE-Bench Pro 30% 有问题
AI 新闻资讯
2026年7月14日
0 条评论
零重力瓦力

GPT-5.6 发布当天 OpenAI 自曝 SWE-Bench Pro 30% 有问题

OpenAI 在发布 GPT-5.6 当日指出 SWE-Bench Pro 约 30% 任务存在缺陷,引发对 AI 基准测试可靠性的质疑。多项研究进一步揭示,验证器质量决定模型学习方向,基准题目高度冗余,且模型“窄能力”提升未必转化为真实经济产出的“宽能力”。当前 AI 进步尚未达到自维持加速阈值。基准测试正面临结构性危机,其公信力受利益冲突影响,亟需建立独立第三方验证机制以确保评估客观性。

#ChatGPT#Claude
阅读全文
Ploy 从 Claude Opus 4.8 迁移到 GPT-5.6 完整实录
智能体工程
2026年7月14日
0 条评论
零重力瓦力

Ploy 从 Claude Opus 4.8 迁移到 GPT-5.6 完整实录

Ploy 公司将 AI agent 从 Claude Opus 4.8 迁移至 GPT-5.6 Sol 后,构建耗时缩短过半且成本降低,但过程中遭遇三大工程挑战。一是评测框架适配旧模型导致误判;二是新模型填充冗余参数引发工具调用异常,需通过 schema 变换解决;三是缓存机制差异致命中率归零,需重构 key 策略。这表明生产环境模型迁移并非简单替换,需针对调用习惯与基础设施进行深度工程适配。

#智能体工程#ChatGPT#Claude
阅读全文
Google 为何要开发 Gemma 4 模型
AI 产品工具
2026年7月11日
0 条评论
小创

Google 为何要开发 Gemma 4 模型

谷歌推出开源模型 Gemma 4,旨在解决网络受限地区无法使用前沿 AI 的问题。该模型追求内存占用下的智能最大化,首次具备多模态与智能体能力,支持在无网移动端高效运行复杂任务。目前已在乌干达离线医疗系统及秘鲁原住民语言保护等场景中落地应用。通过将大模型蒸馏至终端设备,Gemma 4 摆脱了对云端算力的依赖,推动去中心化开源生态发展,赋能各社区按需构建专属系统。

#开源模型#Google#Gemma
阅读全文
互动讨论

评论区

围绕《能自主运行数天的神话级模型 Claude Fable 5 正式发布》展开交流,未登录用户可浏览评论,登录后可参与讨论。

评论数
0
登录后参与评论
支持发表观点与回复一级评论,互动后将同步到消息中心。
登录后评论
暂无评论,欢迎成为第一个参与讨论的人。