Claude 3.5 Sonnet New 直接控制电脑进行编程

Claude 3.5 Sonnet New 可直接操控本地电脑完成端到端编程:自动调用Chrome下载源码、在VS Code中编写调试网页、根据错误反馈自主修复bug,实现从分析、编码到运行的完整闭环,接近真实程序员工作流。

发布于2024年10月23日 07:04
编辑零重力瓦力
评论0
阅读74

Claude 3.5 sonnet New 真的将 AI 编程提升到了一个全新的境界。它不仅能通过提示词生成代码,还能直接操控电脑完成复杂的编程任务。在这段演示视频中,Anthropic 的工程师 Alex 演示了 Claude 如何复刻一个 90 年代风格的 Claude 官方网站首页。包括自动调用 Chrome 浏览器访问 claude.ai 网站,下载源码。随后,它会在 VS Code 中创建新的网页源码,并启动 Python 3 web 服务器进行调试。此外,Claude 还能根据 VS Code 返回的调试信息自动修复代码中的 bug。所有操作都由 Cluade 自动完成,与人类程序员的工作无异。

相关文章

GPT-5.6 发布当天 OpenAI 自曝 SWE-Bench Pro 30% 有问题
AI 新闻资讯
2026年7月14日
0 条评论
零重力瓦力

GPT-5.6 发布当天 OpenAI 自曝 SWE-Bench Pro 30% 有问题

OpenAI 在发布 GPT-5.6 当日指出 SWE-Bench Pro 约 30% 任务存在缺陷,引发对 AI 基准测试可靠性的质疑。多项研究进一步揭示,验证器质量决定模型学习方向,基准题目高度冗余,且模型“窄能力”提升未必转化为真实经济产出的“宽能力”。当前 AI 进步尚未达到自维持加速阈值。基准测试正面临结构性危机,其公信力受利益冲突影响,亟需建立独立第三方验证机制以确保评估客观性。

#ChatGPT#Claude
阅读全文
Ploy 从 Claude Opus 4.8 迁移到 GPT-5.6 完整实录
智能体工程
2026年7月14日
0 条评论
零重力瓦力

Ploy 从 Claude Opus 4.8 迁移到 GPT-5.6 完整实录

Ploy 公司将 AI agent 从 Claude Opus 4.8 迁移至 GPT-5.6 Sol 后,构建耗时缩短过半且成本降低,但过程中遭遇三大工程挑战。一是评测框架适配旧模型导致误判;二是新模型填充冗余参数引发工具调用异常,需通过 schema 变换解决;三是缓存机制差异致命中率归零,需重构 key 策略。这表明生产环境模型迁移并非简单替换,需针对调用习惯与基础设施进行深度工程适配。

#智能体工程#ChatGPT#Claude
阅读全文
Google 为何要开发 Gemma 4 模型
AI 产品工具
2026年7月11日
0 条评论
小创

Google 为何要开发 Gemma 4 模型

谷歌推出开源模型 Gemma 4,旨在解决网络受限地区无法使用前沿 AI 的问题。该模型追求内存占用下的智能最大化,首次具备多模态与智能体能力,支持在无网移动端高效运行复杂任务。目前已在乌干达离线医疗系统及秘鲁原住民语言保护等场景中落地应用。通过将大模型蒸馏至终端设备,Gemma 4 摆脱了对云端算力的依赖,推动去中心化开源生态发展,赋能各社区按需构建专属系统。

#开源模型#Google#Gemma
阅读全文
互动讨论

评论区

围绕《Claude 3.5 Sonnet New 直接控制电脑进行编程》展开交流,未登录用户可浏览评论,登录后可参与讨论。

评论数
0
登录后参与评论
支持发表观点与回复一级评论,互动后将同步到消息中心。
登录后评论
暂无评论,欢迎成为第一个参与讨论的人。