全部评论
谈谈您的想法...
Anthropic发布Claude Opus 4.7,多项基准测试超越GPT-5.4和Gemini 3.1 Pro
市场资讯 2026-04-17 10:59:45
10秒看完全文要点
4月17日,AI公司Anthropic正式发布旗舰模型Claude Opus 4.7,该版本在多项核心基准测试中超越OpenAI GPT-5.4和谷歌Gemini 3.1 Pro,自动化执行能力大幅提升,或将对多个领域的基础工作岗位产生替代效应。
基准测试数据显示,Opus 4.7在SWE-bench Pro编程测试中得分达64.3%,较前代提升近11个百分点,领先GPT-5.4的57.7%和Gemini 3.1 Pro的54.2%。工具调用规模化评测MCP-Atlas上,Opus 4.7得分77.3%,同样优于两款竞品。法律AI平台Harvey测试中,该模型在BigLaw基准取得90.9%,能正确区分“转让条款”与“控制权变更条款”。金融分析代理测试中,Opus 4.7登顶公开模型榜首。视觉推理CharXiv基准从69.1%提升至82.1%,支持2576像素长边识别,清晰度达前代3倍以上。
Opus 4.7新增的Routines功能支持自动化工作流配置。用户只需设置一次提示词,挂载代码仓库、接入API连接器后,模型可独立完成定时任务、代码审查、漏洞排查等长链路工作,无需实时人工干预,甚至可在用户离线状态下自动运行并生成结果报告。
市场有风险,投资需谨慎。本文为AI基于第三方数据生成,仅供参考,不构成个人投资建议。