基本资料
官方公告:https://www.anthropic.com/news/claude-opus-4-7
官方文档:What’s new in Claude Opus 4.7 - Claude API Docs
官方模型卡:https://cdn.sanity.io/files/4zrzovbb/website/037f06850df7fbe871e206dad004c3db5fd50340.pdf
价格:输入$5/输出$25,和4.6一样
上下文:1m,和4.6一样
最大输出:128k,和4.6一样
输出速度:大概50tps,比4.6快30%
4.7 vs mythos:有提升,但比mythos差不少
想换回4.6可以这样:/model claude-opus-4-6[1m]
优点:编程能力变强了
能处理更复杂、步骤更多的任务,还会自己先检查一遍结果再给你。
优点:看图能力也强了
支持最长边到2576像素,也就是2.5k,是4.6的三倍
新功能:/ultrareview
在线审阅,要额外花钱,Pro和Max用户可以免费试三次
新功能:auto模式,能自己决定并连续执行
第一次对Max用户开放
新功能:在high和max之间加了个xhigh
个人觉得没啥大用,更像营销,为了让用户觉得max比xhigh(对应codex)大
缺点:更费token
分词器调整了,4.7比4.6吃更多token
来源:官方System Card里Claude Opus 4.7牙膏倒吸实证
中文多6%,英文多59%,python多21%,别以为中文用户就没事,你代码还是英文居多
官方说max会员的额度可能会增加,用来应对分词器问题
来源:为了应对Opus4.7更长的上下文,CC订阅配额永久提升
缺点:长上下文注意力不行
MRCR长上下文测试,1m上下文的性能比4.6下降挺多
来源:https://www.reddit.com/r/ClaudeAI/comments/1sn6eyd/
来自官方System Card的Claude Opus 4.7牙膏倒吸实证
opus4.7这注意力和gemini3.1pro一个水平??
缺点:说话风格像GPT
感觉Opus 4.7 说话那个调调有点像GPT了
各种评测
官方自己的评测
LMArena评分
来源:Arena Leaderboard | Compare & Benchmark the Best Frontier AI Models
LiveBench评分
来源:https://livebench.ai
现在还没有opus-4.7-max的数据
ArtificialAnalysis评分
来源:https://artificialanalysis.ai/
ARC-AGI评分
Humanity’s Last Exam (HLE)
门萨智商测试,还没上线
vals.ai评分
FrontierMath评分
NYT Word Connections纽约时报填字游戏
4.7的分数只有4.6的一半都不到
来源:GitHub - lechmazur/nyt-connections: Benchmark that evaluates LLMs using 759 NYT Connections puzzles extended with extra trick words · GitHub
能用到的渠道
Chat渠道
官网/app已经能用
LMArena Direct Chat
估计不会上了,opus系列都没上
OpenRouter ChatRoom已经能用,用你自己的余额
来源:AI Chat Playground - Compare AI Models Side by Side | OpenRouter
API渠道
官网
OpenRouter已经能用
来源:Claude Opus 4.7 - API Pricing & Providers | OpenRouter
Code渠道
Claude Code已经能用
同时重置了所有会员的周限额,从17号开始,从0%重新算一周
Cursor已经能用
限时半价
Augment已经能用
260430之前半价
Windsurf已经能用
试用号也能用
droid已经能用
倍率1x
Copilot已经能用
4.7倍率是7.5x(260430后可能15x),按条数收费,最大是medium,上下文200k,需要pro+会员($10的pro会员没有4.7),之前4.6是3x