琢磨了下Luna——轻量快跑、价格压得低,明显往低价位这块下沉。翻了几个能打的对比,感觉OpenAI这回是直奔国产轻量模型的腹地来的。
先看代码能力(分越高越强):
| 指标 | GPT-5.6 Luna | GLM-5.2 | Kimi K2.7 Code |
|---|---|---|---|
| SWE-Bench Pro | 62.7% | 62.1% | 未公布 |
| Terminal-Bench 2.1 | 84.7% | 81.0% | 未公布 |
再看价格(按来源列的美元数):
| 项目 | GPT-5.6 Luna | GLM-5.2 | Kimi K2.7 Code |
|---|---|---|---|
| 普通输入 | $1.00 | $1.40 | $0.95 |
| 缓存输入 | $0.10 | —(源数据截断) | —(源数据截断) |
代码分上Luna跟GLM-5.2基本咬住,Terminal那项还小赢三个点;价格又压在一块钱,比GLM还便宜。这摆明了是拿轻杯来卡国产的价位段。
你们觉得Luna跟国产那几个轻量模型比,实际用起来能打不?还是又是榜分好看、上手拉胯那套?