官方在已知限制那一栏写了几句实话 我看完把努力档调回去了

新 Flash 能自己调努力等级来换质量成本延迟,我上手就默认拉最高,跑了几轮觉得用量涨得不对劲,回头去翻文档,它自己在已知限制那栏写着:模型有时候会为了把表现拉满而用掉更多 token,尤其是在较高的努力等级下。同一栏还顺手承认了偶发变慢和超时。

也就是说高档位不是只让你多等一会儿,它会主动多花钱。这跟很多人以为的档位只影响延迟完全是两回事,按 token 计费的话,档位其实是个价格开关。

还有两条值得留意。知识截止写的是 2026 年 3 月,但官方补了一句,部分领域你会发现它的知识还停在 2025 年 1 月,这种半新不旧最容易骗人。另外多语言安全那项相对上一代退了 5.4 个百分点,中文这边受多大影响不好说,反正我今天试的时候确实吃了两次莫名其妙的拒答。

现在我的用法是默认中档,只有需要长链推理的时候临时拉高。你们是怎么设的。

高档位会多烧 token 这条我真没注意过

默认中档 要用再拉 我也这么干

部分领域还停在 2025 年 1 月 这坑埋得够深

多语言退 5.4 中文用户自己心里有数

拒答变多了 我还以为是自己提示词写坏了

肯把这些写进限制栏 已经算实诚了

超时那条 我今天连着中了三次