最近这两天 Kimi-K3 的 API 现在用起来顺畅多了,至少没遇到 429 的情况。
我发现 K3 似乎比较擅长执行长时间任务,但吐字速度似乎不算太快。就有点像看习惯高刷屏后再看60Hz屏幕的感觉。
但擅长执行长时间任务可能也意味着擅长烧钱,昨天在Hermes上有个任务执行了2个多小时,当日总费用是 166 元(含缓存命中的75元)。按以前的经验,相同任务如果用 mimo-v2.5 可能不到 10 元。
不过“能不能做”与“做得好不好”多少还是与模型相关,一分钱一分货的道理可能是成立的。但对于“难度低”的任务可能就不成立了。如果要计较“亏不亏”,个人对模型能力与任务难度的判断可能是比较大的影响因素。