v4.1 flash 虽然tpm更高,但是实际上这是欺骗性的,对比glm 5.3 falsh,他完成同一个任务,花费的token要更多,耗费的时间也要更久,实际的速度要明显慢于glm 5.3 flash,5.3 flash 虽然tpm低,首token也慢很多,但是他用的token更少,最终完成单次任务,5.3 falsh的速度要快于v4.1 flash 至于完成效果上,这两个倒是差不多,也就是coding agent能力基本一样,这有点像当时opus5和fable5,同样review,用fable5 一轮完工了,用opus5修了3轮才完工,最后一算额度,反而opus5花费了更多的额度 所以看tps、看价格,目前看意义都不大了,还是要看最终的解决单次任务的耗费时间和实际成本 1 个帖子 - 1 位参与者 阅读完整话题


  • 情报分类:技术学习与提效
  • 分类依据:内容涉及技术、AI、软件工具或工程实践
  • 信息来源:服务器 / LINUX DO - 最新话题
  • 发布时间:2026/9/17 23:51:53