今天刷到个数据,上周(9.14–9.20)全球大模型调用量DeepSeekV4.1-Flash排第一,15.8万亿token,环比涨了219%。它9月10号刚发布,价格比上一代又降了一截,闲时缓存命中的输入token每百万才0.02元。便宜大碗的推理,看来要遍地开花了。