【背景信息】 最近一直用minimax-h3大批量做ai视频(日产千条)。因为是大批量,所以需要大量的视频提示词来抽卡,这就导致我很看重模型的输出价格和输出速度。 平时都是用vertex白嫖的gemini flash模型。但是300刀扛不住,一下就用完了,而且容易429,所以一直在找替代品。 【尝试过的模型】 ds-v4-f:接的官方api,速度不快,估计是每次请求思考时间太久导致。结果: glm-5.3-f:接的中转站,速度很慢,偶尔还429,估计中转站的锅。结果: mimo-2.5-p:接的中转站,速度一般,偶尔生成的提示词完全不是按照格式输出的,几乎不可用。结果: qwen-3.8flash-next:接的中转站,拉稀一样的速度,感觉比gemini-3.8f还快,提示词效果感觉最好,对于画面,音乐,口播,甚至口播语气的控制,均优于一直使用的gemini。最重要的是,价格相对gemini是真便宜。 这个经历,让我不由得感慨,其实每个大模型的能力其实都很强,我们需要多尝试下,找到合适的模型,用到适合自己的工作流程中。 3 个帖子 - 2 位参与者 阅读完整话题


  • 情报分类:技术价值
  • 命中依据:新模型体验与提示词经验,有参考价值
  • 来源:服务器 / LINUX DO - 最新话题
  • 原作者:爷今天高兴
  • 发布时间:2026/9/9 10:32:15