求助,本地部署千问模型,我的设备是mac studio m4max 128G,用的模型是qwen3.8-27b-q6,我本地使用了llama.cpp部署了千问3.8模型,吐字非常慢,token才10-20不稳定,有没有好的部署优化方案?或者是不是我的方式不对? 1 个帖子 - 1 位参与者 阅读完整话题


  • 情报分类:技术价值
  • 命中依据:本地部署模型求助,明确技术问题
  • 来源:服务器 / LINUX DO - 最新话题
  • 原作者:香蕉你个巴拉
  • 发布时间:2026/9/12 23:25:34