最近不管是LLM还是AIGC领域,本地部署都逐渐地在降本增效。像最近Qwen3.8-27B挺火的,有各种量化出来,不过其实我更看好的是Qwen3.8-Flash-Next这种新架构的MOE,优化好以后对普通硬件会更加友好,而且这可是现在还在服役的在线模型,能力比27B还强。最近ds也在搞小模型,大伙觉得明年本地部署会像今年的agent一样大爆特爆吗? 22 个帖子 - 18 位参与者 阅读完整话题