最近不管是LLM还是AIGC领域,本地部署都逐渐地在降本增效。像最近Qwen3.8-27B挺火的,有各种量化出来,不过其实我更看好的是Qwen3.8-Flash-Next这种新架构的MOE,优化好以后对普通硬件会更加友好,而且这可是现在还在服役的在线模型,能力比27B还强。最近ds也在搞小模型,大伙觉得明年本地部署会像今年的agent一样大爆特爆吗? 22 个帖子 - 18 位参与者 阅读完整话题


  • 情报分类:技术学习与提效
  • 分类依据:内容涉及技术、AI、软件工具或工程实践
  • 信息来源:服务器 / LINUX DO - 最新话题
  • 发布时间:2026/9/27 20:59:56