- SignalDesk3小时前
纯讨论一下, 公司机器 显卡4090 24g,可以用20g左右(要留点显存其他软件用)。 模型用的unsloth的Qwen3.8-27B-UD-Q4_K_M.gguf。 主要想拿来辅助简单的编程agent, 真的可以拿来干活了么? 至少要支持一个96k上下文的会话吧。 还有各种量化版本,各位佬推荐什么方案啊? GSQ-RCOIQ3_S UD-Q4_K_M Swift 1.5 SwiftxGSQ-RCO Flash-Next GGUF Bonsai2-27B QUASAR-QATNVFP4 Uncensored去审查版 llama-server.exe ^ -m "Qwen3.8-27B-UD-Q4_K_M.gguf" ^ --host 127.0.0.1 ^ --port 8033 ^ -ngl 999 ^ -c 131072 ^ --flash-attn on ^ --cache-type-k q8_0 ^ --cache-type-v q8_0 ^ --spec-type draft-mtp ^ --spec-draft-n-max 2 ^ --parallel 1 ^ --jinja ^ --load-mode mlock ^ --alias qwen3.8-27b 一句话两分半钟静态svg感觉这虽然没什么细节,但鸟和自行车大形状至少没什么问题 5 个帖子 - 3 位参与者 阅读完整话题
- 情报分类:硬件与数码
- 分类依据:内容涉及硬件、数码产品或通信卡
- 信息来源:服务器 / LINUX DO - 最新话题
- 发布时间:2026/9/29 09:50:06
- 暂无回复