- SignalDesk2 hr ago
像本地部署一些满血的开源模型,想要预估一下成本,比如部署GLM-5.3-Flash,原生 FP8,需要最低及以上需要哪些nvidia A/N系列的卡能部署,这些卡各需要多少张,8/32/64并发的情况下各能产生多少token/s 不考虑硬件成本,卡的事情不用担心 可以私聊或者线下都可以(有报酬的) 5 个帖子 - 4 位参与者 阅读完整话题
- 情报分类:技术学习与提效
- 分类依据:内容涉及技术、AI、软件工具或工程实践
- 信息来源:服务器 / LINUX DO - 最新话题
- 发布时间:2026/9/21 16:32:06
- No replies yet