- SignalDesk1小时前
前一段时间看Mimo后训练突然有了个问题,思考了好几天还是没得到答案,发出来想问问各位佬友。 DeepSeek V4 Pro模型 在0813之前灰度测试了一段时间,测试的时候很多消息都称其在某些方面达到了fable级水平,但是在0813发布之后拉了坨大的,以至于到现在0813灰测都是很多人心中的白月光。 很多人对于正式版模型的评价都是后训练炸了,但是像是Mimo的后训练过程中会设置很多恢复节点,一旦出现过拟合就会回滚。我就由此想到,难道deepseek就没有类似的回滚机制以防止后训练的过拟合吗?如果存在这种回滚机制,那么为什么deepseek到现在都没有发布任何一个能力能够媲美灰测模型的V4P? 结合前段时间A÷公开指控deepseek涉及到路由蒸馏,以及此前的流言:deepseek灰测脏token和claude几乎一样。究竟是deepseek自始至终就没有训练出一个厉害的模型,所谓的灰测无非就是秘密招募了一批中转站使用者?还是说deepseek就是草台班子,灰测成绩这么好却没有保存备份,直接后训练过拟合了? 小白一个,没接触过LLM开发和计算机高深知识,恳请各位佬友解惑。 7 个帖子 - 5 位参与者 阅读完整话题
- 情报分类:服务器与云资源
- 分类依据:内容涉及服务器、云资源或网络线路
- 信息来源:服务器 / LINUX DO - 最新话题
- 发布时间:2026/9/24 20:58:30
- 暂无回复