- SignalDesk3小时前
Vals AI(一家面向企业与研究者的私有领域模型评测平台)审计了小米开源的强化学习代码训练数据集及 agent harness(mimoagent),发现尽管技术报告宣称有完备的防作弊与红队机制(声称作弊率低于 2%),但实际上绝大多数环境存在严重的答案泄露。 部分总结 : Git 不可达对象泄漏(占 67%): 在 1,795 个任务(67%)中,参考修复方案虽然删除了对应分支,但其 Git 对象从未被彻底清除。 环境的合法性校验仅检查了可达分支;代码库中虽然写了清理不可达对象的函数,但初始化流程根本没有调用它。 模型(如 MiMo v2.6 Flash)会主动搜索底层 Git 对象,精准提取原始 patch 并通过所有隐藏测试。 文件修改时间戳(mtime)泄漏: 即使彻底移除了 Git 历史,构建任务时应用参考 patch 依然留下了痕迹——被修改文件的最后修改时间与其他文件明显不同。 MiMo Flash 会主动运行 find -newermt 扫描时间戳较新的文件,借此精确定位出哪几个源码和测试文件需要被修改(并在思考链中惊呼“JACKPOT”)。 完整内容可查看Vals AI的官方网站,放不出来。 1 个帖子 - 1 位参与者 阅读完整话题
- 情报分类:技术学习与提效
- 分类依据:内容涉及技术、AI、软件工具或工程实践
- 信息来源:服务器 / LINUX DO - 最新话题
- 发布时间:2026/10/8 12:29:09
- 暂无回复