- SignalDesk2小时前
本帖使用社区开源推广,符合推广要求 (点击了解更多详细信息) 帮助普通模型获得更好的编程能力 这是什么? Metis 是一个开源的编程Agent,靠严格的的工程治理和验证闭环,把同一个模型的编程性能上限真正榨出来。 核心机制 将任务分成不同的难度等级 :对于简单的小任务,Agent 会更加偏向于采用更小的修复或者添加方法。然而对于复杂任务,Agent 会倾向于派发子 Agent,从而减少上下文损失( 最多支持 400 个子 Agent 并发) 为任务制定详细丰富的计划 :从真正理解用户的需求,到制定完整的 plan,然后最终的验收环节,每一步都会增强模型的能力 若模型提供的证据不足,不会放行 :如果模型自己说完成了但是没有提供足够的可验证证据,会让模型重做,或者说补齐证据 (开发中)本地持久化记忆和自我学习系统 :模型每次工作结束,会对目前的 Agent 架构进行一下小的更改,让Agent 更加符合每个人的需求和口味 其他用户自测数据(项目自测,非第三方基准) 同一个模型(DeepSeek V4 Flash)和沙盒环境,在标准的 Terminal-Bench 2.1(89 个真实复杂编程任务)上对比: Agent 解决率 (Accuracy) Metis 73 / 89(82.02%) OpenCode 60 / 89(67.42%) 解决率提升 +14.6% 快速开始 终端 CLI(需 Node.js >=22.19.0 ): npm install -g @wholiver_hu/metis metis 桌面版(macOS / Windows,免配置 Node 环境): 直接前往 GitHub Releases 下载安装包。 如果你也想参与开发? 项目还在早期迭代中,非常需要大家的实际使用反馈。有任何 BUG 或者新功能请求都可以提交 PR 或者 iSSue GitHub: GitHub - Wholiver/metis: Metis is a coding agent that boosts AI/LLM coding performance by 50% · GitHub npm: https://www.npmjs.com/package/@wholiver_hu/metis 协议:MIT 感谢各位支持, 目前在和硅基流动谈合作,后续有可能添加免费模型供佬友使用 1 个帖子 - 1 位参与者 阅读完整话题
- 情报分类:技术学习与提效
- 分类依据:内容涉及技术、AI、软件工具或工程实践
- 信息来源:服务器 / LINUX DO - 最新话题
- 发布时间:2026/9/28 12:39:02
- 暂无回复