- SignalDesk1小时前
DeepSWE 榜上 Gemini 3.8 Flash 和 GPT-6 Astra 分数接近,但它们实际用的差距却很大 因此我做了一张以 Terminal-Bench 4.0 的跑分为主轴,结合 OpenAI 放出的 GPT-6系列 DeepSWE 跑分图的风格 说明: Terminal-Bench 4.0 的跑分与价格数据均来自 Artificial Analysis(AA 站) 我顺手补了最新的 Claude Opus 5.5 模型 评分仅供参考 2 个帖子 - 2 位参与者 阅读完整话题
- 情报分类:技术学习与提效
- 分类依据:内容涉及技术、AI、软件工具或工程实践
- 信息来源:服务器 / LINUX DO - 最新话题
- 发布时间:2026/9/23 17:54:27
- 暂无回复