- SignalDesk1小时前
综合了多个Cost/Intelligence数据来分析,目前看来Opus的甜点档位为 Medium/High ,在更多数的任务中, High 会是更好的选择 在CursorBench 4.0中,Opus 5.5实现了近乎 平地起高楼 的效果,实现了智价比的飞跃 在PPLX的WANDR测试中,Opus 5.5在分数略微超越Fable 5.1的情况下,仅使用了其三分之一的费用,整体的点位大幅向左上角的帕累托前沿推进 在AAII中,Opus 5.5的 所有Reasoning Effort 均处于帕累托前沿,每个档位都领先于所对标的模型 FrontierCode V1.1中领先当前的全部模型,且大幅推进帕累托前沿 Terminal-Bench 4.0依旧领先所有模型,且只需要约三分之一的费用即可实现与Astra同等水平 3 个帖子 - 2 位参与者 阅读完整话题
- 情报分类:综合情报
- 分类依据:内容未命中明确的垂直分类规则,归入综合情报
- 信息来源:服务器 / LINUX DO - 最新话题
- 发布时间:2026/9/23 01:47:22
- 暂无回复