- SignalDesk2小时前
那天和同事闲聊,说现在这几家 AI 厂商打来打去,越看越像三国,或者说是战国时代。聊着聊着就有人说,那 Opus 5.5 不就是当世吕布嘛,断层第一,谁都打不过。 然后就停不下来了,开始挨个对:这个模型像谁,那个模型该是谁,吵了半天谁也说服不了谁。我想既然都不服,那干脆用数据说话,于是就有了这个网站。 网站: https://illegalcreed.github.io/llm-sanguo/ 源码: https://github.com/IllegalCreed/llm-sanguo 对应原则 两份数据: 模型这边用的是 Artificial Analysis 10 月 10 日的榜单快照,697 个模型,其中 687 个有分 武将这边是《三国志 14 威力加强版》全部 1180 个武将的五维 规则很简单: 武力 = 模型的智能指数,按榜首折成 100 分 智力 = 性价比 按 7:3 的权重算百分位距离,离谁最近就是谁 所以不是拍脑袋指定的,是公式算出来的。当然后面也手动排了一版「演义版」,一共 102 席,但也尽量不违背公式。当然还综合考虑了家族,阵营,典故等等。 举几个例子 Claude Opus 5.5 ↔ 吕布 ,折算武力 100 ,原版武力也是 100 GPT-6 Astra ↔ 曹彰 ,91 对 90 颜良、文丑 是 Claude Fable 5 和 Fable 5.1 ,兄弟俩整整齐齐 NVIDIA 是汉献帝 ,五维故意留空。挟天子以令诸侯,说白了就是挟显卡 主公位都给厂家坐:OpenAI 是曹操,Meta 是孙权,Anthropic 是袁绍,算是各家站队 点开武将能看到两个雷达图,一个是游戏里的原版五维,一个是模型折算出来的,还配了两边的「列传」。 实现 没什么技术含量:Python 脚本把数据塞进模板,生成一个纯静态 HTML ,挂在 GitHub Pages 上。不调任何接口,也不用填 Key ,打开就能看。风格做成了美漫风,网点、硬阴影那种,跟三国放一起有点反差。 周末一天半做完的,手机也能看。 说到底就是个吹水产物,图一乐。觉得谁配错了欢迎来喷,也欢迎直接提 PR 给我换将。
- 情报分类:硬件与数码
- 分类依据:内容涉及硬件、数码产品或通信卡
- 信息来源:服务器 / V2EX
- 发布时间:2026/10/11 21:22:04
- 暂无回复