那天和同事闲聊,说现在这几家 AI 厂商打来打去,越看越像三国,或者说是战国时代。聊着聊着就有人说,那 Opus 5.5 不就是当世吕布嘛,断层第一,谁都打不过。 然后就停不下来了,开始挨个对:这个模型像谁,那个模型该是谁,吵了半天谁也说服不了谁。我想既然都不服,那干脆用数据说话,于是就有了这个网站。 网站: https://illegalcreed.github.io/llm-sanguo/ 源码: https://github.com/IllegalCreed/llm-sanguo 对应原则 两份数据: 模型这边用的是 Artificial Analysis 10 月 10 日的榜单快照,697 个模型,其中 687 个有分 武将这边是《三国志 14 威力加强版》全部 1180 个武将的五维 规则很简单: 武力 = 模型的智能指数,按榜首折成 100 分 智力 = 性价比 按 7:3 的权重算百分位距离,离谁最近就是谁 所以不是拍脑袋指定的,是公式算出来的。当然后面也手动排了一版「演义版」,...