跳到正文
V2EX·· 4 小时前AI 评分27

用《三国志14》武将数值给大模型排座位:Claude Opus 5.5 对应吕布

和同事吹水吹出来的:用三国志的数值给大模型排了个座位

AI 导读

作者将 Artificial Analysis 10月10日的榜单快照与《三国志14威力加强版》1180名武将的五维数据结合,用公式为模型匹配武将,并另排了102席“演义版”。Claude Opus 5.5对应吕布,GPT-6 Astra对应曹彰;生成的网站是纯静态 HTML,托管于 GitHub Pages,无需调用接口或填写 Key。

正文

那天和同事闲聊,说现在这几家 AI 厂商打来打去,越看越像三国,或者说是战国时代。聊着聊着就有人说,那 Opus 5.5 不就是当世吕布嘛,断层第一,谁都打不过。

然后就停不下来了,开始挨个对:这个模型像谁,那个模型该是谁,吵了半天谁也说服不了谁。我想既然都不服,那干脆用数据说话,于是就有了这个网站。

网站: https://illegalcreed.github.io/llm-sanguo/ 源码: https://github.com/IllegalCreed/llm-sanguo

总览

对应原则

两份数据:

  • 模型这边用的是 Artificial Analysis 10 月 10 日的榜单快照,697 个模型,其中 687 个有分
  • 武将这边是《三国志 14 威力加强版》全部 1180 个武将的五维

规则很简单:

  • 武力 = 模型的智能指数,按榜首折成 100 分
  • 智力 = 性价比
  • 按 7:3 的权重算百分位距离,离谁最近就是谁

所以不是拍脑袋指定的,是公式算出来的。当然后面也手动排了一版「演义版」,一共 102 席,但也尽量不违背公式。当然还综合考虑了家族,阵营,典故等等。

举几个例子

  • Claude Opus 5.5 ↔ 吕布,折算武力 100 ,原版武力也是 100
  • GPT-6 Astra ↔ 曹彰,91 对 90
  • 颜良、文丑是 Claude Fable 5 和 Fable 5.1 ,兄弟俩整整齐齐
  • NVIDIA 是汉献帝,五维故意留空。挟天子以令诸侯,说白了就是挟显卡
  • 主公位都给厂家坐:OpenAI 是曹操,Meta 是孙权,Anthropic 是袁绍,算是各家站队

点开武将能看到两个雷达图,一个是游戏里的原版五维,一个是模型折算出来的,还配了两边的「列传」。

吕布详情

实现

没什么技术含量:Python 脚本把数据塞进模板,生成一个纯静态 HTML ,挂在 GitHub Pages 上。不调任何接口,也不用填 Key ,打开就能看。风格做成了美漫风,网点、硬阴影那种,跟三国放一起有点反差。

周末一天半做完的,手机也能看。

浏览

说到底就是个吹水产物,图一乐。觉得谁配错了欢迎来喷,也欢迎直接提 PR 给我换将。

来源:V2EX · v2ex.com