WhatsMyLLM English

模型 · Claude

Claude Sonnet 5.5

被要求给出几百个随机整数时,Claude Sonnet 5.5 并不会均匀地挑。这个页面就是那种偏好的形状: 它来自 36 条已记录的回复、共 10575 个数字,也是识别工具用来比对粘贴回复的依据。

核对自称 Claude Sonnet 5.5 的聊天

库内 id
claude-sonnet-5-5
家族
Claude
采集渠道
API
采集日期
2026-09-30
状态
继承自 ModelTrace;服务端身份未经独立核实
用到的不同数值
355 / 355
提示环境
12 / 12

能力与价格

提供方
Anthropic
智力指数
56 · v4.3.2,评测配置为 Adaptive Reasoning, Max Effort, Default Fallback
指数排名
第 2 名,共 10 个
输入,每百万 token
2.00
输出,每百万 token
10.00
混合价,每百万 token
4.00
价格排名
第 6 名,共 10 个
上下文窗口
1,000,000 token

2026-10-02 读取,非本站测量: 指数页 · 价格页

分布

1 355
Claude Sonnet 5.5 在 1 到 355 之间选中每个数字的次数

每根柱子对应 1 到 355 中的一个值,高度是该模型在全部已记录回复里选中它的次数。 一个真正随机的选择器会给出一条平线。库里没有任何模型是这样的。

偏爱的数字

数字被选次数占比
350450.43%
334430.41%
349430.41%
353430.41%
113420.40%
88410.39%
199410.39%
203410.39%
215410.39%
308410.39%
97400.38%
101400.38%

被认出的可靠度

在覆盖全部十二种提示环境的留出测试中,12 轮三回复测试里有 12 轮以明显区分度指出了这个模型,0 轮是家族内的接近情形,0 轮只有较弱的匹配,0 轮以明显区分度指向了别的模型。

把这个模型从库中移除、再用它自己的回复去比对其余模型时,12 轮里仍有 0 轮以明显区分度指向了另一个模型,0 轮是家族内的接近情形,12 轮只有较弱的匹配。它的回复最常落在 Gemini 3.8 Flash(12 轮中的 4 轮)。如果你测的是一个未收录的版本,这就是该记住的数字。

这 36 条回复来自 ModelTrace d4131b3,经 OAIPro 中转采集。使用上游入库数据进行本站题目条件评估,正确 Clear 为 12/12。未另外采集 Sonnet 5.5 留出回复;服务身份和独立生成属于声明的来源,并非已认证事实。

两项测量统计的是本站附在排名第一模型上的状态,而不只是原始排序本身。 原理页说明了测量方法以及它没有覆盖的部分。