模型 · GPT
GPT-5.6 Luna
被要求给出几百个随机整数时,GPT-5.6 Luna 并不会均匀地挑。这个页面就是那种偏好的形状: 它来自 36 条已记录的回复、共 12775 个数字,也是识别工具用来比对粘贴回复的依据。
- 库内 id
gpt-5.6-luna- 家族
- GPT
- 采集渠道
- API
- 状态
- 继承自 ModelTrace;服务端身份未经独立核实
- 用到的不同数值
- 355 / 355
- 提示环境
- 12 / 12
分布
每根柱子对应 1 到 355 中的一个值,高度是该模型在全部已记录回复里选中它的次数。 一个真正随机的选择器会给出一条平线。库里没有任何模型是这样的。
偏爱的数字
| 数字 | 被选次数 | 占比 |
|---|---|---|
| 346 | 68 | 0.53% |
| 347 | 62 | 0.49% |
| 306 | 61 | 0.48% |
| 319 | 61 | 0.48% |
| 278 | 56 | 0.44% |
| 279 | 55 | 0.43% |
| 289 | 55 | 0.43% |
| 326 | 55 | 0.43% |
| 333 | 55 | 0.43% |
| 246 | 52 | 0.41% |
| 340 | 52 | 0.41% |
| 316 | 51 | 0.40% |
被认出的可靠度
在覆盖全部十二种提示环境的留出测试中,12 轮三回复测试里有 12 轮指出了这个模型,0 轮只判到家族,0 轮没有结论,0 轮指向了别的模型。
把这个模型从库中移除、再用它自己的回复去比对其余模型时,12 轮里仍有 0 轮自信地指向了另一个模型,10 轮停在家族层面,2 轮没有结论。它的回复最常落在 GPT-5.5(12 轮中的 6 轮)。如果你测的是一个未收录的版本,这就是该记住的数字。
两项测量用的都是本站实际采用的开放集判定,而不是指纹库的原始排序。 原理页说明了测量方法以及它没有覆盖的部分。