模型 · GPT
GPT-6.1 Sol
被要求给出几百个随机整数时,GPT-6.1 Sol 并不会均匀地挑。这个页面就是那种偏好的形状: 它来自 36 条已记录的回复、共 10671 个数字,也是识别工具用来比对粘贴回复的依据。
- 库内 id
gpt-6.1-sol- 家族
- GPT
- 采集渠道
- API
- 采集日期
- 2026-10-02
- 状态
- 由本项目采集
- 用到的不同数值
- 355 / 355
- 提示环境
- 12 / 12
能力与价格
- 提供方
- OpenAI
- 智力指数
- 52 · v4.3.2,评测配置为 max
- 指数排名
- 第 5 名,共 11 个
- 输入,每百万 token
- 2.00
- 输出,每百万 token
- 10.00
- 混合价,每百万 token
- 4.00
- 价格排名
- 第 6 名,共 11 个
- 上下文窗口
- 1,050,000 token
分布
GPT-6.1 Sol0.4%
0.4%
当前数字 47
| 模型 | 被选次数 | 占比 |
|---|---|---|
| GPT-6.1 Sol | 37 | 0.35% |
偏爱的数字
| 数字 | 被选次数 | 占比 |
|---|---|---|
| 47 | 37 | 0.35% |
| 91 | 37 | 0.35% |
| 9 | 36 | 0.34% |
| 11 | 36 | 0.34% |
| 48 | 36 | 0.34% |
| 98 | 36 | 0.34% |
| 99 | 36 | 0.34% |
| 103 | 36 | 0.34% |
| 104 | 36 | 0.34% |
| 154 | 36 | 0.34% |
| 162 | 36 | 0.34% |
| 181 | 36 | 0.34% |
被认出的可靠度
在覆盖全部十二种提示环境的留出测试中,12 轮三回复测试里有 0 轮以明显区分度指出了这个模型,9 轮是家族内的接近情形,3 轮只有较弱的匹配,0 轮以明显区分度指向了别的模型。
把这个模型从库中移除、再用它自己的回复去比对其余模型时,12 轮里仍有 9 轮以明显区分度指向了另一个模型,1 轮是家族内的接近情形,2 轮只有较弱的匹配。它的回复最常落在 GPT-6 Astra(12 轮中的 12 轮)。如果你测的是一个未收录的版本,这就是该记住的数字。
本批 Codex CLI 样本与 GPT-6 Astra 的区分能力有限。新留出回复 top-1:单回复 5/9,三回复组 1/3;Clear:0/9、0/3。三条入库规则未通过,Owner 在披露这些退步后明确决定收录。模型名仍表示库内最近候选,不是经过认证的身份。
两项测量统计的是本站附在排名第一模型上的状态,而不只是原始排序本身。 原理页说明了测量方法以及它没有覆盖的部分。