模型 · DeepSeek
DeepSeek V4 Pro 0813
被要求给出几百个随机整数时,DeepSeek V4 Pro 0813 并不会均匀地挑。这个页面就是那种偏好的形状: 它来自 36 条已记录的回复、共 10584 个数字,也是识别工具用来比对粘贴回复的依据。
- 库内 id
deepseek-v4-pro-0813@openrouter:deepseek- 家族
- DeepSeek
- 采集渠道
- OpenRouter
- 采集日期
- 2026-09-18
- 状态
- 由本项目采集
- 用到的不同数值
- 355 / 355
- 提示环境
- 12 / 12
能力与价格
- 提供方
- DeepSeek
- 智力指数
- 36 · v4.3.2,评测配置为 reasoning, max effort
- 指数排名
- 第 10 名,共 11 个
- 输入,每百万 token
- 1.32
- 输出,每百万 token
- 3.96
- 混合价,每百万 token
- 1.98
- 价格排名
- 第 3 名,共 11 个
- 上下文窗口
- 1,000,000 token
提供方的标准价。非高峰时段按其一半计费。
分布
每根柱子对应 1 到 355 中的一个值,高度是该模型在全部已记录回复里选中它的次数。 一个真正随机的选择器会给出一条平线。库里没有任何模型是这样的。
偏爱的数字
| 数字 | 被选次数 | 占比 |
|---|---|---|
| 349 | 50 | 0.47% |
| 310 | 49 | 0.46% |
| 352 | 48 | 0.45% |
| 354 | 45 | 0.43% |
| 318 | 44 | 0.42% |
| 338 | 44 | 0.42% |
| 347 | 44 | 0.42% |
| 337 | 43 | 0.41% |
| 342 | 43 | 0.41% |
| 118 | 42 | 0.40% |
| 309 | 42 | 0.40% |
| 322 | 42 | 0.40% |
被认出的可靠度
在覆盖全部十二种提示环境的留出测试中,12 轮三回复测试里有 4 轮以明显区分度指出了这个模型,1 轮是家族内的接近情形,7 轮只有较弱的匹配,0 轮以明显区分度指向了别的模型。
把这个模型从库中移除、再用它自己的回复去比对其余模型时,12 轮里仍有 0 轮以明显区分度指向了另一个模型,0 轮是家族内的接近情形,12 轮只有较弱的匹配。它的回复最常落在 Qwen3.8 Max 0902(12 轮中的 6 轮)。如果你测的是一个未收录的版本,这就是该记住的数字。
针对本站九道题目的新留出回复,API 输入路径与 chat 分支结果一致:旧库两个模型的 top-1/Clear 均为 0/9、0/9;本库中 DeepSeek 单回复为 8/9、4/9,三个环境组为 3/3、1/3;Qwen 单回复为 9/9、9/9(全部回复均为 Clear),三个环境组为 3/3、3/3。经 OpenRouter 锁定服务供应商采集;身份属于声明的来源,不是独立认证。
两项测量统计的是本站附在排名第一模型上的状态,而不只是原始排序本身。 原理页说明了测量方法以及它没有覆盖的部分。