WhatsMyLLM English

模型 · Kimi

Kimi K2.6

被要求给出几百个随机整数时,Kimi K2.6 并不会均匀地挑。这个页面就是那种偏好的形状: 它来自 36 条已记录的回复、共 14513 个数字,也是识别工具用来比对粘贴回复的依据。

核对自称 Kimi K2.6 的聊天

库内 id
kimi-k2.6@cloudflare
家族
Kimi
采集渠道
Cloudflare Workers AI
采集日期
2026-09-17
状态
由本项目采集
用到的不同数值
355 / 355
提示环境
12 / 12

能力与价格

提供方
Moonshot AI
智力指数
27 · v4.3.2,评测配置为 default
指数排名
不参与排名——该指数已标记此配置被 Kimi K3 取代。
输入,每百万 token
0.95
输出,每百万 token
4.00
混合价,每百万 token
1.71
价格排名
不参与排名
上下文窗口
256,000 token

2026-09-23 读取,非本站测量: 指数页 · 价格页

分布

1 355
Kimi K2.6 在 1 到 355 之间选中每个数字的次数

每根柱子对应 1 到 355 中的一个值,高度是该模型在全部已记录回复里选中它的次数。 一个真正随机的选择器会给出一条平线。库里没有任何模型是这样的。

偏爱的数字

数字被选次数占比
14740.51%
58690.48%
44680.47%
64680.47%
95680.47%
19670.46%
28670.46%
198670.46%
17660.45%
57660.45%
78650.45%
38630.43%

被认出的可靠度

在覆盖全部十二种提示环境的留出测试中,12 轮三回复测试里有 8 轮以明显区分度指出了这个模型,0 轮是家族内的接近情形,4 轮只有较弱的匹配,0 轮以明显区分度指向了别的模型。

把这个模型从库中移除、再用它自己的回复去比对其余模型时,12 轮里仍有 0 轮以明显区分度指向了另一个模型,0 轮是家族内的接近情形,12 轮只有较弱的匹配。它的回复最常落在 Claude Haiku 4.512 轮中的 4 轮)。如果你测的是一个未收录的版本,这就是该记住的数字。

针对本站九道题目的新留出回复。发布时页面的 API 输入路径只接受 9 条原始回复中的 6/9:两条 JSON 数组回复含少数超过 355 的数值,另一条(query-17)混有多个代码块和说明文字。自 2026-09-18 输入更新起,这类数组与其他形式的回复一样读取,超出范围的数值被忽略,页面接受 8/9:top-1/Clear 为 8/9、5/9,三个环境组为 3/3、2/3,其中 JSON 组只用了三条中的两条。query-17 仍被拒绝。未修复或重新采集任何输入;三个题组不等于已证明独立或跨供应商覆盖。

两项测量统计的是本站附在排名第一模型上的状态,而不只是原始排序本身。 原理页说明了测量方法以及它没有覆盖的部分。