前1500字选重
每字取主读音最短入口,该范围无需选重。
让常用单字与词语尽量避开同一个编码,是夜莺的重点设计。这里的数据全部按 2.0 最终表、多来源字频与统一当量表重算,脚本在仓库内可复现。
2026-09-16 重算 · 单字取主读音最短入口 · 字频加权夜莺2.0单字 × 2.0 普通词表(四家共识)
字频前1500 × 词频前10000
100%
有简码的字在全码位让给词,该高频范围内
全码字词冲突对全部消除。
同一个四码同时对应一个单字和一个词条,计为一对冲突。这是冲突对数的变化,不是输入错误率。
前提:已有一至三码入口的字改用简码,不再参与全码冲突统计。前 1500 字里没有简码的字只有 126 个。
2026-09-16 按 2.0 最终表(155139 条)重算。字取字频前 1500(32 多来源字频)的全部四码全码;词取 08 综合排名前 10000 的四码词;同码即计一对。剔除有简码的字后再算一次。与 1.0 页面口径相同,词表换为 2.0 的四家共识普通词表。
简码分流按"是否存在简码入口"判断,不要求该简码首选,也不模拟用户是否记得或实际使用简码。冲突逐条配对计数,候选顺序不影响计数;本实验未证明不同方案之间的性能排名。
以下数据按 2.0 最终表重算,与上述字词冲突分别统计。
每字取主读音最短入口,该范围无需选重。
按字频加权,与重码字数占比不同。
含空格或选重键;不等同于实际打字速度。
切换范围,查看按字频加权的码长分布。
一至三码加权比重 —
百分比按每百万核心字预计次数加权;字数见完整表格。相加可能有舍入误差。
前 1500 字里有 357 个字的全码不在首选(多数是让位给了词),但每个字都有简码入口,实际最短输入选重为 0。
前 1500 字为 0,1501–3000 字区间为 7。前 6000 字合计 171,不能把"无重"理解成所有字全码都不重。
171 / 6000 约为 2.85%,这是字数占比;0.017% 是按字频加权的选重率,反映日常输入里碰到选重的比重。
前 6000 字,按字频加权统计各字母键 · 数值单位为%
色彩越鲜明,负担越高。
手感三项按字内相邻两键统计、字频加权:互击为两键异手;同指大跨排为同一手指跨两行,小跨排为跨一行。统计描述击键分布,实际手感也取决于个人习惯与熟练程度。
手机上可横向滑动表格。
| 统计范围 | 字数 | 1码 | 2码 | 3码 | 4码 | 选重 | 选重加权 | 全码非首选 | 加权键长 | 加权字均当量 | 加权键均当量 | 左右互击 | 同指大跨排 | 同指小跨排 |
|---|
字表:2.0 最终表(含扩展字,统计只取字频前 6000 的通用规范汉字)。字频:多来源字频重建(新闻、文学、对话、字幕、社交五源)。当量:统一键对当量表。每字取主读音下最短的输入序列(含空格或选重键,超过三选加翻页键)。
"全码非首选"指该字的四码全码在候选里不是第一位,包括让位给词的情况;"选重"指实际最短入口需要选重。当量为键对成本之和(字均)或平均(键均),不据此推导每分钟字数。
下载重算数据 JSON ↓查看计算脚本 ↗字根练习用于熟悉键位;下载区提供码表与导入说明。