夜莺NIGHTINGALE
夜莺 2.0 / 性能

字词避重与单字性能

让常用单字与词语尽量避开同一个编码,是夜莺的重点设计。这里的数据全部按 2.0 最终表、多来源字频与统一当量表重算,脚本在仓库内可复现。

2026-09-16 重算 · 单字取主读音最短入口 · 字频加权
字词避重

高频字词冲突:55 对 → 0

夜莺2.0单字 × 2.0 普通词表(四家共识)
字频前1500 × 词频前10000

100%

有简码的字在全码位让给词,该高频范围内
全码字词冲突对全部消除。

同一个四码同时对应一个单字和一个词条,计为一对冲突。这是冲突对数的变化,不是输入错误率。

同一字表、词表与频率来源
计入全部单字全码55 对
剔除已有简码的字0 对

前提:已有一至三码入口的字改用简码,不再参与全码冲突统计。前 1500 字里没有简码的字只有 126 个。

统计范围与数据来源

2026-09-16 按 2.0 最终表(155139 条)重算。字取字频前 1500(32 多来源字频)的全部四码全码;词取 08 综合排名前 10000 的四码词;同码即计一对。剔除有简码的字后再算一次。与 1.0 页面口径相同,词表换为 2.0 的四家共识普通词表。

简码分流按"是否存在简码入口"判断,不要求该简码首选,也不模拟用户是否记得或实际使用简码。冲突逐条配对计数,候选顺序不影响计数;本实验未证明不同方案之间的性能排名。

下载重算结果 JSON ↓ · 查看计算脚本 ↗

单字性能

以下数据按 2.0 最终表重算,与上述字词冲突分别统计。

0

前1500字选重

每字取主读音最短入口,该范围无需选重。

0.017%

前6000字加权选重率

按字频加权,与重码字数占比不同。

3.21

前6000字加权键长

含空格或选重键;不等同于实际打字速度。

01 / 码长分布

各码长的字数与加权占比

切换范围,查看按字频加权的码长分布。

前6000字

一至三码加权比重

百分比按每百万核心字预计次数加权;字数见完整表格。相加可能有舍入误差。

02 / 重码与选重

全码重码与简码选重统计

简码分流

前1500字:357 → 0

前 1500 字里有 357 个字的全码不在首选(多数是让位给了词),但每个字都有简码入口,实际最短输入选重为 0。

扩大统计范围

前3000字:7 个选重

前 1500 字为 0,1501–3000 字区间为 7。前 6000 字合计 171,不能把"无重"理解成所有字全码都不重。

字数占比与加权占比

171 字 ≠ 0.017% 的字

171 / 6000 约为 2.85%,这是字数占比;0.017% 是按字频加权的选重率,反映日常输入里碰到选重的比重。

03 / 键位负担

各键使用占比与左右手负担

前 6000 字,按字频加权统计各字母键 · 数值单位为%
色彩越鲜明,负担越高。

左手 右手

手感三项按字内相邻两键统计、字频加权:互击为两键异手;同指大跨排为同一手指跨两行,小跨排为跨一行。统计描述击键分布,实际手感也取决于个人习惯与熟练程度。

04 / 完整数据

完整评测数据

手机上可横向滑动表格。

夜莺 2.0 单字性能 · 2026-09-16 重算
统计范围字数1码2码3码4码选重选重加权全码非首选加权键长加权字均当量加权键均当量左右互击同指大跨排同指小跨排

数据来源与统计口径

字表:2.0 最终表(含扩展字,统计只取字频前 6000 的通用规范汉字)。字频:多来源字频重建(新闻、文学、对话、字幕、社交五源)。当量:统一键对当量表。每字取主读音下最短的输入序列(含空格或选重键,超过三选加翻页键)。

"全码非首选"指该字的四码全码在候选里不是第一位,包括让位给词的情况;"选重"指实际最短入口需要选重。当量为键对成本之和(字均)或平均(键均),不据此推导每分钟字数。

下载重算数据 JSON ↓查看计算脚本 ↗

字根练习与码表下载

字根练习用于熟悉键位;下载区提供码表与导入说明。