拼音方案配置
全拼与双拼共享的候选行为、分隔符、词频调整、词组补全、自动学习与模糊音
方案 → 全局方案配置 → 拼音方案配置。全拼、双拼、混输的拼音子引擎、临时拼音共用这一份配置,也共用同一套词库与用户数据——双拼用户切到全拼,学过的词、调过的频依然生效。
对应配置段是 config.toml 的 [schema.pinyin],完整键名与默认值见方案与引擎配置。
两种拼音方案
| 方案 | ID | 说明 |
|---|---|---|
| 全拼 | pinyin | 输入完整拼音,如 zhongguo → 中国。基于白霜拼音(rime-frost)词库 |
| 双拼 | shuangpin | 两个按键表示一个音节,大幅减少击键。复用全拼词库与算法 |
两者都支持简拼、智能组词/整句、编码提示,内置五笔反查词库。
双拼布局
布局在方案页 → 选中双拼 → 设置 → 方案参数 → 双拼布局里选,内置 8 种:
| 布局 | ID | 说明 |
|---|---|---|
| 小鹤双拼 | xiaohe | 最流行的双拼方案(默认) |
| 自然码 | ziranma | 经典双拼方案 |
| 微软双拼 | mspy | Windows 内置方案 |
| 搜狗双拼 | sogou | 搜狗输入法方案 |
| 智能ABC | abc | 经典 ABC 方案 |
| 紫光双拼 | ziguang | 紫光 / 华宇方案 |
| 拼音加加 | jiajia | 拼音加加方案 |
| 首道双拼 | shoudao | 首道输入法方案 |
布局文件在 schemas\shuangpin\<布局ID>.toml,内容是声母与韵母的键位映射表。在用户数据目录下放同名文件即可覆盖内置布局,放新文件即可新增布局——见同结构覆盖机制。
学习新布局时打开编码提示
双拼支持编码提示,切到不熟悉的布局时,候选旁的编码可以帮助记忆键位。
全拼降级输入 0.115 新增
面向「多人共用一台机器」:主力用户打双拼,偶尔来的人只会全拼。在方案页 → 候选行为 → 双拼里打开「允许全拼输入」,双拼方案就会在自己的候选之外,额外把击键串当全拼再解释一遍。
| 击键 | 额外给出的全拼候选 |
|---|---|
zaijian | 再见 |
dianhua | 电话 |
wojintianhenkaixin | 我今天很开心 |
精确整词、子短语、前缀补全与整句组句都覆盖,模糊音跟随下方模糊音设置,不必单独配置。
候选顺序上,只有低置信的全拼候选会沉到列表末尾——即预测你尚未输入音节的前缀补全,以及只解释了开头一截的子短语。精确整词与整句则和双拼候选同层竞争,由消费长度排序,所以 zaijian 的「再见」会排在那些只吃两个键的同音单字前面。同一个词双拼本身也打得出时,保留的是双拼那条。
双拼击键大多不是合法全拼
双拼常拿 v/i/u 当声母,nihc、womf 这类击键根本切不出合法音节,不会产生多余候选。只有 nihao、dianhua 这种本身就是完整全拼的击键串才会触发。
默认关闭,关闭时候选与开启前完全一致。本项只对双拼方案有意义:全拼方案不受影响,混输方案里的拼音也强制关闭。
候选行为
| 选项 | 说明 | 出厂 |
|---|---|---|
| 显示编码提示 | 拼音候选旁显示对应编码(用主码表方案反查,如显示五笔码) | 开 |
| 智能组词 | 根据上下文智能拼接候选,支持整句 | 开 |
| 拼音分隔符 | 手动断开音节边界用的键,见下 | 自动 |
拼音分隔符
用于消歧:xi'an → 西安(而不是「先」)。四个取值:
| 取值 | 说明 |
|---|---|
自动(' / `) | 默认用 ';当 ' 被次选键占用时自动改用 ` |
单引号 ' | 固定用 ' |
反引号 ` | 固定用 ` |
| 不使用 | 不提供分隔符 |
简拼
只打声母就能出词,全拼与双拼都支持:bj → 北京、nh → 你好、bzd → 不知道。
混合简拼 0.113 新增
同一串里可以混用声母与完整音节,不必整串都简、也不必整串都全:
| 输入 | 形态 | 结果 |
|---|---|---|
nhao | 声母在前 + 全拼音节 | 你好 |
nihm | 全拼音节 + 声母在后 | 你好吗 |
nih | 全拼 + 声母 | 你好 |
0.112 及以前只认「整串全是声母」这一种形态,nhao 这样声母打头的混合串没有候选。
长串不再打到一半就空码 0.113 新增
简拼串一旦长过词库里任何一个词,0.112 及以前会整串落空——连打 bzdnihaobuhao,输到 bzdha 就没有任何候选了。0.113 起整串没命中时会自动退到较短的切点出候选,选中后剩下的编码留在缓冲里继续,可以分步上屏。
简拼参与整句组句 0.113 新增
简拼段现在与全拼段一起进入整句解码,由语言模型挑最优路径:bzdhaobuhao 直接出「不知道好不好」,不必先选「不知道」再选「好不好」。
编码栏会按音节切分显示
简拼与混合串在编码栏里按候选的真实音节边界分段显示(如 bzd hao bu hao),便于确认输入法把这串理解成了什么。分隔只是显示,去掉分隔符恰好还原你敲的字母,退格与光标编辑不受影响。
简拼与全拼共用词频
简拼候选记录的是词的全拼编码,因此用简拼选过的词,之后用全拼打也一样上浮,两边共用同一份使用次数。
混输方案里可以单独关掉简拼候选,见混输方案配置 · 启用拼音简拼。纯拼音方案不受那个开关影响。
词频调整
| 选项 | 说明 | 出厂 |
|---|---|---|
| 启用词频调整 | 总开关 | 开 |
| 补全词参与调频 | 前缀补全出来的候选是否参与提升:不参与 / 仅单字单词 / 全部 | 仅单字/单词 |
| 热度衰减半衰期 | 使用记录衰减到一半所需的小时数,0 = 内置 72 小时 | 0 |
拼音没有策略选择——它固定使用位置提升模型:用过的候选按位次前移(每用一次前移一半),久未使用则按半衰期回落,不打分、不改权重。
补全词参与调频 0.114 新增
只打半个音(如 d)时所有候选都是前缀补全,这一项决定它们是否参与提升:
| 取值 | 打 d 选「得」 | 打 d 选「东西」 |
|---|---|---|
| 不参与 | 不提升 | 不提升 |
| 仅单字/单词(默认) | 提升 | 不提升 |
| 全部 | 提升 | 提升 |
判据是语义单元数(汉字逐字计、连续西文段整体计 1),不是字符数:「东西」2 个、hello 1 个。默认值的取舍是——短输入下你给出的信息量很少,让单字正常上浮,但别把长词组顶到单字前面。
输完整音节后候选都是精确匹配,这一项就不起作用了。
热度衰减半衰期 0.114 新增
「热度衰减到一半所需的小时数」:某个词最后一次使用过去越久,它累积的使用次数就越不算数。出厂 0 表示用内置的 72 小时(3 天)。
调大它,久不用的词也保持靠前,适合用词稳定的人;调小则更贴近「最近在写什么」。
这意味着一个月不用的词会完全失效
墙钟衰减的固有行为——30 天约等于 10 个半衰期,即便用过 50 次也会衰减到接近零。不希望如此就把半衰期调大。
码表侧有一份同名设置,两者完全独立、各管各的。完整原理见词频与候选排序。
词组补全 0.114 新增
打一两个字母时,候选里不再混进「但是」「的时候」「电话」这类词组——0.114 起与主流拼音输入法一致:输入几个音节,就给几个音节的候选,打到第二个音节才开始预测词组。
| 选项 | 说明 | 出厂 |
|---|---|---|
| 最少音节数 | 输入达到几个音节才给出词组候选。1 = 不限制,单个字母也给 | 2 |
| 词组最多超出 | 词组最多比已输入的内容多几个音节。数值越小,候选越贴近已打的字 | 3 |
音节怎么算:完整音节数,加上尾部未成音节的字母(算起头的一个)。所以:
| 输入 | 算几个音节 | 候选 |
|---|---|---|
d | 1 | 只有单字:的、对、但、等、都… |
dian | 1 | 只有单字:点、店、电、垫…(外加编码恰为 dian 的「堤岸」) |
dianh | 2 | 电话、电荷、点火… |
nih | 2 | 你好、你会、你还… |
「堤岸」为什么还在
dian 也可以读作 di|an,「堤岸」的编码恰好就是 dian——它是精确匹配,不是在预测你没打的字。同理 xian 下的「西安」、xiao 下的「西奥」都会保留。被挡掉的只有编码比输入更长的那些。
「词组最多超出」决定引擎能预测多远:调到 1 时 nih 只给「你好」「你会」,不再给 4 音节的「你会发现」;要让 zhonghuar 补出「中华人民共和国」(7 音节)则需要 4。这两端无法兼得,按自己的输入习惯选。
自动学习
| 选项 | 说明 | 出厂 |
|---|---|---|
| 启用自动学习 | 连续选词后自动把词组加入用户词库 | 开 |
| 最短学习词长 | 至少几个字的词组才记录 | 2 |
拼音家族共享用户数据
全拼与双拼的用户词库、调频、临时词库统一存储在同一个数据域(pinyin)。双拼用户切到全拼,学过的词、调过的频依然生效;导出双拼方案的词库,得到的就是整个拼音家族的数据。
模糊音
让易混淆的拼音对在输入时互不区分。全局配置,全拼与双拼共享。 共 11 组,需先打开总开关,再逐对勾选:
| 组 | 组 | 组 |
|---|---|---|
| zh ↔ z | ch ↔ c | sh ↔ s |
| n ↔ l | r ↔ l | f ↔ h |
| an ↔ ang | en ↔ eng | in ↔ ing |
| ian ↔ iang | uan ↔ uang |
全部出厂关闭。开得越多候选越杂,建议只开自己确实分不清的那几组。
相关页面
- 混输方案配置——五笔优先、拼音兜底
- 临时模式 · 临时拼音——码表方案忘码时应急
- 词库管理——扩展词库、用户词、词频
- 词频与候选排序——位置提升模型的完整说明