码表从哪里来

拾穗跟打器只有一个训练诊断引擎,但可以读取多种输入方案的本地码表。我们不内置第三方封闭码表,但会教你从自己正在使用的输入法、Rime 配置或公开 GitHub 项目中找到码表,并导入到本地训练。

图解 / 码表导入流程

用户自己带码表,拾穗负责训练和复盘

码表导入不是技术细节,而是产品授权边界。你继续使用自己的输入法和码表,拾穗只读取本地文件,生成训练诊断。

本地导入链路

输入法配置 dict.yaml / TSV 拾穗导入 覆盖率 精准训练

没有完整码表时可以练节奏;导入后才能启用逐字编码诊断。

格式对照

數據 shuju
治理 zhili
Prompt prompt

第一阶段优先识别单字和常见词条,词组诊断会继续增强。

小白版解释

码表可以先理解成“字词和按键的对照表”

如果你没有码表,拾穗仍然可以帮你练文本准确率和速度;但它不知道某个字在你的输入方案里应该怎么打。导入码表后,拾穗才知道“目标字应该对应什么编码”。

第一次找码表

  1. 先确认你正在用什么输入方案,例如小鹤、五笔、Rime 双拼、仓颉。
  2. 如果你用 Rime,优先找 `.dict.yaml` 文件。
  3. 如果你有 TSV 或 txt 码表,先打开看是否像“字词 + 编码”的格式。
  4. 复制一份码表,不要直接修改正在使用的输入法配置。
  5. 导入拾穗后,看“单字编码数量”和“当前覆盖率”。

常见误区

  • 以为所有输入法都能直接导出完整码表。
  • 把个人可用和商业可分发混为一谈。
  • 导入了错误格式,却以为是跟打器不支持。
  • 只导入很小的演示码表,就期待完整诊断。
01 / Rime 用户

先从 Rime 用户文件夹找 schema 和 dict

Rime 方案通常由 schema.yaml 和 dict.yaml 组成。schema 描述输入方案,dict 保存词典和码表。拾穗第一阶段主要读取 dict.yaml 里的词条行。

macOS

鼠须管

打开 Rime 用户文件夹,寻找 *.dict.yaml 和 *.schema.yaml。

Windows

小狼毫

右键输入法状态栏,进入用户文件夹,再复制需要训练的 dict 文件。

Linux

IBus / Fcitx

通常在 ~/.config/ibus/rime 或 ~/.local/share/fcitx5/rime 一类目录。

移动端

同文 / iRime

优先从同步目录或配置备份导出,不建议直接改线上使用中的文件。

02 / GitHub 来源

常见公开码表来源

从 GitHub 获取码表时,先看 README、LICENSE 和文件格式。能导入不代表能随产品分发;个人本地训练和商业内置是两回事。

03 / 导入拾穗

导入以后,才开启精准训练

  1. 复制你有权使用的码表文件。
  2. 打开拾穗跟打器设置。
  3. 选择「导入码表」。
  4. 确认单字编码数量和当前练习覆盖率。
  5. 开始练习,观察期望编码、错码和回退。

目前支持

  • TSV:候选 + 编码
  • 空格分隔码表
  • Rime dict.yaml 词条行
  • 第一阶段优先读取单字编码
04 / 授权边界

个人导入可以,产品内置要谨慎

拾穗会把“用户本地导入”和“产品内置分发”严格区分。小鹤、虎码、五笔不同版本、呒虾米、大易等方案可能有各自授权边界。用户可以导入自己合法获得的本地码表用于训练;拾穗不会把未确认授权的第三方完整码表打包销售。