JLPT词库
先精确查词,查不到再按意思找。输入日语、罗马字或英文直接查;只记得意思、想不起词时,用任何语言描述它,语义检索会帮你找。
当前页面不是安全上下文,语义检索的模型缓存可能不可用。建议在本目录运行
python3 -m http.server 8000,再打开 http://localhost:8000/。正在载入词库…
① 精确匹配
词形、读音、罗马字、英文释义的完全一致和前缀匹配,不需要模型,秒出
- 输入内容后在这里看结果
② 按意思找
想不起词时用描述去找,数值是余弦相似度;已出现在①里的词不重复显示
- 加载语义检索后可用
当前词库只有英文释义,没有中文释义。中文查询只能走第②层的跨语言语义检索;简体字也不会精确匹配日语的汉字写法(例如“会议”和“会議”)。需要中文释义,要另接 CC-CEDICT 等数据。
语义检索设置(第二层,需要下载模型)
未加载
首次会下载约 175 MB 的文本模型,之后由浏览器缓存。词条向量优先读取 data/vectors.int8.bin(用 tools/build-vectors.mjs 预先生成,需要通过本地服务器或网站访问,双击打开读不到);没有的话在浏览器里现算并缓存,约 7800 条,WebGPU 下通常要几分钟,WASM 会更久。门槛只是起点,需要用你自己的查询校准。