牛津高阶英汉双解词典第10版(OALD 10)Yomitan 适配版 V3.1

Yomitan / Yomichan 一直是外语沉浸学习和 Anki 制卡的重要工具,但高质量的英汉学习词典适配版相对稀缺。为了配合 Anki、asbplayer 和日常英语输入,我让 AI 帮忙在 OALD 10 数据的基础上制作了这份词典适配版(前期是先用 Gemini 把排版大致方向确定下来,然后用 Codex 来完善逻辑和优化)。

本词典基于 xingxingla 分享的 OALD 10 数据(2026 年 7 月 11 日版本),格式与排版设计也参考了 librola33 的《明镜日汉双解辞典》Yomitan 版。在此感谢两位的分享。

V3.0 主要解决显示层级、标签排版和 Anki 导入问题;V3.1 则把重点放在抽取完整性、边缘结构覆盖和发布前自动质检上。脚本现在会从源 HTML、内部 IR 一直检查到最终 ZIP,尽量让遗漏和空词条在生成阶段就暴露出来,而不是依赖用户逐个碰词测试。


:inbox_tray: V3.1 下载

成品 ZIP 可以直接导入 Yomitan,不需要解压

版本 文件名 适合人群 下载
标准双解版 OALD10_Yomitan_V3.1.0.zip 英文释义 + 中文翻译 + 中文界面标签 Google Drive
百度网盘(ceuf)
进阶沉浸版 OALD10_Yomitan_V3.1.0_Immersion.zip 英文释义与例句 + 中文辅助标签和导航 Google Drive
百度网盘(s55b)
国际纯英版 OALD10_Yomitan_V3.1.0_Global.zip 纯英文内容 + 英文界面标签 Google Drive
百度网盘(expu)

:light_bulb: 老用户升级提示:请先在 Yomitan 设置中删除旧版词典,再导入新版 ZIP。路径一般是 Yomitan Settings -> Dictionaries -> Configure installed and enabled dictionaries...

:inbox_tray: SHA256

  • 标准双解版3688364179301FA7918C62F1F0F3A8AEDE4BC335CB244685E2F990A1F84FEF75
  • 进阶沉浸版BE9C42B168961159A782A35F147D50A8813F1AB56F4F0B59081E4680B45A22B9
  • 国际纯英版88FBD3406B5306CDEEF3014A2E639D8AB82440FD839C457BD5F7154692BBF800

:loudspeaker: V3.1 更新内容

1. 全量源数据完整性审计

转换时会同时统计源 HTML 与 IR 中的词条、义项、主释义、翻译、保留例句、主题标签、义项级 Oxford / CEFR 标记、用法说明、特殊面板和交叉引用。除了总数校验,还会逐义项检查定义、例句、topic 和核心词表标记,避免两个错误恰好互相抵消后被总数掩盖。

2. 补齐容易遗漏的结构

点击展开详情
  • 补回 1,945 处用法说明,包括普通义项和 Synonyms 面板中的说明。
  • 支持同一义项下多个例句列表,避免后续列表中的例句被漏掉。
  • 处理定义内部交叉引用、缩写全称、嵌套粗体 / gloss 富文本和复合词性。
  • 保留习语与短语动词组中的义项级 Oxford3000 / Oxford5000 和 CEFR 标记,不再误提到整个词条顶部,也不会静默遗漏。
  • 完整覆盖当前源数据中的 18 类特殊面板,包括 Word Family、Wordfinder、Vocabulary 表格、Language Bank、Which Word、Grammar、More About 和 Express Yourself 等低频结构。
  • 修正 satellite 这类重复 topic 数据,保留有效主题并自动去重。

3. 清理内部页面与空占位

源文件中包含 37 个以 oalecd_ref_* 开头的词典参考附录页。这些页面不是可供查词的普通词条,部分页面还会误抓表格中第一个地名或人名的发音。V3.1 会在进入抽取器前明确排除它们。

另外,train-atwant-fromwrite-away 三个只有词头和词性的空占位不会再生成空词条;指向这些占位的重定向会重新解析,无法落到有效词条的目标会被移除。

4. 义项编号与层级修正

点击展开详情
  • 只有语法元数据的义项仍会显示,但不会错误占用普通释义编号。
  • 只包含搭配等补充面板的容器不再生成单独的空
  • outstay 等词的搭配面板和习语层级现已恢复正常。
  • b-wconsistthick 等无普通定义但带有重要语法信息的结构不会被误删。

5. 更严格的 Yomitan ZIP 打包校验

点击展开详情

最终 ZIP 会检查:

  • 必要文件与 term bank JSON
  • 非法 style 和非预期 open 字段
  • 空结构化词条和空义项标题
  • 内部富文本标记泄漏
  • 未定义的标签和 CSS class
  • Immersion 版中越界的中文释义、例句、长说明或面板正文
  • Global 版中的中文语言节点及未标语言的 CJK 文本
  • 指向不存在词条的悬空重定向

一旦失败,日志会显示具体 term bank、行号和词头,方便直接定位。

6. 明确 Immersion 的语言边界

点击展开详情

进阶沉浸版现在定位为“中文标签辅助的英英过渡版”:主释义、例句、长用法说明和面板正文保持英文;shortcut、可数性、及物性、语域、地域、用法限制、变体提示、交叉引用及面板标题保留中文辅助。

源数据没有翻译的常见结构语法词会使用一组封闭词表补齐,例如 countable 可数intransitive 不及物only before noun 仅用于名词前。未知标签、短语动词名称、Oxford3000 和 CEFR 等不会被自动翻译。国际纯英版仍不保留任何中文。

7. 完善 Yomitan 词典信息

点击展开详情

转换器版本、词典构建 revision 和源数据日期现已分离:脚本和 ZIP 继续使用 V3.1.0;Yomitan 的 revision 默认使用生成词典当天的日期;输入文件名中的 20260711 则作为源数据日期写入 Description。即使 MDX 不变,只要脚本更新后重新构建,Yomitan 也能显示新的词典 revision。

index.json 同时补充项目 GitHubFreeMdict 发布页原数据帖、作者/来源署名以及源语言和目标语言。

标准双解版声明 en -> zh,进阶沉浸版和国际纯英版声明 en -> en。目前没有稳定的自动更新清单和直接下载地址,因此不添加容易误导的 isUpdatableindexUrldownloadUrl


:camera_with_flash: 实际效果截图

标准双解版

进阶沉浸版 Immersion

国际纯英版 Global


三种版本的区别

  • 标准双解版:英文释义、中文翻译和中文标签都保留,适合大多数中文学习者。
  • 进阶沉浸版:主释义、例句和长正文只保留英文;shortcut、语法/用法提示、变体和导航标题保留中文辅助,适合从双解逐步过渡到英英环境。
  • 国际纯英版:内容、元数据和界面标签均为英文;校验器要求中文语言节点与 CJK 文本字符同时为 0。

源码与自行构建

转换脚本采用 AGPL-3.0 开源:

常用命令
# 标准双解版
python main.py -i oaldpe-20260711.mdx.txt -o build\bilingual -m bilingual -u zh

# 进阶沉浸版
python main.py -i oaldpe-20260711.mdx.txt -o build\immersion -m mono -u zh

# 国际纯英版
python main.py -i oaldpe-20260711.mdx.txt -o build\global -m mono -u en

三个版本应使用不同输出目录。全量构建比较耗时,内存不足时建议顺序生成,不要并行运行。


使用说明与反馈

Yomitan 导入后会使用词典自带的结构化 CSS。导入 Anki 时,具体字体和颜色还可能受到 Anki 卡片模板覆盖;V3.1 保证词典自身结构与 class 定义完整,但不会强行覆盖所有第三方模板样式。

如果发现显示异常、释义缺失、例句错位或导入问题,请反馈具体词头、所用版本和截图。相比“看起来哪里不对”,一个可复现单词通常更容易定位。

感谢评论区大家的意见反馈与支持。


:speech_balloon: 作者碎碎念:
自去年离职以来,今年才投入一些时间在英语的沉浸式输入上(指看《Breaking Bad》),然后最近在找工作中。因为有些许焦虑,反而进度上有点放慢了。

做这个工具主要是为了自己日常沉浸学习用得顺手。如果它也刚好帮到了同样在用 Yomitan 学英语的你,那就太好了。祝大家学习顺利。

13 Likes

谢谢制作Yomitan适用的词典,请问下这个词典的大小是否有可能小一点?好像一般Yomitan版本的词典不超过50M的比较多

盲猜一把,用的Google的ai甚至就是antigravity,语言风格太像了,“极致”“优雅”

在“这个词典的大小是否有可能小一点?”这个问题上,是可以的。

说下目前体积大的原因吧:
1、原版mdx(2026年5月17日的版本)文件53.2MB,不过其中很多词的释义都是通过“@@@LINK”进行链接到主词条释义。
2、目前的Yomitan词典是把这些重定向链接都展开了,把释义都克隆到每一个衍生词下。

如果说一定要缩减体积的话,可能弊端:
划词时可能经常看到 🔗 请见主词条:XXX,得手动再点划词下主词条才能看到释义。

所以目前属于空间换体验了。

xingxingla 大佬最新的 mdx文件删除了部分词汇做了一些精简处理,理论上用脚本跑一遍之后,生成的体积会比现在小一些。因为Yomitan在词性变化上的检索没有词典软件那么智能,所以目前没有跟进最新的版本。

体积问题上就是看取舍了,后续再考虑下是否出一版小空间的吧。

大佬眼神真好 :joy:
确实是在用 Google 的 Gemini 。不过没用过 antigravity 这类 Agent,看来我有点落后时代了。

毕竟我用了好久,不过现在叛变到chatgpt了……Gemini flash太不靠谱,pro太慢,这个缺点已经让我可以忍受chatGPT的不说人话了。

看来我某种程度上习惯了Gemini Pro转圈时切出去干其他事情的设定了 :joy:,不过确实很慢。
GPT好久没续费了,都不知道“行情”如何了。

啊,为啥我切出去Gemini就不干活了?虽说确实挺强的,我前段时间生病就把症状和检查结果发Gemini pro,复盘看从头到尾没错过一次(包括对症猜因、检查结果解读、就诊建议)

既然折腾了,可以考虑基于官方ciku做一个纯净的OALD10双解版。

我这个是“物理意义”上的切,我是浏览器打开Gemini,然后切标签页看其他的了,让Gemini后台运行,而不是切其他Gemini对话。

感谢建议。

话说“官方ciku” 是指“牛津高阶词典第10版 Android App 解包后的 ciku.db”?(一开始没反应过来ciku是拼音,笑死)

刚了解到 leon406 的版本里面有注明其版本翻译部分来源于此,而 xingxingla 的版本是基于此之上做了些修改,所以目前的版本相对来说词条应该会更全一些。

目前的脚本主要是针对MDX的HTML文本进行排版的,数据库版本相当于重写一个版本了。
考虑了下,目前对“纯净”的需求不算大,同时这个帖子也算是抛砖引玉了,我短时间内应该不会开新版,留给其他人开坑吧,哈哈。

确实是个好思路,之前都没想到,如果以后遇到了MDX比较难修补的痛点我再考虑开个新坑。

噢噢,我用app多

谢谢解答。另外好像发现一个bug,有点小冲突的,Yomitan词典里同时开启yzk-freq-en-v3和这个词典的话,yzk-freq-en-v3不显示,试了其他英语词典是可以显示的
yzk-freq-en-v3.zip (934.2 KB)

一直以为只有日语圈有做词频,原来英文圈也有,感谢分享。
然后你发现的这个 Bug,确实也在启用这个词频词典上发生了。

简单来说:Yomitan 在匹配词频时,会同时核对词典的 [词头][读音] 字段。v1.2.1以及之前的版本都是把牛津的音标(比如 /ˈæpl/)塞进了 Yomitan 的读音字段里,导致英文词频词典在核对时无法匹配(词频词典认为 apple 没有读音字段,所以拒绝匹配)。看了下,基本上英文圈都没有在读音字段放音标(我之前是套用日语的逻辑,把假名读音的位置用来放英语音标了)。

这两天我会推送一个 v1.2.2。把音标清出了 [读音] 字段,前置到了每个释义的顶部(加了一个 :speaker_low_volume: 小喇叭图标)。这样就兼容 yzk-freq-en 等词频词典了。

感谢反馈,等我发新版。效果如图:

1 Like

词频词典的话,目前只有上面传的附件的那个遇到不显示的问题。需安装的 Yomitan 英语辞典(17) - Google 云端硬盘
这个链接里有网上搜到的博主自制的词频词典,可以正常显示

Add images

这波直接王炸 :rofl:

1、查看了下, yzk-freq-en 词频词典里面有 [词头]reading 字段,同时其reading 字段跟单词完全一致。v1.2.1以及之前的版本的reading字段是音标,[词头]reading 字段一起匹配就“失效”了。
而你分享的链接里面的其他词频词典 reading 字段留空,所以只要匹配上 [词头] 就能正常显示了。

2、原来去年就已经有博主做 Yomitan 词典了嘛,看来我检索能力还不太行啊,这波有点重复造轮子那味了。 :joy:

3、看了下这位博主做的,才发现 Yomitan 自带了重定向的格式了,所以目前准备参考优化了,大概体积能控制在30MB以内了(小丑竟是我自己)。整体优化后,这几天应该会发布个1.3版本了。

1 Like

我看主楼写了anki和asbplayer,有需要的话可以看下这个博主的(有提供英文的本地音频):我的日语沉浸制卡流程 | Ken’s Shelter
可以部署下本地音频,查词制卡时候会快一些

感谢分享。

之前也想过做本地音频来着,但是不知道怎么做,就直接在线谷歌/有道音频了 :joy:

Very cool project!

Can’t wait to have the 2.0 script be released so that I can make modifications to it :smiley:

谢谢更新, 你感觉这个字体粗细显示是不是你最开始发的那种好一点?


上面的是你这本,下面是另一本