牛津高阶英汉双解词典第10版(OALD 10)Yomitan 适配版 V3.3

Yomitan / Yomichan 是外语沉浸学习和 Anki 制卡的重要工具,但高质量的英汉学习词典适配版相对稀缺。为了配合 Anki、asbplayer 和日常英语输入,我在 OALD 10 数据的基础上制作了这份 Yomitan 适配版:前期使用 Gemini 确定大致排版方向,之后用 Codex 持续完善解析逻辑、结构化排版、测试和发布流程。

本词典基于 xingxingla 分享的 OALD 10 数据。上游文件通常名为 oaldpex.mdx,文件名本身不包含版本号。为保证本次发布可复现,构建时按云盘修改时间保存了本地快照别名 oaldpex-202608231432.mdx2026.08.23.1432 只是本项目使用的本地快照标识,并非原作者提供的版本号。格式与排版设计参考了 librola33 的《明镜日汉双解辞典》Yomitan 版。在此感谢两位的分享。

V3.1 建立了从源 HTML、内部 IR 到最终 ZIP 的完整性检查;V3.2 补齐响应式排版、公开回归测试与三版本发布门禁;V3.3 进一步完善词典内查词导航、翻译来源标识、高序号义项、用法说明、动词形式和严格包结构审计。


:inbox_tray: V3.3 下载

成品 ZIP 可以直接导入 Yomitan,不需要解压

版本 文件名 适合人群 下载
标准双解版 OALD10_Yomitan_V3.3.0.zip 英文释义 + 中文翻译 + 中文界面标签 Google Drive
百度网盘(t4j7)
进阶沉浸版 OALD10_Yomitan_V3.3.0_Immersion.zip 英文释义与例句 + 中文辅助标签和导航 Google Drive
百度网盘(q2tv)
国际纯英版 OALD10_Yomitan_V3.3.0_Global.zip 纯英文内容 + 英文界面标签 Google Drive
百度网盘(e6rn)

:light_bulb: 老用户升级提示:请先在 Yomitan 设置中删除旧版词典,再导入新版 ZIP。路径一般是 Yomitan Settings -> Dictionaries -> Configure installed and enabled dictionaries...

SHA256

  • 标准双解版465D4885BDA6F292305D38F53532EA21F46647C17829EB1A754C5B1726F538B1
  • 进阶沉浸版CB496CAF4C03CFB9E1CC2DFECADF8C28F6F46E1858A45E8F2CB1A347C2A657E9
  • 国际纯英版BB1EFF0B3CF7869BFCC4840F9F55AB0E0FBDD8B8762E3F9B1EF7E986C97C6A67

:loudspeaker: V3.3 更新内容

1. 词典内导航可以直接查词

点击展开详情
  • See also、Phrasal verbs、Wordfinder 和 More Like This 中的词条都改为可点击的 Yomitan 查询链接。
  • 定义正文、元数据标签、变体、例句、用法说明、同音词和特殊面板中的链接同样保留;即使显示文字与实际词条不同,也会使用上游给出的规范目标查词。
  • 短语动词的重定向别名会继承目标词条的 Yomitan 变形规则,改善动词变形后的短语检索。
  • 上游确实存在多个有效目标的重定向会完整保留,不再静默只选一个。
  • Phrasal verbs 使用克制的浅底导航带,普通 See also 与同义词/反义词等关系提示不加底框;同时去掉容易单独换行的装饰箭头。
  • More Like This 继续作为可折叠学习面板,内部词条改用随宽度自动换行的紧凑链接流。

2. 排版与结构层级继续统一

点击展开详情
  • 21 至 50 的高序号义项改用单字符带圈数字,不再出现编号压住正文或括号拆行。
  • 词条音标采用悬挂内容列,UK / US 音标换行后仍与第一行对齐,不会掉到喇叭图标下方。
  • 双语例句的英文行使用常规圆点,中文译文作为无前缀次行与英文正文列对齐;三角符号只用于真正可以展开的面板。
  • 翻译来源改为低干扰尾注,例如 我在网上读到的。〔人工校译〕;不再让来源标签与项目符号争抢左侧标记槽。
  • Verb Forms 使用明确的原形、第三人称单数、过去式、过去分词和 -ing 角色标签,并按宽、中、窄窗口自动调整布局。
  • 用法说明增加 Usage note 用法说明 标题,与普通释义和折叠面板区分。
  • Wordfinder、More Like This、面板标题、链接颜色与明暗主题使用统一的视觉层级。

3. 翻译来源标识更清楚

点击展开详情
  • 标准双解版现在能区分官方译文、人工校译和 AI 翻译。官方译文不增加标签,人工贡献者译文末尾显示 〔人工校译〕,机器译文末尾显示 〔AI翻译〕
  • 不直接显示 [leon406][hany105] 等用户名,避免普通使用者不清楚标签含义;精确贡献者来源仍保留在构建统计中,便于维护者审计。
  • 例句筛选优先级为官方译文、人工校译、AI 翻译;同一层级继续保持上游顺序。
  • 如果一个翻译节点同时出现互相冲突的来源标记,转换会直接失败,而不是猜测其来源。
  • Immersion 与 Global 会把译文正文和来源标签一起剔除,不会出现只剩一个孤立标签的情况。

4. 同步上游并明确三版本语言策略

点击展开详情
  • 上游原文件名为 oaldpex.mdx;当前制品使用本地快照别名 oaldpex-202608231432.mdx,本地快照标识为 2026.08.23.1432,词典 revision 为 2026.08.23。该快照标识来自云盘修改时间,不是上游官方版本号。
  • 新快照采用 hanyl 标记记录 hany105 翻译,并新增音频按钮与动词形式包装 class;脚本按语义结构处理这些变化,没有加入针对单词或输出文本的一次性替换。
  • 8 月 23 日快照新增或扩展了 Bengali、bipolar、Burton、draught 等真实词条,合并了若干多词性标签,修正了部分翻译,并净移除 29 条重定向别名;记录级差分已经逐项复核。
  • 其中 5 个共享 Which Word 面板的 note at 引用缺少常规 xt 属性。脚本只对这个经过审核的精确结构进行推断,其他缺失或未知类型仍会让发布门禁失败。
  • 全量结构扫描没有遗留未知交叉引用类型、未知面板类型、未分类链接或意外解析失败。
  • 保留多段用法说明、共享词项变体、句型、定义/元数据/变体链接、动词形式槽位、交叉引用、More Like This 和当前已知的 18 类特殊面板。
  • Immersion 的释义、例句、用法说明正文和面板正文保持纯英文;shortcut、语法/用法限制、变体和导航标题保留简洁中文辅助。
  • Global 的中文语言节点和未标语言的 CJK 文本均要求为 0

5. 更严格的回归测试与发布门禁

点击展开详情
  • 合成回归测试增加到 65 个,覆盖解析器、渲染器、翻译来源、重定向、预览器、源语料分析、时间戳 revision、基线选择和最终包审计;测试夹具均为人工构造,不包含 Oxford 词典正文。
  • 最终包不仅要求每个 term row 严格符合 Yomitan v3 的八字段结构,还会检查每种 structured-content tag 允许的属性。Yomitan 链接节点不允许携带 data/style,因此语义 class 统一放在合法的外层 span,显示与跳转不变。
  • 新增结构化释义 sequence 复用审计,可以区分合法别名复用与冲突内容。
  • 审计会检查全部已分类的源链接及规范目标,并在最终 ZIP 中继续检查内部链接、More Like This、用法说明标题、高序号义项、重定向规则及关键父子层级。
  • 修复粗体或 gloss 范围跨过定义内链接时可能泄漏富文本标记的问题;嵌套面板也会归属其真实语义容器,不再被外层定义误计数。
  • package audit v7 也纳入严格基线,新增链接 wrapper、富文本标记泄漏与链接语义检查,避免旧审计器误判新结构。
  • 发布门禁会依次运行测试、扫描完整源数据、生成三包、校验 ZIP、执行语义审计并输出 SHA256 清单。

本次全量验证

点击展开详情

本版以作者发布的 oaldpex.mdx 为源文件;为复现本次构建,本地快照保存为 oaldpex-202608231432.mdx,快照标识为 2026.08.23.1432,词典 revision 为 2026.08.23。快照标识仅用于构建核对,不代表上游官方版本。

  • Source → IR:76,304 个词条、121,991 个源义项、121,577 条释义、145,072 条保留例句、67,782 个源面板全部通过计数核对。
  • 翻译来源冲突为 0;官方、leon406、hany105 与 AI 的精确来源计数保留在转换器构建日志中,不再手工抄入发布稿。
  • More Like This:35,553 个项目、35,228 个有效链接;交叉引用:30,599 组、38,160 个链接;定义、元数据和变体链接分别为 37,149361204 个,全部核对一致。
  • 每个最终版本:293,550 行 term bank、76,668 行结构化词条、122,378 个渲染义项、67,815 个面板。
  • 标准双解版:4,134,376 个审计结构节点、148,582 个内部链接,异常 0
  • 进阶沉浸版:3,589,225 个审计结构节点、148,573 个内部链接,异常 0;中文正文节点 0
  • 国际纯英版:3,318,001 个审计结构节点、148,576 个内部链接,异常 0;中文语言节点与 CJK 字符均为 0
  • 非法 term row、sequence 冲突、空义项标题、空结构行、富文本标记泄漏、不可见字符泄漏、未知标签/CSS class、悬空重定向和语义异常均为 0
  • 另以官方 Yomitan v3 JSON Schema 独立复核 96 个包内文件、880,758 行 bank 数据,错误 0
  • 完整源结构与审核基线相比,变化计数和结构区段均为 0;全部 65 个合成回归测试通过。

:camera_with_flash: 实际效果截图

标准双解版

进阶沉浸版 Immersion

国际纯英版 Global


三种版本的区别

  • 标准双解版:英文释义、中文翻译和中文标签都保留,适合大多数中文学习者。
  • 进阶沉浸版:主释义、例句和长正文只保留英文;shortcut、语法/用法提示、变体和导航标题保留中文辅助,适合从双解逐步过渡到英英环境。
  • 国际纯英版:内容、元数据和界面标签均为英文;校验器要求中文语言节点与 CJK 文本字符同时为 0

源码与自行构建

常用命令
# 标准双解版
python main.py -i oaldpex.mdx -o build\bilingual -m bilingual -u zh

# 进阶沉浸版
python main.py -i oaldpex.mdx -o build\immersion -m mono -u zh

# 国际纯英版
python main.py -i oaldpex.mdx -o build\global -m mono -u en

作者分享的上游文件通常直接名为 oaldpex.mdx,自行构建时无需添加日期。只有维护者需要复现正式发布和匹配严格基线时,才应按云盘修改时间另存一个本地快照别名。

三个版本应使用不同输出目录。全量构建比较耗时,内存不足时建议顺序生成,不要并行运行。


使用说明与反馈

Yomitan 导入后会使用词典自带的结构化 CSS。导入 Anki 时,具体字体和颜色还可能受到 Anki 卡片模板覆盖;V3.3 保证词典自身结构与 class 定义完整,但不会强行覆盖所有第三方模板样式。

如果发现显示异常、释义缺失、例句错位或导入问题,请反馈具体词头、所用版本和截图。相比“看起来哪里不对”,一个可复现单词通常更容易定位。

感谢评论区大家的意见反馈与支持。


:speech_balloon: 作者碎碎念:

自去年离职以来,今年才投入一些时间在英语的沉浸式输入上(指看《Breaking Bad》),然后最近在找工作中。因为有些许焦虑,反而进度上有点放慢了。

做这个工具主要是为了自己日常沉浸学习用得顺手。如果它也刚好帮到了同样在用 Yomitan 学英语的你,那就太好了。祝大家学习顺利。

14 个赞

谢谢制作Yomitan适用的词典,请问下这个词典的大小是否有可能小一点?好像一般Yomitan版本的词典不超过50M的比较多

盲猜一把,用的Google的ai甚至就是antigravity,语言风格太像了,“极致”“优雅”

在“这个词典的大小是否有可能小一点?”这个问题上,是可以的。

说下目前体积大的原因吧:
1、原版mdx(2026年5月17日的版本)文件53.2MB,不过其中很多词的释义都是通过“@@@LINK”进行链接到主词条释义。
2、目前的Yomitan词典是把这些重定向链接都展开了,把释义都克隆到每一个衍生词下。

如果说一定要缩减体积的话,可能弊端:
划词时可能经常看到 🔗 请见主词条:XXX,得手动再点划词下主词条才能看到释义。

所以目前属于空间换体验了。

xingxingla 大佬最新的 mdx文件删除了部分词汇做了一些精简处理,理论上用脚本跑一遍之后,生成的体积会比现在小一些。因为Yomitan在词性变化上的检索没有词典软件那么智能,所以目前没有跟进最新的版本。

体积问题上就是看取舍了,后续再考虑下是否出一版小空间的吧。

大佬眼神真好 :joy:
确实是在用 Google 的 Gemini 。不过没用过 antigravity 这类 Agent,看来我有点落后时代了。

毕竟我用了好久,不过现在叛变到chatgpt了……Gemini flash太不靠谱,pro太慢,这个缺点已经让我可以忍受chatGPT的不说人话了。

看来我某种程度上习惯了Gemini Pro转圈时切出去干其他事情的设定了 :joy:,不过确实很慢。
GPT好久没续费了,都不知道“行情”如何了。

啊,为啥我切出去Gemini就不干活了?虽说确实挺强的,我前段时间生病就把症状和检查结果发Gemini pro,复盘看从头到尾没错过一次(包括对症猜因、检查结果解读、就诊建议)

既然折腾了,可以考虑基于官方ciku做一个纯净的OALD10双解版。

我这个是“物理意义”上的切,我是浏览器打开Gemini,然后切标签页看其他的了,让Gemini后台运行,而不是切其他Gemini对话。

感谢建议。

话说“官方ciku” 是指“牛津高阶词典第10版 Android App 解包后的 ciku.db”?(一开始没反应过来ciku是拼音,笑死)

刚了解到 leon406 的版本里面有注明其版本翻译部分来源于此,而 xingxingla 的版本是基于此之上做了些修改,所以目前的版本相对来说词条应该会更全一些。

目前的脚本主要是针对MDX的HTML文本进行排版的,数据库版本相当于重写一个版本了。
考虑了下,目前对“纯净”的需求不算大,同时这个帖子也算是抛砖引玉了,我短时间内应该不会开新版,留给其他人开坑吧,哈哈。

确实是个好思路,之前都没想到,如果以后遇到了MDX比较难修补的痛点我再考虑开个新坑。

噢噢,我用app多

谢谢解答。另外好像发现一个bug,有点小冲突的,Yomitan词典里同时开启yzk-freq-en-v3和这个词典的话,yzk-freq-en-v3不显示,试了其他英语词典是可以显示的
yzk-freq-en-v3.zip (934.2 KB)

一直以为只有日语圈有做词频,原来英文圈也有,感谢分享。
然后你发现的这个 Bug,确实也在启用这个词频词典上发生了。

简单来说:Yomitan 在匹配词频时,会同时核对词典的 [词头][读音] 字段。v1.2.1以及之前的版本都是把牛津的音标(比如 /ˈæpl/)塞进了 Yomitan 的读音字段里,导致英文词频词典在核对时无法匹配(词频词典认为 apple 没有读音字段,所以拒绝匹配)。看了下,基本上英文圈都没有在读音字段放音标(我之前是套用日语的逻辑,把假名读音的位置用来放英语音标了)。

这两天我会推送一个 v1.2.2。把音标清出了 [读音] 字段,前置到了每个释义的顶部(加了一个 :speaker_low_volume: 小喇叭图标)。这样就兼容 yzk-freq-en 等词频词典了。

感谢反馈,等我发新版。效果如图:

1 个赞

词频词典的话,目前只有上面传的附件的那个遇到不显示的问题。需安装的 Yomitan 英语辞典(17) - Google 云端硬盘
这个链接里有网上搜到的博主自制的词频词典,可以正常显示

Add images

这波直接王炸 :rofl:

1、查看了下, yzk-freq-en 词频词典里面有 [词头]reading 字段,同时其reading 字段跟单词完全一致。v1.2.1以及之前的版本的reading字段是音标,[词头]reading 字段一起匹配就“失效”了。
而你分享的链接里面的其他词频词典 reading 字段留空,所以只要匹配上 [词头] 就能正常显示了。

2、原来去年就已经有博主做 Yomitan 词典了嘛,看来我检索能力还不太行啊,这波有点重复造轮子那味了。 :joy:

3、看了下这位博主做的,才发现 Yomitan 自带了重定向的格式了,所以目前准备参考优化了,大概体积能控制在30MB以内了(小丑竟是我自己)。整体优化后,这几天应该会发布个1.3版本了。

1 个赞

我看主楼写了anki和asbplayer,有需要的话可以看下这个博主的(有提供英文的本地音频):我的日语沉浸制卡流程 | Ken’s Shelter
可以部署下本地音频,查词制卡时候会快一些

感谢分享。

之前也想过做本地音频来着,但是不知道怎么做,就直接在线谷歌/有道音频了 :joy:

Very cool project!

Can’t wait to have the 2.0 script be released so that I can make modifications to it :smiley:

谢谢更新, 你感觉这个字体粗细显示是不是你最开始发的那种好一点?


上面的是你这本,下面是另一本