先感谢大神无私分享,请教为什么mdict原始软件不能搜索词头
不太清楚,我手里只有欧路
好,明白,请教您,前文提及的清内存如何清理
大约有一万个词头的内容完全重复,比如quad
bojo_deduped.rar (3.9 MB)
应该不是我这边的问题,你看下这两个原始出处是否也有重复
quad¹…quad¹³, 这共有13个,还有一个合并的词头 quad。这在发布贴中有说明。我看转换文件中,有多个词头quad,却都没带上标。最好用 Mdict 打开看看。
我知道是网页的问题。一般打字不用superscript,而且英文单词基本上没有带superscript的,所以应该处理掉。
superscript仅仅是字典内部用的的标签,不应该是词头。词头应该纯粹就是英文词语。
同样的内容,一旦有了上标,就会重复,因为那个词头会在两个词头中出现,一次无上标,一次加了上标。
还有其他重复的内容的原因,我没细看了。
重复判定标准是gd tag里面的文字完全一样。
gd 中可通过设置解决。
我说的是< gd > html element, 不是软件
仔细看了一下原文本中带上标的词条,一个上标词条确实含有其他上标的内容,但是隐藏的没显示出来,各个上标的内容也不完全相同。猜想app采用的是动态显示方式,才处理成这样,与改编者无关。
对的。quad 等等这部分我没动,@meandmyhomies 提醒我有重复,我以为是我提取习语产生的。既然是你那边就存在的重复,加上我也不懒得动,而且这部分也是隐藏的,所以……代码能跑不改也罢 ![]()
我也差点理解错了。这些东西原本没注意,深入进去才能弄清楚原由。
没明白有啥可深入理解的,内容重复,字面上的重复。体积大约50MB。
原因有啥玄机和困难么,反正我已经去重了。原版的mdx我没有
有些单词的词性上方会额外出现一条分割线,特别是及物动词和非及物动词上面。这个问题可以考虑修复一下吗?
此外,如果解释的数量超过9个,序号排版没有对齐。
下面是我自己用AI改的,把编号改成“01,02”这种格式了。但是多余的分割线实在去不掉 ![]()
(帖子已被作者删除)
辛苦啦,这已经很好了





