大致思路:
- 解压mdx为db数据库(只适合体量比较小的词典)(个人比较懒选取了这一步)
或者自己编写读取mdx的逻辑 - 编写 HTML → Markdown 转换器
不要直接喂给ai html这样不好,而且许多html标签缩写根本不能直接看出来用意
有许多开源解决方案比如markdownify,当然面对许多手搓标签更建议直接用BeautifulSoup解析 - 编写MCP Server
直接丢给AI写就好了,注意一下@@@LINK的跳转问题 - 接入Agent
看了一下国产软件支持mcp并不是很好,豆包支持mcp但是直接倒在了调用python的情况(也许是豆包内置了python但是没有安装bs4),然后Workbuddy以及千问办公等能导入mcp但是是要强迫登录+积分制,不支持指定自己的模型…
于是我还是接入了生产力工具…
大概就是这样子
想法是来自DictTango Windows 1.7.2的新功能 [DictTango] Windows版 v1.7.2 - DictTango - FreeMdict Forum
但是体感感觉不好,html很浪费token,于是有了本帖
可以优化的点很多,个人理想的架构:
词典提供查词和提供MCP能力,词典作者或者社区提供html2md的脚本
然后这里提供本人帖子中的mcp供大家玩一玩:
MCP.7z (5.7 MB)
接入方法stdio
python dict-mcp-server/server.py
这里使用了 @阿弥陀佛 制作的精美的两本词典,在此感谢
【阿彌陀佛】古代汉语词典2[商务]文字版2022.9.25更新 · 古汉语常用字字典[王力][第5版][商务馆]2022.5.8
