「PDFMathTranslate」分享开源 PDF 文献翻译工具,保留公式和图表,支持双语对照

1次阅读

共计 404 个字符,预计需要花费 2 分钟才能阅读完成。

由于自己最近在做科研工作,多了很多文献阅读的任务。但是这些文献大多都是英文的,阅读起来相比母语还是会慢上不少。因此开发了一款 PDF 翻译工具来提升阅读速度, 在翻译文档的同时,保留原文档的公式、图表以及目录结构

虽然大多数 arxiv 上的论文都提供了 latex 源码,可以直接在 html 中翻译,或者使用 MathTranslate 这样的工具进行翻译。但是很多出版的图书出于版权考虑是不提供 latex 源码的,这样就只有翻译 pdf 文件这一个选择了。

这些专业图书动辄就是上千页,目前收费的服务基本都是按页收费的,翻译整本图书的成本非常高,而免费的服务质量又一言难尽,反而还会拉低阅读效率。

好在 latex 编译出来的 pdf 有比较明显的特征,我们可以使用简单的正则把公式部分提取出来,然后将这些公式填回到译文中就实现我们想要的效果了。

项目地址

https://github.com/Byaidu/PDFMathTranslate

对比

「PDFMathTranslate」分享开源 PDF 文献翻译工具,保留公式和图表,支持双语对照

「PDFMathTranslate」分享开源 PDF 文献翻译工具,保留公式和图表,支持双语对照

正文完
 0