linux下如何将pdf转换成text文本
1、安装软件
sudo apt-get install gocr
sudo apt-get install tesseract-ocr
2、打开Screenshot截屏软件截取你要转换的文字


3、打开libreOffice Writer,将刚才截屏的图片托进去.

4、点击保存为PDF格式文件,文件名为text

5、找到保存好的text.pdf文件,右键打开终端.

6、在终端中输入pdftoppm text.pdf a,得到a-1.ppm文件

7、然后输入命令:tesseract a-1.ppm a,得到a.txt文件.

声明:本网站引用、摘录或转载内容仅供网站访问者交流或参考,不代表本站立场,如存在版权或非法内容,请联系站长删除,联系邮箱:site.kefu@qq.com。
阅读量:81
阅读量:145
阅读量:162
阅读量:55
阅读量:115