linux下如何将pdf转换成text文本
1、安装软件sudo apt-get install gocrsudo apt-get install tesseract-ocr
2、打开Screenshot截屏软件截取你要转换的文字


3、打开libreOffice Writer,将刚才截屏的图片托进去.

4、点击保存为PDF格式文件,文件名为text

5、找到保存好的text.pdf文件,右键打开终端.

6、在终端中输入pdftoppm text.pdf a,得到a-1.ppm文件

7、然后输入命令:tesseract a-1.ppm a,得到a.txt文件.
