zoukankan      html  css  js  c++  java
  • pdf转txt

    ubuntu pdf转jpg或txt

    chenlei posted @ 2009年12月30日 17:22 inLinux , 1818 阅读

    呵呵,刚刚在网上定购了一款mp5,后来才发现它不支持PDF!

    没办法,只好查一下转换的方法,呵呵,

    (1)PDF转JPG:

    安装一个软件ImageMagick:

    # sudo apt-get install imageMagick

    然后就可以转换了,yes!!

    # convert XXX.pdf XXX.jpg

    这样XXX.pdf 就转换成了一大堆的XXX-*.jpg,一页一张JPG。

    如果想清晰些(实验中):

    # convert -verbose -colorspace RGB -resize 1800 -interlace none -density 300 -quality 100 XXX.pdf XXX.jpg

    (2)PDF转txt:

    我们要用poppler来做,它是系统自带的,

    呵呵,先加一个中文支持:

    # sudo apt-get install poppler-data

    嘻嘻,转换啦!!

    # pdftotext -layout -nopgbrk XXX.pdf

    因为pdftotext不支持同时处理多个 pdf,所以用批处理要脚本搞定,打开终端,进入放置 pdf 的目录,运行下面命令

    find ./ -name '*.pdf' | while read i; do pdftotext -layout -nopgbrk $i; done

    很快就在当前目录下输出很多 txt 文件,“-layout”参数表示保留页面布局,“-nopgbrk”表示不输出换行符,自己对比一下就知道区别了。

    doc docx to txt

    abiword --to=txt example.doc

  • 相关阅读:
    Kosaraju算法---强联通分量
    Java和C++的区别
    嵌入式面试题汇总
    tabbar 之 基本结构搭建
    路由 之 再识
    常见问题 之 vue项目中使用less报错
    路由 之 初识
    VueCLI3创建项目和目录结构与配置信息详解
    runtime-compiler 和 runtime-only的区别
    vueCLI2 之 目录结构
  • 原文地址:https://www.cnblogs.com/smallcoderhujin/p/3412697.html
Copyright © 2011-2022 走看看