zoukankan      html  css  js  c++  java
  • PHP 读取PDF文件内容之PdfParser

    PdfParser,一个独立的PHP库,提供了多种工具来从PDF文件提取数据,不支持加密的PDF文件

    官方文档:https://www.pdfparser.org/documentation

    使用composer安装依赖包:

    composer require smalot/pdfparser

    安装成功后如下图:

    创建index.php文件,引入autoload.php文件:

    include 'vendor/autoload.php';

    1.一次性读取文件中的所有内容:

    include 'vendor/autoload.php';
    
    $parser = new SmalotPdfParserParser();
    $pdf = $parser->parseFile('document.pdf');
    $text = $pdf->getText(); //将所有内容读取到一个字符串中
    echo $text; 

    2.分页读取:

    include 'vendor/autoload.php';
    $parser = new SmalotPdfParserParser(); $pdf = $parser->parseFile('document.pdf'); $pages = $pdf->getPages(); //分页信息 foreach ($pages as $page) { echo $page->getText(); //输出每一页的内容 }

    3.获取文件的基本信息,如:制作人、日期、总页数等

    include 'vendor/autoload.php';
    $parser = new SmalotPdfParserParser(); $pdf = $parser->parseFile('document.pdf'); $details = $pdf->getDetails();
  • 相关阅读:
    ps怎么撤销的三种方法和ps撤销快捷键以及连续撤销多步快捷键
    jquery data()
    jQuery.extend方法
    Bootstrap
    骚操作
    mysql作业
    jQuery UI练习
    左侧菜单,表格,认证登录作业
    JS
    js中的DOM操作汇总
  • 原文地址:https://www.cnblogs.com/52lnamp/p/12870437.html
Copyright © 2011-2022 走看看