php讀取pdf數據,pdf導出jpg圖片 php

本文目錄一覽:

如何從php程序讀取pdf文檔中的文本信息

PHP程序pdf格式文件函數庫

本函數庫共有65個函數

PDF是Adobe所發展的可攜式文件格式,它的文件可以在網路上傳輸、瀏覽,甚至使用印表機印出,或使用其它輸出裝置輸出,都可以保存原來的文字及圖片的編排。詳細的信息可以參考 Adobe 的網站。參考其中有關 PDF 或 Acrobat 的部份。

在 UNIX 系統中,可以使用 Thomas Merz 開發的 PDF 函數庫。將它編譯安裝完成後,再編譯 PHP 程序方可供 PHP 使用 pdflib。編譯時可能要 JPEG library 及 TIFF library。

除了用這個函數庫可以建立 PDF 文件外,FastIO 公司發展的產品 ClibPDF 也可以處理 PDF 文件。

以下為處理 PDF 文件的範例,本例對 test.pdf 加工後等待用戶讀取。

?php

$fp = fopen(“test.pdf”, “w”);

$pdf = PDF_open($fp);

pdf_set_info_author($pdf, “Uwe Steinmann”);

PDF_set_info_title($pdf, “Test for PHP wrapper of PDFlib 2.0”);

PDF_set_info_author($pdf, “Name of Author”);

pdf_set_info_creator($pdf, “See Author”);

pdf_set_info_subject($pdf, “Testing”);

PDF_begin_page($pdf, 595, 842);

PDF_add_outline($pdf, “Page 1”);

pdf_set_font($pdf, “Times-Roman”, 30, 4);

pdf_set_text_rendering($pdf, 1);

PDF_show_xy($pdf, “Times Roman outlined”, 50, 750);

pdf_moveto($pdf, 50, 740);

pdf_lineto($pdf, 330, 740);

pdf_stroke($pdf);

PDF_end_page($pdf);

PDF_close($pdf);

fclose($fp);

echo “A HREF=getpdf.php3finished/A”;

?

上例中的 gettest.php3 可能像下面的樣子

?php

$fp = fopen(“test.pdf”, “r”);

header(“Content-type: application/pdf”);

fpassthru($fp);

fclose($fp);

?

PDF_get_info: 返迴文件信息。

PDF_set_info_creator: 配置建檔者字元串。

PDF_set_info_title: 配置文件標題。

PDF_set_info_subject: 配置文件主題。

PDF_set_info_keywords: 配置文件的關鍵字。

PDF_set_info_author: 配置文件作者。

PDF_open: 建立新的 PDF 檔。

PDF_close: 關閉 PDF 檔。

PDF_begin_page: 啟始 PDF 文件頁面。

PDF_end_page: 關閉 PDF 文件頁面。

PDF_show: 輸出字元串到 PDF 文件。

PDF_show_xy: 輸出字元串到指定坐標。

PDF_set_font: 配置使用的字型及大小。

PDF_set_leading: 配置行距。

PDF_set_text_rendering: 配置文字表現方式。

PDF_set_horiz_scaling: 配置文字水平間距。

PDF_set_text_rise: 配置文字高度。

PDF_set_text_matrix: 配置文字矩陣。

PDF_set_text_pos: 配置文字位置。

PDF_set_char_spacing: 配置字元間距。

PDF_set_word_spacing: 配置字間距。

PDF_continue_text: 輸出文字。

PDF_stringwidth: 計算字元串的寬度。

PDF_save: 儲存環境變數。

PDF_restore: 還原環境變數。

PDF_translate: 移動原點。

PDF_scale: 縮放類。

PDF_rotate: 旋轉類。

PDF_setflat: 配置平滑值。

PDF_setlinejoin: 配置連接參數。

PDF_setlinecap: 配置 linecap 參數。

PDF_setmiterlimit: 配置斜邊界限。

PDF_setlinewidth: 配置線寬。

PDF_setdash: 配置虛線樣式。

PDF_moveto: 配置處理的坐標點。

PDF_curveto: 繪貝氏曲線。

PDF_lineto: 繪直線。

PDF_circle: 繪圓。

PDF_arc: 繪弧。

PDF_rect: 繪長方形。

PDF_closepath: 形成封閉的向量形狀。

PDF_stroke: 沿向量繪線。

PDF_closepath_stroke: 形成封閉的向量形狀並沿向量繪線。

PDF_fill: 填滿目前的向量。

PDF_fill_stroke: 填滿目前的向量並沿向量繪線。

PDF_closepath_fill_stroke: 形成封閉的向量形狀沿向量繪線並填滿。

PDF_endpath: 關閉目前向量。

PDF_clip: 組合所有向量。

PDF_setgray_fill: 指定填入的顏色為灰階。

PDF_setgray_stroke: 指定繪圖的顏色為灰階。

PDF_setgray: 指定繪圖的顏色為灰階並填入。

PDF_setrgbcolor_fill: 指定填入的顏色為彩色。

PDF_setrgbcolor_stroke: 指定繪圖的顏色為彩色。

PDF_setrgbcolor: 指定繪圖的顏色為彩色並填入。

PDF_add_outline: 目前頁面加入書籤。

PDF_set_transition: 配置頁的轉換。

PDF_set_duration: 配置二頁的切換時間。

PDF_open_gif: 打開 GIF 圖檔。

PDF_open_memory_image: 打開內存圖檔。

PDF_open_jpeg: 打開 JPEG 圖檔。

PDF_close_image: 關閉圖檔。

PDF_place_image: 放置圖片到 PDF 檔指定位置。

PDF_put_image: 放置圖片到 PDF 檔。

PDF_execute_image: 放置 PDF 檔中圖片到指定位置。

PDF_add_annotation: 加入注釋。

php怎麼實現在線閱讀pdf文件

為了更好地用戶體驗,建議你前端採用 FlexPaper在線顯示文檔組件來顯示你的文檔,先用PDF2SWF工具將你的pdf轉成flash文件,然後用 FlexPaper來顯示轉換後的swf文件,這樣用戶瀏覽速度會很快,就像百度文庫那樣!

!DOCTYPE HTML PUBLIC “-//W3C//DTD HTML 4.0 Transitional//EN”

html

head

title/title

script type=”text/javascript” src=”pdfobject.js”/script

script type=”text/javascript” src=”jquery-1.8.0.min.js”/script

script type=”text/javascript”

$(document).ready(function(){

//第一種方式

// var myPDF = new PDFObject({ url: “1.pdf” }).embed();

//第二種方式

var variablename = new PDFObject({ url: “1.pdf” }).embed(“pdfobj”);

//第三種方式

// var myembedparams = {

// url: “1.pdf”

// };

// var myPDF = new PDFObject(myembedparams).embed();

});

/script

/head

bodyasdfadsfasdf

div id=”pdfobj”/div

/body

/html

我想用PHP讀取PDF文件的內容,尤其是現在很多的掃描後轉為PDF的文件,請問怎麼讀?

你可以從網上找一些為PHP語言編寫的 pdf 擴展庫,數量不少,比如:

PHP的PDF解析庫 PdfParser

PdfParser 是一個標準的 PHP 庫提供個用於從 PDF 文件中抽取數據的工具。它載入 PDF 文件並解析文件中對象、頭和元數據,可抽取其中的文本信息,支持壓縮的 PDF、MAC OS 羅馬字符集編碼、8進位和16進位編碼。兼容 PSR-0 和 PSR-1。

 

示例代碼:

$document = \Smalot\PdfParser\Document::parseFile(‘document.pdf’);

$pages    = $document-getPages();

$text     = $pages[1]-getText();

PHP官方里也有一個對PDF支持的庫 : PDFlib, 你可以根據自己的需要和喜好來使用。

php讀取pdf文檔內容,並分頁顯示

?php()

// 創建一個新的pdf文檔句柄

$pdf = pdf_new();

// 打開一個文件

pdf_open_file($pdf, “pdftest.pdf”);

// 開始一個新頁面(a4)

pdf_begin_page($pdf, 595, 842);

// 得到並使用字體對象

$arial = pdf_findfont($pdf, “arial”, “host”, 1);

pdf_setfont($pdf, $arial, 10);

// 輸出文字

pdf_show_xy($pdf, “this is an exam of pdf documents, it is a good lib,”,50, 750);

pdf_show_xy($pdf, “if you like,please try yourself!”, 50, 730);

echo “a href=m.php?page=1首頁/a “;

if($page!=1){

echo “a href=m.php?page=”.($page-1).”上一頁/a “;

}

if($page$page_count){

echo “a href=m.php?page=”.($page+1).”下一頁/a “;

}

echo “a href=m.php?page=”.$page_count.”尾頁/a”;

// 結束一頁

pdf_end_page($pdf);

// 關閉並保存文件

pdf_close($pdf);

?更多問題到問題求助專區

原創文章,作者:小藍,如若轉載,請註明出處:https://www.506064.com/zh-tw/n/304490.html

(0)
打賞 微信掃一掃 微信掃一掃 支付寶掃一掃 支付寶掃一掃
小藍的頭像小藍
上一篇 2025-01-01 11:05
下一篇 2025-01-01 11:05

相關推薦

  • Python讀取CSV數據畫散點圖

    本文將從以下方面詳細闡述Python讀取CSV文件並畫出散點圖的方法: 一、CSV文件介紹 CSV(Comma-Separated Values)即逗號分隔值,是一種存儲表格數據的…

    編程 2025-04-29
  • PHP和Python哪個好找工作?

    PHP和Python都是非常流行的編程語言,它們被廣泛應用於不同領域的開發中。但是,在考慮擇業方向的時候,很多人都會有一個問題:PHP和Python哪個好找工作?這篇文章將從多個方…

    編程 2025-04-29
  • 用Python繪製酷炫圖片

    在本篇文章中,我們將展示如何使用Python繪製酷炫的圖片。 一、安裝Python繪圖庫 在使用Python繪製圖片之前,我們需要先安裝Python繪圖庫。Python有很多繪圖庫…

    編程 2025-04-29
  • Python基礎教程第三版PDF下載

    熟練掌握Python編程語言可以讓你輕鬆地用代碼解決很多問題,Python基礎教程第三版是一本適合初學者的Python教程。本文將從幾個方面詳細介紹Python基礎教程第三版PDF…

    編程 2025-04-29
  • Python中讀入csv文件數據的方法用法介紹

    csv是一種常見的數據格式,通常用於存儲小型數據集。Python作為一種廣泛流行的編程語言,內置了許多操作csv文件的庫。本文將從多個方面詳細介紹Python讀入csv文件的方法。…

    編程 2025-04-29
  • 如何用Python統計列表中各數據的方差和標準差

    本文將從多個方面闡述如何使用Python統計列表中各數據的方差和標準差, 並給出詳細的代碼示例。 一、什麼是方差和標準差 方差是衡量數據變異程度的統計指標,它是每個數據值和該數據值…

    編程 2025-04-29
  • Python多線程讀取數據

    本文將詳細介紹多線程讀取數據在Python中的實現方法以及相關知識點。 一、線程和多線程 線程是操作系統調度的最小單位。單線程程序只有一個線程,按照程序從上到下的順序逐行執行。而多…

    編程 2025-04-29
  • 使用Spire.PDF進行PDF文檔處理

    Spire.PDF是一款C#的PDF庫,它可以幫助開發者快速、簡便地處理PDF文檔。本篇文章將會介紹Spire.PDF庫的一些基本用法和常見功能。 一、PDF文檔創建 創建PDF文…

    編程 2025-04-29
  • Python爬取公交數據

    本文將從以下幾個方面詳細闡述python爬取公交數據的方法: 一、準備工作 1、安裝相關庫 import requests from bs4 import BeautifulSou…

    編程 2025-04-29
  • Python兩張表數據匹配

    本篇文章將詳細闡述如何使用Python將兩張表格中的數據匹配。以下是具體的解決方法。 一、數據匹配的概念 在生活和工作中,我們常常需要對多組數據進行比對和匹配。在數據量較小的情況下…

    編程 2025-04-29

發表回復

登錄後才能評論