Guest User

testing iText

a guest
May 30th, 2011
297
0
Never
Not a member of Pastebin yet? Sign Up, it unlocks many cool features!
Java 2.59 KB | None | 0 0
  1. package org.ali;
  2.  
  3. //import java.io.IOException;
  4. import java.io.PrintWriter;
  5. import java.io.FileOutputStream;
  6.  
  7.  
  8. import com.itextpdf.text.pdf.PRTokeniser;
  9. import com.itextpdf.text.pdf.parser.PdfContentStreamProcessor;
  10. import com.itextpdf.text.pdf.parser.ContentByteUtils;
  11. import com.itextpdf.text.pdf.parser.PdfReaderContentParser;
  12. import com.itextpdf.text.pdf.parser.RenderListener;
  13. import com.itextpdf.text.pdf.parser.TextExtractionStrategy;
  14. import com.itextpdf.text.pdf.parser.SimpleTextExtractionStrategy;
  15. import com.itextpdf.text.pdf.PdfContentByte;
  16. import com.itextpdf.text.pdf.PdfName;
  17. import com.itextpdf.text.pdf.PdfDictionary;
  18. ///////////////////////////////////
  19. import com.itextpdf.text.Document;
  20. import com.itextpdf.text.pdf.PdfImportedPage;
  21. import com.itextpdf.text.pdf.PdfReader;
  22. import com.itextpdf.text.pdf.parser.PdfTextExtractor;
  23. import java.io.File;
  24.  
  25. import java.awt.Rectangle;
  26. import com.itextpdf.text.pdf.parser.RenderFilter;
  27. import com.itextpdf.text.pdf.parser.RegionTextRenderFilter;
  28. import com.itextpdf.text.pdf.parser.FilteredTextRenderListener;
  29. import com.itextpdf.text.pdf.parser.LocationTextExtractionStrategy;
  30. import com.itextpdf.text.pdf.parser.TextMarginFinder;
  31.  
  32. import com.itextpdf.text.pdf.parser.PdfReaderContentParser;
  33. import com.itextpdf.text.pdf.PdfStamper;
  34.  
  35. public class PdfExctractor {
  36.     public PdfExctractor (String inFile, String outFile){
  37.         try{
  38.            
  39.             PdfReader reader = new PdfReader(inFile);
  40.             int n = reader.getNumberOfPages();
  41.             String str = PdfTextExtractor.getTextFromPage(reader, 1);
  42.             System.out.println(str + "\n\n total pages:" + n);
  43.            
  44.         } catch (Exception e){
  45.             e.printStackTrace();
  46.         }
  47.     }
  48.     public void parser3 (String src, String dest){
  49.         try{
  50.             PdfReader reader = new PdfReader(src);
  51.             PrintWriter out = new PrintWriter(new FileOutputStream(dest));
  52.             Rectangle rect = new Rectangle(70, 80, 100, 500);
  53.             RenderFilter filter = new RegionTextRenderFilter(rect);
  54.             TextExtractionStrategy strategy;
  55.             for (int i = 1; i <= reader.getNumberOfPages(); i++){
  56.                 strategy = new FilteredTextRenderListener(new LocationTextExtractionStrategy(), filter);
  57.                 out.println(PdfTextExtractor.getTextFromPage(reader, i));
  58.             }
  59.             out.flush();
  60.             out.close();
  61.         } catch (Exception e){
  62.             e.printStackTrace();
  63.         }
  64.     }
  65.     /**
  66.      * @param args
  67.      */
  68.     public static void main(String[] args) {
  69.         // TODO Auto-generated method stub
  70.         String pdfFile = "1.pdf";
  71.         String outText = "out.txt";
  72.         if (args.length > 0) pdfFile = args[0];
  73.         PdfExctractor p = new PdfExctractor(pdfFile, outText);
  74.  
  75.         p.parser3(pdfFile, "another_try.txt");
  76.  
  77.     }
  78.  
  79. }
Advertisement
Add Comment
Please, Sign In to add comment