| Ausführung | 4.2 |
|---|---|
| Herausgeber | PDFlib |
| Veröffentlichungsdatum | 23.05.2013 |
| Datum hinzugefügt | 24.05.2013 |
| Os Anforderungen | Windows 8, Windows Vista, Windows, Windows 7, Windows XP |
| Bedarf | None |
| Downloads insgesamt | 160 |
| Preis | Free to try |
Beschreibung
PDFlib TET extrahiert Text, Bilder und Metadaten aus PDF-Dokumenten. TET stellt den Textinhalt eines PDFs als Unicode-Strings bereit, plus detaillierte Informationen zu Glyphen und Schriftarten sowie die Position auf der Seite. Rasterbilder werden in gängigen Rasterformaten extrahiert. TET konvertiert optional PDF-Dokumente in ein XML-basiertes Format namens TETML, das Text und Metadaten sowie Ressourceninformationen enthält.