Re: ExtractText and docs?
| Newsgroups | gmane.mail.spam.spamassassin.general |
|---|---|
| Message-ID | <[email protected]> |
On 3/20/25 6:52 PM, Alex wrote:
> Hi,
>
> I'm using ExtractText to identify QR codes in PDFs.
>
> # QR-code decoder
> extracttext_external zbar /usr/bin/zbarimg -q -D {}
> extracttext_use zbar .jpg .png .pdf .webp image/(?:jpeg|png) application/pdf
> add_header all ExtractText-Uris _EXTRACTTEXTURIS_
>
> However, now they're sending them in Word doc/docx format. Any tips on how to do that?
>
I think you need a wrapper that uses docx2pdf or word2pdf to create a pdf file, then zbarimg(1) on the {temporary} pdf file.
Giovanni
> This was just a regular Word document with a .docx extension.
>
>
OpenPGP_signature.asc
(application/pgp-signature, 840 B)
-----BEGIN PGP SIGNATURE----- wsF5BAABCAAjFiEEqg3TnG6R3qYMxl94+r7qCYlyWOUFAmfe7iEFAwAAAAAACgkQ+r7qCYlyWOW/ sRAAkvevasxLHXUuwoS5emNNRj14W5rStDyKCd4Hc7UZShtu2M9/CBuK23NDCZ60MgMxp7cLrpvb HXcfbM+KAYZTeXozbuiO+cxTIB10QEWCj+ijQW1o79cqFv80IGQbWIChI561U5AoU8I76BfHtd1U ZGKkKLPbrwRj6sQabvIK9Q+FSgcCfjk+qJ0ykM3f/v+wHsX5CSZvBSQX+cw274IQWBErnFbo7FDA x/mSMaB7B9DTSOWu0TIb1nAwNq78LNNQkXgCE7vdkS+U6s84gmLTFPc12lg5F7EEDb5bRAadekI2 Cuk5RPKDBfwnD/je9wQTihYdBLxCf7+kg+RHxR5MlwwnhvOQI7/nJTE7yBcWhg3PPES8oAVgzQaI RLEGjNnYVaa39SDJ2HXHWrISwEWIRzrI+8fGMVA2kU+ieHG0HFlyqDC47xBimiQ0iVeBl8vAxIxl Ko2fwSflfaPPPVJTKIoyIIBjkdvJAzjjG9Q83/DWwnVccqP1J1TFtzljnwsJveZzzbi6JoATnQA3 BBtRs5OrpdVOnrzQU7fyRFKn6L5BlagHD1YccYuhDX7wZ+oGSNLdChDSudA7pusKnHNjJU5Wg88i 3T42nKb5Tvn3VEGOWQyLXRQpuARCjGcDxYsq9DCmRVOg2Xe9P6HrdQP715Gero6N08IwZw6Mbv23 Jfw= =9asz -----END PGP SIGNATURE-----