Remplace l'appel externe `pdftotext -layout` (poppler-utils) par
pdfplumber, une bibliotheque Python pure : plus aucune dependance
systeme, ce qui permettra d'empaqueter l'application en executable
autonome.
- `read_pdf()` retourne un `PdfContent` (texte layout + mots de la
premiere page avec coordonnees) ; `extract_text_from_pdf()` est
conserve comme wrapper de compatibilite.
- Metadonnees : la reference est desormais extraite via les
coordonnees geometriques des mots (fiable sur l'en-tete
multi-colonnes), regex du destinataire durcie (forme pointee
`S.C.I.`).
- Operations : reduction des espaces multiples dans les descriptions.
- Dockerfile : suppression de poppler-utils.
Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
- Backend Python (uv + click + FastAPI)
- CLI: plesna-gerance extract <pdf> pour extraire les donnees
- CLI: plesna-gerance serve pour lancer le serveur API
- API REST: POST /api/extract pour upload et extraction de PDF
- Parsers modulaires: metadata, locataires, operations
- Utilise pdftotext (poppler-utils) pour l'extraction de texte
- Frontend Vue.js + Tailwind CSS
- Interface split-screen: PDF a gauche, donnees a droite
- Preview PDF avec zoom et navigation pages (pdf.js)
- Visualisation structuree des donnees extraites
- Sections depliables: metadata, locataires, operations
- Drag & drop pour upload de PDF
- Extraction automatique a la selection du fichier