Application du modèle YOLO X Layout pour la classification automatique des dossiers judiciaires
Application du modèle YOLO X Layout pour la classification automatique des dossiers judiciaires
1. Introduction : L'IA transforme la gestion des documents juridiques
La gestion manuelle des dossiers judiciaires numériques, composés de requêtes, listes de preuves, procès-verbaux d'audience et photographies, représente une tâche laborieuse et suj ...
Publié le 15 juin à 23h05
Déploiement d'un Système OCR avec PaddleOCR et OpenVINO sur Windows 10
Cet article détaille la mise en place d'un environnement de reconnaissance optique de caractères (OCR) basé sur PaddleOCR, optimisé avec OpenVINO, sur une machine sous Windows 10. L'objectif est de permettre la détection et la reconnaissance de texte, particulièrement utile dans des contextes industriels.
I. Configuraton de l'environnement et t ...
Publié le 11 juin à 02h35
Extraction intelligente de documents avec Youtu-Parsing : Guide d'utilisation via interface WebUI
L'extraction de données à partir de documents complexes (PDF scannés, photos de rapports, notes manuscrites) représente souvent un défi technique majeur. Youtu-Parsing, développé par le laboratoire Tencent Youtu, s'impose comme une solution de pointe pour transformer ces images en données structurées. Ce modèle multi-modal est capable de segmen ...
Publié le 10 juin à 07h09
GLM-4v-9b : Traitement avancé des tableaux blancs pour la transcription et la modélisation des relations logiques
Le modèle GLM-4v-9b, un développement open-source de Zhipu AI datant de 2024, est un modèle multimodal vision-langage de 9 milliards de paramètres. Sa capacité distinctive réside non seulement dans sa compréhension visuelle, mais également dans son aptitude à interpréter le contenu textuel des images, offrant un support bilingue anglais-chinois ...
Publié le 7 juin à 17h47
Automatisation de l'Extraction de Données Structurées avec DocQuery et les LLM
DocQuery est un utilitaire open-source basé sur les grands modèles de langage (LLM) conçu pour l'extraction d'informations structurées à partir de documents non structurés tels que les PDF et les images numérisées. Cet outil permet d'automatiser l'analyse de documents complexes sans nécessiter de développement lourd.
Installation et Configurati ...
Publié le 7 juin à 01h45
Intégration de l'outil multimodal mPLUG-Owl3-2B pour l'extraction de données à partir d'images de documents financiers
Le traitement des documents financiers tels que les factures et les reçus représente un défi majeur pour les entreprises du secteur financier. Les méthodes manuelles traditionnelles sont chronophages et sujettes aux erreurs, entraînant une augmentation des coûts opérationnels. L'outil multimodal mPLUG-Owl3-2B offre une solution intelligente en ...
Publié le 4 juin à 05h43
Document Parsing avec Youtu-Parsing : Optimisation Continue avec Fine-tuning LoRA sur 5 Go de VRAM
Faces à des documents complexes (contrats numérisés, notes manuscrites, rapports tabulaires), l'extraction d'informations précises avec l'OCR traditionnel s'avère limitée. Ce dernier échoue souvent sur les tableaux, formules mathématiques et graphiques, nécessitant une intervention manuelle chronophage et sujette aux erreurs.
Youtu-Parsing est ...
Publié le 1 juin à 08h08