Guide complet sur les pyramides d'images avec opencv4nodejs pour l'extraction de caractéristiques multi-échelles
Introduction aux Pyramides d'Images
Les pyramides d'images sont une technique fondamentale en vision par ordinateur pour l'analyse multi-échelles. Elles permettent de construire une série d'images à des résolutions dégressives, facilitant l'extraction de caractéristiques pertinentes à différentes échelles. Cet article explore comment utiliser l ...
Publié le 26 juillet à 01h08
Restauration des Couleurs dans le Traitement d'Images: Techniques et Implémentations
Vous avez déjà remarqué que vos photos de nourriture sous l'éclairage d'un restaurant prennent une teinte jaunâtre, que vos paysages par temps nuageux semblent terne, ou que la couleur d'un vêtement en ligne apparaît différente à la réception ? Ces problèmes sont dus aux distorsions colorimétriques ! La restauration des couleurs vise à corriger ...
Publié le 22 juillet à 18h15
Capture d'écran complète d'une page web avec Python en cinq étapes
Cette méthode permet de générer une capture d'écran longue d'une page web en utilisant Python, PyQt5 pour l'affichage et le défilement, et PIL pour le traitement d'images. Elle s'articule autour de cinq phases distinctes.
Étape 1 : Configuration de l'interface et chargement de la page
On crée une fenêtre sans cadre avec PyQt5, on y intègre un n ...
Publié le 20 juillet à 16h47
Manipulation d'images avec Apache Commons Imaging
Présentation de la bibliothèque
Apache Commons Imaging est une bibliothèque Java open source pour le traitement d'images. Anciennement nommée Sanselan, elle permet la lecture et l'écriture dans divers formats graphiques. Ses fonctionnalités incluent l'extraction de métadonnées (EXIF, IPTC), la conversion entre formats, et l'analyse des propriét ...
Publié le 18 juillet à 07h52
De Qwen2-VL à Qwen3-VL-WEBUI | Guide pratique du modèle de langage visuel amélioré
De Qwen2-VL à Qwen3-VL-WEBUI | Guide pratique du modèle de langage visuel amélioré
1. Introduction : Pourquoi passer à Qwen3-VL-WEBUI ?
Avec l'adoption croissante des modèles multimodaux dans des scénarios tels que la compréhension texte-image, les agents visuels et le raisonnement vidéo, les exigences en matière de capacités des modèles ne ces ...
Publié le 10 juillet à 21h41
Techniques de Vision Stéréoscopique : De l'Optimisation de la Parallaxe au Matching de Points 3D
La vision stéréoscopique est une méthode fondamentale en vision par ordinateur et en robotique pour acquérir des informations de profondeur et reconstruire la structure tridimensionnelle des scènes. Cet article explore en détail plusieurs techniques clés, notamment l'affinement du pic de parallaxe, le nettoyage et la reconstruction d'images, l' ...
Publié le 28 juin à 00h40
Reconnaissance de CAPTCHA simples avec l'algorithme KNN
KNN (K plus proches voisins)
L'algorithme KNN est une méthode d'apprentissage supervisé simple qui peut être utilisée pour la classification de données. Dans le contexte de la reconnaissance de CAPTCHA, il permet d'identifier les caractères présents dans une image après un prétraitement approprié.
Paramètres de l'implémentation sklearnLa classe ...
Publié le 25 juin à 20h41
STEP3-VL-10B: Déploiement d'un modèle multimodal léger avec support d'images, OCR et compréhension spatiale
STEP3-VL-10B: Déploiement d'un modèle multimodal léger avec support d'images, OCR et compréhension spatiale
Vous êtes-vous déjà retrouvé dans des situations où vous deviez faire comprendre une image à une IA, comme identifier des données tabulaires, analyser des graphiques ou interpréter des schémas complexes ? Les modèles textuels traditionnel ...
Publié le 19 juin à 03h32
Retours d'Expérience en Vision Industrielle avec Halcon
Pourquoi opter pour Halcon ?
Trois avantages majeurs motivent le choix de ce logiciel pour la vision industrielle :
Bibliothèque d'algorithmes étendue : Plus de 1500 opérateurs dédiés au positionnement, à la métrologie, à la reconnaissance et au contrôle de défauts.
Précision industrielle : Traitement au niveau sous-pixel garantissant une stab ...
Publié le 17 juin à 20h50
Développement d'une application GUI de reconnaissance de chiffres manuscrits avec PyTorch
Aperçu du projet
Installation des bibliothèques nécessaires
Conception de l'interface graphique
Chargement du modèle et prédiction
Flux de prétraitement d'image
Analyse du code complet
Démonstration des résultats
Aperçu du projet
Cet projet met en œuvre une application de reconnaissance de chiffres manuscrits basée sur PyTorc ...
Publié le 17 juin à 06h17