Vision par ordinateur (Computer vision)
La vision par ordinateur est une branche de l’IA qui donne aux machines la capacité de percevoir, analyser et interpréter des images ou des vidéos, à l’aide de caméras et de traitement de signal numérique — l’équivalent, en IA, des yeux humains et de la capacité du cerveau à traiter ce qu’ils perçoivent. Elle repose principalement sur le deep learning et les réseaux convolutifs (CNN), qui décomposent une image en pixels et leur attribuent des étiquettes pour en extraire des motifs reconnaissables.
Trois processus structurent le domaine : la reconnaissance (identifier objets, personnes, lieux ou textes dans une image), la reconstruction (reconstituer une scène en 3D à partir d’images 2D) et la réorganisation (structurer l’information visuelle extraite). Sensibilité (capacité à distinguer des formes en conditions difficiles) et résolution (finesse de distinction entre objets) sont les deux caractéristiques techniques qui déterminent la qualité d’un système de vision.
En RH, la vision par ordinateur intervient dans des usages ciblés : extraction automatique d’informations depuis un CV scanné ou une pièce d’identité, contrôle d’accès par badge photo, ou vérification de conformité d’équipements de protection individuelle en environnement industriel. Point commun avec la reconnaissance faciale : ces deux technologies partagent le même socle technique, mais la reconnaissance faciale relève spécifiquement de l’identification de personnes — usage strictement encadré par le RGPD et l’AI Act en contexte professionnel.
Retrouvez tous les termes dans le lexique SIRH et IA de yapluqua.com.
Sources : IBM (02/02/2026), CNIL.