Toutes les news taguées avec ce sujet.
Une méthode sans entraînement pour générer de nouvelles vues dans les scènes avec miroirs en exploitant le contenu réfléchi.
Un ResEnc U-Net conditionné par des scribbles améliore la segmentation lésions sur des données PET/CT multisites.
Une équipe a poussé des Nikon d'entrée de gamme à leurs limites et entraîné un réseau de neurones pour automatiser le nettoyage de 526 000 scans.
Une méthode hybride combine DWT et AlexNet pour améliorer la classification des images de texture.
GeoNeXt réutilise des modèles vidéo pré-entraînés pour estimer profondeur et normales de surface, avec bien moins de données que les approches concurrentes.
Une technologie de smartphone exploite la LED et l'IA pour repérer les optiques cachées.
Un chercheur explore comment des modèles de vision par ordinateur pourraient détecter les faux produits cosmétiques.
Étude de la préservation des propriétés physiologiques lors de la conversion PPG vers rPPG via CHROM.
LeVJEPA simplifie l'encodage vidéo self-supervisé en éliminant les asymétries architecturales complexes, offrant une meilleure efficacité calculatoire.
Une architecture MoE reliant des experts robustes par mode connectivity pour améliorer la défense contre les attaques adversariales multi-normes.
Une méthode pour auditer les réseaux de neurones en isolant les concepts réellement utilisés par le modèle.
Un nouveau benchmark et un moteur de raisonnement allient vidéo, pose et sEMG pour un coaching sportif expert.
Une méthode d'analyse d'images développée par Google mesurerait des indicateurs de composition corporelle à partir de simples photos.
DeepSeek dévoile DeepSeek-OCR, un nouveau modèle de reconnaissance optique de caractères.
Roboflow affirme que GPT-5.6 Sol surpasse tous les modèles vision précédents d'OpenAI sur ses tests de perception visuelle.
Un framework d'IA modélise l'incertitude pour déterminer le sexe des auteurs de stencils préhistoriques.
Une nouvelle technique convertit des données tabulaires en images en préservant les relations entre variables, avec des performances supérieures aux méthodes existantes.
OpenCV ouvre les inscriptions pour sa compétition annuelle dédiée aux projets d'IA et de vision par ordinateur.
Une revue méthodologique évalue les techniques CAM pour CNNs, Transformers et modèles de fondation.
Cette bibliothèque synchronise les transformations sur images et annotations pour éviter les désalignements.
Une méthode distingue possession stérile et création d'espace via l'analyse vidéo et les menaces attendues.
Un nouveau framework exploitant la sémantique et la géométrie pour corriger les reflets dans les vidéos.
Un nouveau cadre hybride allant efficacité et protection de la vie privée pour analyser les vidéos de classe.
Intégration des technologies de vision par ordinateur et de reconnaissance d'objets dans les dispositifs d'optique grand public.