NVIDIA LocateAnything-3B : jusqu'à 2,5× plus rapide en localisation visuelle, sous licence recherche
NVIDIA Research a publié le 26 mai 2026 « LocateAnything » (modèle LocateAnything-3B), un modèle vision-langage qui localise les objets d'une image en prédisant chaque boîte englobante d'un seul coup - le « Parallel Box Decoding » - au lieu de générer ses coordonnées une par une, pour un décodage jusqu'à 2,5× plus rapide sans perdre en précision, sous licence de recherche non commerciale.