Ultralytics YOLO-VLM
Un frontal YOLO léger alimentant une couche LLM plus profonde pour des pipelines vision-langage efficaces, annoncé sur la feuille de route d'Ultralytics. Construis dès aujourd'hui sur YOLO26 et sois prêt à connecter la vision au langage au lancement.
Recommandé par les plus grandes organisations au monde
L'impact de nos modèles
Optimise tes processus à travers les secteurs grâce à nos modèles d'IA de vision de pointe. Vitesse, précision et facilité d'utilisation propulsées par Ultralytics.
L'évolution des modèles Ultralytics YOLO
Découvre comment Ultralytics YOLO a évolué, du flux de travail pratique de YOLOv5 à l'inférence prête pour la périphérie de YOLO26.
Entraîne-toi sur les meilleurs GPU à moindre coût
26 GPU NVIDIA à partir de 0,24 $/h — d'Ampere à Blackwell. Aucune marge, aucun minimum, aucun engagement.
Explore les solutions sectorielles
Découvre comment les équipes appliquent la vision par ordinateur d'Ultralytics dans les environnements de production.

Agriculture

Automobile

Santé

Logistique

Fabrication

Commerce de détail

Robotique

Agriculture

Automobile

Santé

Logistique

Fabrication

Commerce de détail

Robotique

Agriculture

Automobile

Santé

Logistique

Fabrication

Commerce de détail

Robotique
Foire aux questions
YOLO-VLM est un prochain modèle Ultralytics annoncé sur la feuille de route officielle d'Ultralytics comme une interface visuelle YOLO légère alimentant une couche LLM plus profonde pour des pipelines vision-langage efficaces : une perception visuelle rapide connectée à un modèle de langage.
La plupart des modèles vision-langage sont grands et coûteux à exécuter en continu sur de la vidéo. En général, diviser le travail — une interface visuelle rapide alimentant une couche de langage plus profonde — maintient la perception en temps réel tout en réservant le calcul linguistique là où il ajoute de la valeur. C'est la structure de pipeline que la feuille de route d'Ultralytics décrit pour YOLO-VLM.
En général, les pipelines vision-langage permettent des descriptions de scènes en langage naturel, la réponse à des questions visuelles, la recherche à vocabulaire ouvert sur la vidéo et des alertes qui expliquent ce qui s'est passé au lieu de se contenter de le signaler. Le rôle annoncé de YOLO-VLM est d'être le frontal efficace pour des pipelines de ce type.
Ultralytics annonce le calendrier de sortie sur la feuille de route officielle, qui constitue la source faisant autorité concernant les dates de sortie. Suis la feuille de route et Ultralytics sur GitHub pour les annonces de sortie.
Commence avec Ultralytics YOLO26 pour la couche de perception en temps réel : détection, segmentation, pose et suivi. Les pipelines construits sur le flux de travail Ultralytics aujourd'hui sont positionnés pour ajouter la couche de langage lorsque YOLO-VLM sortira. Entraîne et déploie dès maintenant sur la plateforme Ultralytics.
Sois prêt pour YOLO-VLM
Construis la couche de perception avec Ultralytics YOLO26 dès aujourd'hui et connecte la vision au langage au lancement.