Ultralytics YOLO-VLM
Un front-end YOLO leggero che alimenta un livello LLM più profondo per pipeline efficienti di visione-linguaggio, annunciato sulla roadmap di Ultralytics. Inizia a costruire su YOLO26 oggi stesso e preparati a connettere la visione al linguaggio al momento del lancio.
Scelto dalle organizzazioni leader nel mondo
L'impatto dei nostri modelli
Ottimizza i processi in tutti i settori con i nostri modelli di IA di visione all'avanguardia. Velocità, precisione e semplicità d'uso offerte da Ultralytics.
L'evoluzione dei modelli Ultralytics YOLO
Scopri come Ultralytics YOLO si è evoluto dal pratico flusso di lavoro di YOLOv5 all'inferenza edge-ready di YOLO26.
Allena sulle migliori GPU spendendo meno
26 GPU NVIDIA a partire da 0,24 $/ora, da Ampere a Blackwell. Nessun ricarico, nessun minimo, nessun impegno.
Esplora le soluzioni per settore
Scopri come i team applicano la visione artificiale di Ultralytics negli ambienti di produzione.

Agricoltura

Settore automobilistico

Sanità

Logistica

Manifattura

Vendita al dettaglio

Robotica

Agricoltura

Settore automobilistico

Sanità

Logistica

Manifattura

Vendita al dettaglio

Robotica

Agricoltura

Settore automobilistico

Sanità

Logistica

Manifattura

Vendita al dettaglio

Robotica
Domande frequenti
YOLO-VLM è un prossimo modello di Ultralytics annunciato sulla roadmap di Ultralytics ufficiale come front-end YOLO leggero che alimenta un livello LLM più profondo per pipeline efficienti di visione-linguaggio: percezione visiva rapida collegata a un modello linguistico.
La maggior parte dei modelli di visione-linguaggio sono grandi e costosi da eseguire continuamente su video. In generale, suddividere il lavoro — un front-end di visione rapido che alimenta un livello linguistico più profondo — mantiene la percezione in tempo reale riservando il calcolo linguistico a dove aggiunge valore. Questa è la forma della pipeline che la roadmap di Ultralytics descrive per YOLO-VLM.
In generale, le pipeline di visione-linguaggio abilitano descrizioni di scene in linguaggio naturale, risposte a domande visive, ricerca a vocabolario aperto sui video e avvisi che spiegano cosa è successo invece di limitarsi a segnalarlo. Il ruolo annunciato di YOLO-VLM è il front-end efficiente per pipeline come queste.
Ultralytics annuncia i tempi di rilascio sulla roadmap ufficiale, che costituisce la fonte autorevole per sapere cosa viene rilasciato e quando. Segui la roadmap e Ultralytics su GitHub per gli annunci di rilascio.
Inizia con Ultralytics YOLO26 per il livello di percezione in tempo reale: rilevamento, segmentazione, posa e tracciamento. Le pipeline costruite sul flusso di lavoro di Ultralytics oggi sono posizionate per aggiungere il livello linguistico quando YOLO-VLM verrà rilasciato. Allena e distribuisci ora su Ultralytics Platform.
Preparati per YOLO-VLM
Costruisci il livello di percezione con Ultralytics YOLO26 oggi stesso e connetti la visione al linguaggio al momento del lancio.