martedì 4 agosto 2026
botoïdes.com
FR·EN·DE·ES·IT·PT·NL·PL
La guida indipendente ai robot in casa

VLA (Vision-Language-Action)

Modello di IA che traduce immagini e linguaggio in comandi motori per un robot.

Architettura di modello di IA che unisce la comprensione visiva (immagini, flussi video), la comprensione del linguaggio naturale e la generazione di azioni motorie in un'unica rete neurale di base. Un VLA riceve in ingresso immagini provenienti dalle telecamere e istruzioni verbali, e produce in uscita comandi di movimento per un robot. CLOiD di LG ne è un esempio: addestrato su decine di migliaia di ore di dati relativi a mansioni domestiche, traduce la vista e la parola in gesti fisici.

Articoli che parlano di « VLA (Vision-Language-Action) »

Termini correlati

Se ne parla Presto

Una domanda, un disaccordo, un riscontro sul campo su questo termine? Il forum della community Botoide arriva presto.

← Tutto il glossario