VLA (Vision-Language-Action)
Modello di IA che traduce immagini e linguaggio in comandi motori per un robot.
Architettura di modello di IA che unisce la comprensione visiva (immagini, flussi video), la comprensione del linguaggio naturale e la generazione di azioni motorie in un'unica rete neurale di base. Un VLA riceve in ingresso immagini provenienti dalle telecamere e istruzioni verbali, e produce in uscita comandi di movimento per un robot. CLOiD di LG ne è un esempio: addestrato su decine di migliaia di ore di dati relativi a mansioni domestiche, traduce la vista e la parola in gesti fisici.
Articoli che parlano di « VLA (Vision-Language-Action) »
Termini correlati
Se ne parla Presto
Una domanda, un disaccordo, un riscontro sul campo su questo termine? Il forum della community Botoide arriva presto.
