Hasta ahora había que entrenar a un robot para cada tarea nueva. La nueva idea es mucho más simple: que te mire unos segundos
La firma de robótica e inteligencia artificial Generalist AI ha presentado un modelo llamado GEN-1.5 capaz de intentar una nueva tarea tras observar una única demostración de entre tres y 12 segundos.
Lo llaman " physical prompting ": hacer con los robots algo parecido a lo que hacemos con los LLM cuando les ponemos un ejemplo en el prompt.
Bastan apenas 10 segundos .
La idea detrás de GEN-1.5, el nuevo modelo robótico de Generalist AI, es la de enseñarle algo al modelo robótico en lugar de "programárselo".
Si le pedimos hacer algo nuevo para él, el robot observa una demostración física de entre 3 y 12 segundos y después intenta reproducirla.
Por ejemplo, abrir un bote, bajar una cremallera o sacar un billete de una cartera.
No hay por tanto que crear un nuevo conjunto de datos de entrenamiento ni hacer ajuste fino ( fine tuning ).
Destreza robótica: por qué los robots pueden hacer cálculos complejos pero no pelar un cable Un prompt basado en el movimiento .
Un modelo de IA generativa de texto puede tratar de resolver una tarea desconocida si le damos un prompt adecuado con uno o varios ejemplos que muestran cómo queremos que la resuelva.
Aquí el prompt no son palabras, sino un vídeo con los movimientos que queremos que el robot aprenda .
El modelo observa el estado inicial, cómo se manipula un objeto y eso sirve como contexto para deducir qué tiene que hacer.
El mundo físico se convierte así en el conjunto de datos de aprendizaje.
Hay experimentos llamativos .
La empresa mostraba cómo puede concatenar dos demostraciones distintas para que el robot complete por sí mismo los movimientos que faltan entre ambas.
5News agregó este resumen a partir del feed público del medio. La nota completa, con todo el contexto, está en www.xataka.com — el contenido pertenece a Xataka.