Publicado:
Estamos construyendo un conjunto de datos de Visión-Lenguaje-Acción (VLA) para entrenar la próxima generación de robots humanoides. Tu rol será grabar videos cortos en primera persona de actividades cotidianas del hogar usando tu iPhone (1080p, vista montada en la cabeza).
Cada clip (1–2 minutos) debe mostrar a una persona realizando naturalmente una tarea, por ejemplo: doblar ropa, cargar los platos, limpiar una mesa o verter agua, desde una perspectiva en primera persona consistente.
Responsabilidades
Requisitos
Deseable
Detalles del proyecto
Ejemplos de tareas
En Hidden Force buscamos a la persona que lidere la escalada de nuestra unidad de Headhunting y Consultoría Organizacional, conectando estrategia comercial, marketing...
Ubicación: Remoto Empresa: Fruitful Light Dedicación: 10 a 15 horas semanales (horario flexible) Acerca de Fruitful Light Fruitful Light está desarrollando tecnología que...
Acerca de la empresa En Ready Talent no hacemos reclutamiento tradicional ni simplemente buscamos currículums. Somos un socio global de Managed Services diseñado...
Skylight es una startup tecnológica que está construyendo el sistema operativo para las familias. Creamos Skylight Calendar, el calendario inteligente preferido por millones...