Volver a Datasets

Recopilación de datos de teleoperación de robots personalizados

Ordenar datos personalizados de aprendizaje de imitación: seleccionar el robot, tareas, modalidades y escala, cobertura de teleoperatoria las 24 horas en nuestro laboratorio de San Francisco desde $500 por episodio de tarea. Obtenga una cotización en 24 horas.

Específica el robot, la lista de tareas, las modalidades y la escala recopilamos, etiquetamos, calificamos y entregamos datos de aprendizaje de imitación en el formato que espera tu pila de entrenamiento.

[Permita muestras] T0) [Obtenga cita personalizada] T1)

Confiable en la escala

10M+ Episodios entregados hasta la fecha

** 50+** Teléoperadores capacitados en el personal

ISO sistema de gestión de la calidad

7+ Realizaciones de robots en rotación

Paquetes de Datos listos para obtener licencia

Si necesita datos de aprendizaje de imitación today, comience con uno de nuestros paquetes de conjuntos de datos seleccionados. Cada paquete se limpia, etiquetado y listo para la política de difusión de OpenVLA / Octo / ajuste fino.

Pack de manipulación bimanual

20.000 episodios de doble brazo en 50 tareas de mesa. ALOHA 2 y cobertura bimanual Panda, cámaras RGB + de muñeca, con anotaciones de lenguaje.

Desde $5,000.

El paquete de movimiento humanoide

50.000 trayectorias de movimiento en el unidad G1/H1 en 30 terrenos.

Desde $10,000

Un buen paquete de agarramiento

10.000 trayectorias de agarre multi-dedo en la Mano de la Sombra y la Mano de LEAP en 200 objetos.

Desde $5,000.

Pack de evaluación de VLA

2.000 evaluaciones de ejecución en Franka y WidowX, distribuido en forma igualada a BridgeData V2 y LIBERO. Ideal para comparar un nuevo VLA sin contaminar su conjunto de tren.

Desde $3,000

Comisionar una campaña de costumbre

Cada proyecto personalizado sigue un flujo de cuatro pasos.

  1. ** Espe.** Usted comparte un resumen de tarea robot, objetos, escenas, modalidades, criterios de éxito, formato de entrega.
  2. Pilot. Recopilamos ~100 episodios contra su especificación, entrenamos una política de difusión de verificación de la salud sobre los datos piloto, y entregamos episodios crudos más un informe de validación.
  3. Escala. Una vez que el piloto sea aprobado, ejecutamos cobertura de teleoperatoria las 24 horas hasta el conteo de episodios objetivo con seguimiento continuo y entregas semanales.
  4. Delivery. El conjunto de datos final se envía en RLDS, HuggingFace, LeRobot o en un esquema personalizado con un CHANGELOG, metadatos por episodio y una configuración de entrenamiento reproducible.

Normas de calidad de los datos

Cada episodio pasa por una línea de calidad de tres etapas: filtros heurísticos automáticos (cortada de acción, abandono del sensor, longitud del episodio), revisión manual por un segundo teleoperador y una verificación final de la cordura basada en políticas. Menos del 0,5% de los episodios entregados requieren un trabajo posterior. Consulte nuestra página de servicios de datos completos (en inglés) para obtener detalles del protocolo, números de acuerdos entre raters y informes de validación de muestras.

Licencias y formatos

Usted elige el formato de entrega:

  • RLDS / TFDS. Drop-in compatible con la mezcla Open X-Embodiment y los guiones de entrenamiento Octo / OpenVLA.
  • ** Datos de HuggingFace.** Con soporte de parquet, transmitible, versionado, listo para un repo privado de HF.
  • LeRobot. El esquema de abrazo de cara LeRobot para compartir en comunidad.
  • Esquema personalizado. Su propio HDF5 / Zarr / ROS diseño de bolsa coincidimos con lo que su oleoducto existente espera.

Todos los datos recogidos a medida se le conceden exclusivamente por defecto.

Guía de precios

Task complexity Price per episode Typical use
Simple pick-and-place, 5s episodes $0.50 - $1 VLA pretraining volume
Mid-complexity manipulation, 15-30s $1 - $3 Standard imitation learning
Long-horizon, bimanual, or contact-rich $3 - $5 Production policy fine-tuning
Humanoid / dexterous, full body $5 - $15 Whole-body policy training
Novel embodiment (customer-shipped robot) $500 per task episode Bespoke R&D collection

Los descuentos de volumen se inician por encima de los 10.000 episodios. Los presupuestos completos del proyecto suelen variar desde $5,000 para un piloto hasta $5,000+ para una campaña de producción.

Logos y estudios de casos de clientes

Trabajamos con los principales laboratorios de modelos de base de robots, startups humanoides y grupos de investigación académica.

  • Recogió 120.000 episodios bimanual para una startup humanoide de Serie A en 8 semanas.
  • Entregó un paquete WidowX estilo BridgeData de 30.000 episodios para un grupo de investigación de VLA en una universidad de cinco mejores.
  • Dirigió una campaña de 6 semanas de captura hábil en una mano robótica enviada por el cliente, produciendo 8.000 episodios con anotaciones táctiles.

Empieza con datos abiertos en su lugar

¿No está seguro de que necesita una recopilación personalizada todavía? Comience con uno de los conjuntos de datos abiertos a continuación si aún necesita más cobertura después, vuelva aquí.

  • [Centro X abierto]T3) 1M+ trayectorias cruzadas de robots para el entrenamiento previo a VLA
  • BridgeData V2 60K Demo de WidowX con lenguaje
  • 76K episodios de Franka en 564 escenas
  • [LIBERO] T6) 65K demostraciones de aprendizaje permanente
  • [CALVIN]T7) Sim en el lenguaje de largo horizonte
  • [ALOHA]T8) Teléoperación bimanual en el mundo real
  • [Robomimic]T9) BC canónico referencia
  • [RoboNet] T10) Vía de predicción de robots cruzados
  • [MimicGen] T11) Augmentation de datos sintéticos

Ver el centro completo datasets hub para un directorio actualizado.

Solicite una cita

Nos contamos con una cotización fija y un plan de recopilación de datos dentro de las 24 horas.