Micro1, especializada en proporcionar datos para entrenar sistemas de inteligencia artificial, elevó su tasa anualizada de ingresos brutos de 100 millones a 500 millones de dólares durante los últimos ocho meses, según una persona familiarizada con las operaciones de la empresa que habló con TechCrunch. Este crecimiento refleja la expansión de la demanda de datos únicos que los laboratorios de inteligencia artificial y las grandes empresas necesitan para entrenar modelos y evaluar sus resultados.
Micro1, fundada hace cuatro años, opera de manera similar a empresas competidoras que contratan a médicos, abogados, científicos y expertos en otros campos bajo contratos para realizar tareas relacionadas con los datos. Según la misma fuente, la empresa conserva entre el 60% y el 70% de su tasa anualizada de ingresos brutos, lo que sitúa su tasa anualizada de ingresos netos estimada entre 150 millones y 200 millones de dólares.
Un mercado con espacio para más de un actor
Aunque Micro1 sigue siendo más pequeña que competidores como Mercor, que alcanzó los 2.000 millones de dólares en ingresos brutos anualizados este verano, y Handshake, que llegó a 1.000 millones de dólares a principios de año, su ritmo de crecimiento indica que existe suficiente demanda para sostener a varias empresas dedicadas al suministro de datos para entrenar sistemas de inteligencia artificial.
Algunos investigadores creen que el gasto futuro en datos podría acercarse al gasto en capacidad computacional, mientras la empresa registra un aumento en el tamaño de los contratos y prevé que sus márgenes mejoren con el tiempo.
Del etiquetado humano a los datos sintéticos
Micro1 busca reducir la dependencia del trabajo humano en algunas tareas mediante la producción de datos sintéticos, como la generación automática de descripciones del contenido de vídeo. Algunos de los conjuntos de datos que produce también pueden venderse a más de un cliente, lo que eleva los márgenes brutos de sus datos listos para usar hasta entre el 80% y el 90%, según una persona familiarizada con las finanzas de la empresa.
En la práctica, esto significa que el crecimiento de las empresas de datos para inteligencia artificial no depende únicamente de aumentar el número de expertos que participan en el etiquetado y la evaluación, sino también de convertir los datos en productos reutilizables, lo que podría reducir el coste de proporcionarlos y aumentar el rendimiento de cada conjunto de datos.
Debate sobre la venta de datos a más de un cliente
La reventa de conjuntos de datos a múltiples clientes ha generado polémica recientemente, ya que los críticos consideran que proporcionar datos listos para usar a desarrolladores de modelos de inteligencia artificial en China podría ayudar a sus modelos a acercarse al nivel de los principales modelos estadounidenses.
Ali Ansari, fundador de Micro1, afirmó en una publicación en la plataforma X el mes pasado que su empresa, a diferencia de algunos de sus competidores, no vende sus datos a desarrolladores de modelos chinos. Micro1 no respondió a la solicitud de comentarios de TechCrunch.
Expansión hacia la evaluación de modelos y la robótica
Micro1 comenzó como una startup de contratación basada en inteligencia artificial, antes de pasar al negocio del etiquetado de datos después de que Ansari observara que sus clientes utilizaban la plataforma para evaluar y contratar ingenieros para trabajos de anotación y etiquetado.
La empresa también trabaja en lo que describe como centros de entrenamiento por refuerzo, donde sus expertos evalúan los resultados de los modelos, además de crear un conjunto de datos para el preentrenamiento de robots mediante la tarea de cientos de personas de registrar interacciones cotidianas con objetos en sus hogares.
Micro1 recaudó una ronda Serie A en septiembre del año pasado con una valoración de 500 millones de dólares, y TechCrunch entiende que la empresa podría haber recaudado recientemente otra ronda con una valoración muy superior, aunque no existe confirmación pública de esta ronda.