OpenAI anunció el 7 de septiembre de 2026 que había alcanzado el objetivo que se había fijado de llegar al nivel de «becario de investigación automatizada» para septiembre del mismo año. Esta descripción, según la definición de la empresa, se refiere a un sistema capaz de ejecutar tareas de investigación bien definidas bajo dirección humana y completar trabajos que a un investigador cualificado podrían llevarle varios días.
Alcanzar este nivel no significa que el sistema se haya convertido en un investigador independiente. Los seres humanos siguen siendo responsables de establecer las prioridades de investigación, seleccionar las ideas que merecen seguimiento y tomar decisiones sobre ampliar los sistemas o detenerlos. OpenAI había presentado esta trayectoria en dos etapas en octubre de 2025, mientras que su próximo objetivo consiste en alcanzar el nivel de «investigador de inteligencia artificial automatizada» para marzo de 2028.
Los agentes de programación pasan al centro del trabajo de investigación
Los datos compartidos por OpenAI revelan una rápida transformación en la forma de trabajar de sus equipos de investigación. A comienzos de 2026, el uso de agentes de programación por parte de los investigadores era relativamente limitado, pero a mediados de agosto el investigador promedio ya utilizaba estos sistemas regularmente como parte de su flujo de trabajo diario.
La empresa estima que el coste diario de inferencia de los agentes utilizados por el investigador promedio supera los 600 dólares cuando se calcula según los precios de la interfaz de programación de aplicaciones. El tiempo total de ejecución de los agentes también aumentó desde un nivel inferior al tiempo de trabajo humano antes de junio de 2026 hasta aproximadamente 3,1 días laborables del agente por cada día laborable humano dentro de la organización de investigación a mediados de agosto.
Los investigadores ejecutan varios agentes al mismo tiempo, mientras que estos sistemas han empezado a realizar tareas que incluyen resolver problemas de infraestructura de investigación, escribir código, analizar experimentos y ofrecer apoyo técnico. OpenAI afirma que este uso ayudó a los investigadores a producir código con mayor rapidez y a realizar un mayor número de experimentos. En agosto de 2026, el promedio de experimentos por investigador activo alcanzó su nivel más alto desde el inicio de las mediciones en enero de 2025, algo que la empresa relaciona con el aumento del uso de Codex y con una mayor capacidad computacional disponible.
¿Qué cambió en la práctica?
Los agentes ya no se limitan a escribir código de investigación y de infraestructura, sino que su función se ha ampliado para incluir apoyo técnico, supervisión de experimentos y tareas que se prolongan durante periodos más largos. Sin embargo, esta expansión no equivale a una autonomía completa. Durante los últimos seis meses, más de la mitad de las tareas que duraron entre cuatro y ocho horas requirieron al menos una intervención humana.
Por tanto, el «becario de investigación» que describe OpenAI es un asistente avanzado que trabaja dentro de un ámbito definido por el investigador, no un sistema que crea una agenda de investigación independiente o decide por sí solo qué ideas deben desarrollarse.
El siguiente paso y las cuestiones de control
OpenAI vincula su objetivo más ambicioso con la idea de una automatización cada vez mayor de la investigación en inteligencia artificial, hasta llegar a que los sistemas ayuden a desarrollar nuevos sistemas y aceleren la investigación sobre seguridad y alineación. La empresa señala posibles usos como desarrollar medios de defensa contra agentes de inteligencia artificial peligrosos y proteger infraestructuras sensibles.
Sin embargo, la empresa no considera inevitable alcanzar rápidamente una auto-mejora iterativa a gran escala, o RSI. Afirma que continuar avanzando en esta dirección dependerá de la capacidad de los seres humanos para mantener el control y de que los procedimientos de seguridad evolucionen en paralelo con las capacidades de los modelos. Este punto sigue siendo la principal limitación del anuncio: las cifras presentadas describen la experiencia interna de OpenAI y, por sí solas, no demuestran que la automatización vaya a expandirse al mismo ritmo fuera de su entorno o sin intervención humana.