Sigue la cobertura, explicaciones e historias tecnológicas relacionadas.
GitHub ha lanzado el estándar abierto ReviewBench para evaluar agentes de revisión de código a partir de 219 solicitudes de incorporación de cambios de 187 repositorios y 19 lenguajes de programación, con métricas que distinguen entre la detección de problemas conocidos y nuevos. La empresa afirma que sus resultados sin conexión reflejaron la tendencia de los experimentos de producción en Copilot Code Review, aunque las pruebas reales con usuarios siguen siendo el criterio de evaluación definitivo.