Aktuelle Berichte, Erklärungen und verbundene Technologiethemen.
GitHub hat den offenen Benchmark ReviewBench zur Bewertung von Code-Review-Agenten veröffentlicht. Er basiert auf 219 Pull Requests aus 187 Repositories und 19 Programmiersprachen und umfasst Metriken, die zwischen der Erkennung bekannter und neuer Probleme unterscheiden. Nach Angaben des Unternehmens spiegelten die Offline-Ergebnisse die Richtung der Produktionstests für Copilot Code Review wider, wobei reale Nutzertests weiterhin der endgültige Maßstab bleiben.