Компания Inherent — лондонская лаборатория искусственного интеллекта, основанная бывшими сотрудниками Google DeepMind, — заявила, что её новый агент Faraday превзошёл более крупные модели Anthropic и OpenAI в задаче воспроизведения результатов опубликованных научных работ, не получая заранее готового ответа.
Faraday появился всего через несколько недель после выхода Inherent из режима скрытности, одновременно с объявлением компанией о начальном раунде финансирования на сумму 50 миллионов долларов. Компания утверждает, что агент сравнивался с Claude Opus 4.8 от Anthropic и GPT-5.5 от OpenAI — двумя системами, которые в материале описываются как более крупные и относящиеся к категории передовых моделей.
Тест, выходящий за рамки сопоставления результатов
По словам сооснователя и главного научного сотрудника Edward Hughes, Inherent измеряла не только способность Faraday воспроизводить результаты. Компания также хотела проверить то, что называет «исследовательским чутьём», — способность оценивать, какие эксперименты заслуживают проведения, и правильно их разрабатывать. Компания считает воспроизведение результатов опубликованного исследования распространённой практической подготовкой для учёных: многие аспиранты начинают именно с этой задачи.
Согласно материалу, Faraday работает на модели Qwen 3.6, включающей всего 27 миллиардов параметров, тогда как в сравнении использовались значительно более крупные модели. Количество параметров обычно служит приблизительным показателем размера модели и затрат на её обучение, однако само по себе это число недостаточно для доказательства превосходства одной системы над другой, особенно без полной информации о тесте, его данных или методике подсчёта результатов.
Обучение с подкреплением вместо навязывания исследовательских шагов
Inherent в значительной степени полагается на обучение с подкреплением: система получает вознаграждение за хорошие результаты, вместо того чтобы ей предоставляли набор подробных правил проведения научного исследования. Компания рассчитывает, что такой подход поможет её агентам обобщать знания в разных научных областях, а не ограничиваться имитацией ранее изученных методов исследования.
Компания заявляет, что её долгосрочная цель — создать агента, который работает как учёный в области искусственного интеллекта и участвует в открытии новых знаний, а не просто проверяет известные результаты. Поэтому она не разрабатывала собственный инструмент программирования, а сделала так, чтобы Faraday использовал GPT-5.5 Codex, имитируя зависимость исследователей от существующего программного обеспечения вместо создания каждого инструмента с нуля.
Почему эта новость важна?
Если результаты теста подтвердятся в рамках воспроизводимой методологии, это может указывать на то, что специализированные агенты способны демонстрировать высокую производительность с использованием меньших моделей, если их поддерживают подходящее обучение и возможности выбора и оценки экспериментов. Это смещает акцент с одного лишь размера модели на конструкцию агента, способ его вознаграждения и рабочую среду, в которой он действует.
Однако источник передаёт заявление компании и не предоставляет достаточных подробностей для независимой оценки сравнения, а также не уточняет охват научных работ или области, включённые в тест. Поэтому значение «превосходства» пока определяется конкретным тестом и ещё не доказывает способность Faraday открывать новые знания или эффективно работать во всех дисциплинах.
В Inherent работают около 12 сотрудников, которые присутствуют в её офисе в районе King’s Cross в Лондоне; к концу года компания планирует увеличить штат примерно до 20 или 25 человек. Кроме того, Hughes лично говорил о влиянии ограничений, связанных с «обязательным отпуском» в Великобритании, на переход сотрудников в конкурирующие компании, что может повлиять на способность лаборатории привлекать исследователей из DeepMind и других организаций.