JetBrains объявила о новом режиме Junie /demo в инструменте Junie CLI, предназначенном для автоматизации интерактивной части проверки программных изменений. Вместо того чтобы ограничиваться запуском тестов, разработчик может описать требуемый сценарий, после чего Junie соберёт и запустит приложение, взаимодействует с его интерфейсом, а затем создаст HTML-отчёт с результатом, снимками экрана и видео выполнения.
Как работает новый режим?
Junie анализирует проект и предлагает план сборки и запуска, а затем после одобрения пользователя создаёт файлы конфигурации. Перед вводом запроса, определяющего действия и ожидаемые результаты, можно выбрать изменения из ветки, сессии, рабочего дерева или последнего commit. В примере, представленном JetBrains, агент выбирает две задачи в инструменте отслеживания задач, меняет их состояние на Done, проверяет изменение счётчиков, а затем перезагружает страницу, чтобы убедиться, что результат сохранился.
Пользователь может в реальном времени следить за выполнением, пока агент перемещается по интерфейсу. Видео включает вводные слайды для каждого сценария и заключительный слайд с результатами, а также пояснительные субтитры, которые можно включать и отключать. JetBrains поясняет, что после записи модель анализирует снимки экрана для подготовки этих слайдов, тогда как голосовое сопровождение может быть добавлено в одном из следующих обновлений.
От ручной демонстрации к проверке с возможностью аудита
HTML-отчёт объединяет исходный запрос, результат, видео, снимки экрана и выполненные шаги, указывая, какие тесты пройдены, не пройдены или остались незавершёнными. Благодаря этому результаты может проверить разработчик, инженер по обеспечению качества или член команды, которому нужно увидеть поведение функции, а не только прочитать программное изменение.
По мнению certi.news, практическая ценность здесь заключается не в замене автоматизированных тестов, а в добавлении визуального подтверждения поведения интерфейса. Оценка готовности изменения по-прежнему остаётся ответственностью проверяющего; завершение работы агента автоматически не означает успешного прохождения проверки. Поэтому в примерах JetBrains Junie должен выдать явный verdict, а результат передаётся только при написании PASS, тогда как такие значения, как FAIL и PARTIAL, или отсутствие результата приводят к провалу проверки результата.
Интеграция с GitHub Actions и стоимость
JetBrains использовала этот режим внутри компании с GitHub Actions более чем для 1 500 уникальных запросов на слияние и создала более 2 100 демонстрационных видео. Кроме того, режим применялся в 22 сценариях smoke-тестов для веток релизов, всего было проведено более 1 300 внутренних тестов. Компания предоставляет два примера YAML-файлов, которые можно адаптировать: один предназначен для проверки изменений, заслуживающих демонстрации, и добавления ссылок на доказательства в запрос на слияние, а другой — для тестов релизов, запускаемых при push или вручную.
В примерах используются GitHub Artifacts, поэтому отдельный сервис для размещения видео не требуется. JetBrains сообщает, что запуск 22 случаев во время внутреннего измерения стоил 19,94 доллара при использовании GPT-5.6 SOL согласно применяемому ею пересчёту подписки, без учёта стоимости среды выполнения CI. Это внутренние показатели, на которые влияют приложение, шаги сборки и формулировка запросов; они не являются общей оценкой для каждого проекта.
Среда и операционные ограничения
Режим работает внутри контейнера Docker на основе Debian Bookworm, в который входят Chromium, Node.js, Xvfb, оконный менеджер и такие инструменты, как xdotool и ffmpeg. Он использует модель с поддержкой Computer Use для управления щелчками, клавиатурой и снимками экрана. Сложные репозитории могут определять несколько шаблонов виртуальных машин с отдельными настройками для сервисов и интерфейсов.
Запуск невозможен без поддерживаемой модели. Junie использует активную модель, если она доступна и поддерживает Computer Use; в противном случае выбирает модель из списка, включающего GPT-5.6 SOL и GPT-6 Astra, затем GPT-5.5 и GPT-5.4, с настройкой High reasoning effort в режиме /demo. Выполнение также занимает несколько минут, а наибольшая польза режима заключается в переносе повторяющейся интерактивной проверки в проверяемый процесс, а не в гарантии корректности результата без участия человека.