프로그래밍 및 소프트웨어 개발

JetBrains, 코드 변경 사항의 대화형 데모를 녹화하는 모드 Junie 추가

JetBrains가 Junie CLI 도구에 Junie /demo 모드를 도입했습니다. 이 모드에서 에이전트는 애플리케이션을 실행하고 인터페이스와 상호작용하며, 변경 사항의 동작을 검증하기 위한 동영상, 스크린샷, HTML 보고서를 기록할 수 있습니다. 또한 GitHub Actions와 통합되어 CI에서 병합 요청 검토와 smoke 테스트에 사용할 수 있습니다.

2026-09-18
3 분 읽기
6 조회수
فريق تحرير certi.news
JetBrains, 코드 변경 사항의 대화형 데모를 녹화하는 모드 Junie 추가

JetBrains는 Junie CLI 도구에 새로운 Junie /demo 모드를 발표했습니다. 이 모드는 코드 변경 사항을 대화형으로 검증하는 과정을 자동화하는 것을 목표로 합니다. 테스트를 실행하는 데 그치지 않고, 개발자가 원하는 시나리오를 설명하면 Junie가 애플리케이션을 빌드하고 실행한 뒤 인터페이스와 상호작용하고, 결과와 스크린샷 및 실행 동영상이 포함된 HTML 보고서를 생성합니다.

새 모드는 어떻게 작동하는가?

Junie는 프로젝트를 분석하고 빌드 및 실행 계획을 제안한 다음, 사용자의 승인을 받은 뒤 설정 파일을 생성합니다. 변경 사항은 브랜치, 세션, 작업 트리 또는 마지막 commit에서 선택할 수 있으며, 그 전에 수행할 작업과 예상 결과를 지정하는 요청을 입력합니다. JetBrains가 제시한 예시에서 에이전트는 작업 추적 도구에서 두 개의 이슈를 선택하고, 상태를 Done으로 변경하며, 카운터가 바뀌었는지 확인한 다음 페이지를 다시 로드해 결과가 유지되는지 확인합니다.

사용자는 에이전트가 인터페이스를 탐색하는 동안 실행 과정을 실시간으로 확인할 수 있습니다. 동영상에는 각 시나리오를 위한 도입 슬라이드와 결과를 위한 마지막 슬라이드가 포함되며, 켜거나 끌 수 있는 설명 자막도 제공됩니다. JetBrains는 녹화 후 모델이 스크린샷을 분석해 이러한 슬라이드를 준비한다고 설명하며, 음성 해설은 이후 업데이트에서 추가될 수 있습니다.

수동 데모에서 감사 가능한 검토로

HTML 보고서는 원래 요청, 결과, 동영상, 스크린샷 및 실행된 단계를 한데 모으고, 성공했거나 실패했거나 완료되지 않은 테스트를 명시합니다. 따라서 개발자, 품질 보증 엔지니어 또는 코드 변경 사항만 읽는 대신 기능의 동작을 확인하려는 팀원이 결과물을 검토할 수 있습니다.

certi.news는 여기서 실질적인 가치는 자동화된 테스트를 대체하는 것이 아니라 인터페이스 동작에 대한 시각적 증거를 추가하는 데 있다고 봅니다. 변경 사항이 준비되었는지 판단하는 책임은 여전히 검토자에게 있으며, 에이전트 실행이 완료되었다고 해서 검사가 자동으로 성공하는 것은 아닙니다. 이러한 이유로 JetBrains의 예시는 Junie에 명시적인 verdict를 출력하도록 요구하며, PASS가 작성된 경우에만 결과를 통과시킵니다. 반면 FAIL, PARTIAL 또는 결과 누락과 같은 값은 결과 검사를 실패하게 합니다.

GitHub Actions 통합과 비용

JetBrains는 GitHub Actions와 함께 이 모드를 내부적으로 1,500건이 넘는 고유 병합 요청에 사용했으며, 2,100개가 넘는 데모 동영상을 생성했습니다. 또한 릴리스 브랜치의 smoke 테스트를 위한 22개 시나리오에 사용했고, 내부 테스트는 총 1,300건을 넘었습니다. 회사는 조정해 사용할 수 있는 YAML 파일 예시 두 가지를 제공합니다. 하나는 데모할 가치가 있는 변경 사항을 검사하고 증거 링크를 병합 요청에 추가하며, 다른 하나는 push 또는 수동 실행 시 시작되는 릴리스 테스트용입니다.

예시는 GitHub Artifacts를 사용하므로 동영상을 호스팅하기 위한 별도 서비스가 필요하지 않습니다. JetBrains는 내부 측정에서 22개 사례를 실행하는 데 자사가 사용한 구독 전환 기준으로 GPT-5.6 SOL을 사용했을 때 19.94달러가 들었으며, CI 실행 환경 비용은 별도라고 설명합니다. 이는 애플리케이션, 빌드 단계 및 요청 작성 방식의 영향을 받는 내부 수치이며, 모든 프로젝트에 적용되는 일반적인 추정치가 아닙니다.

환경과 운영상의 제약

이 모드는 Debian Bookworm을 기반으로 빌드된 Docker 컨테이너에서 작동하며, Chromium, Node.js, Xvfb, 윈도 관리자와 xdotool 및 ffmpeg 같은 도구를 포함합니다. 클릭, 키보드 입력 및 스크린샷을 제어하기 위해 Computer Use를 지원하는 모델을 사용합니다. 복잡한 저장소는 여러 가상 머신 템플릿을 정의할 수 있으며, 서비스와 인터페이스에 대해 별도의 설정을 사용할 수 있습니다.

지원되는 모델이 없으면 실행이 시작되지 않습니다. Junie는 사용 가능한 활성 모델이 Computer Use를 지원하면 해당 모델을 사용하고, 그렇지 않으면 GPT-5.6 SOL, GPT-6 Astra, GPT-5.5, 이어서 GPT-5.4가 포함된 목록에서 선택하며, /demo 모드에서는 High reasoning effort로 설정됩니다. 또한 실행에는 수분이 걸리며, 가장 큰 이점은 인간의 검토 없이 결과의 정확성을 보장하는 데 있는 것이 아니라 반복적인 대화형 검증을 검토 가능한 흐름으로 옮기는 데 있습니다.

뉴스 출처
JetBrains Blog
원문 보기 ↗
ف
작성자

فريق تحرير certi.news

같은 카테고리

추천 기사

모든 뉴스 보기