JetBrains, 맥 로컬 구동 코딩 에이전트 'Junie Local' 공개

3분 JetBrainsJunieQwen3.6로컬 AI
최근 30일 조회수 — 좋아요 —

핵심 요약

JetBrains가 M5 맥에서 무료·오프라인으로 돌아가는 코딩 에이전트 Junie Local을 공개했다.

JetBrains가 코딩 에이전트 Junie를 클라우드 연결 없이 맥(Mac) 로컬에서 완전히 구동하는 기능 ‘Junie Local’을 공개했다. 토큰 소모나 크레딧 차감 없이 무료로 쓸 수 있고, 코드가 기기 밖으로 나가지 않는다는 점을 핵심으로 내세웠다.1 같은 날 별도 게시물로 이 기능을 뒷받침하는 모델 최적화 작업도 함께 공개했다.2

Junie는 그동안도 Ollama나 LM Studio를 통해 로컬 모델에 연결할 수 있었다. 다만 사용자가 직접 모델을 고르고 설정을 튜닝해야 했고, 작은 모델은 단순 작업 정도만 처리할 수 있었다. JetBrains는 이 과정을 아예 대신 처리해 패키징했다. Junie 안에서 /local 명령 하나만 입력하면 모델이 내려받아지고 로컬 서버가 뜨면서 에이전트가 자동으로 전환된다. 별도 JSON 프로필 작성이나 런타임 설치, 엔드포인트 지정이 필요 없다.

탑재된 모델은 Qwen3.6-27B를 4비트로 양자화한 버전이다. 다운로드 용량은 약 20GB이며, 구동에는 M5 맥과 64GB RAM이 필요하다. Plan 모드, 라이브 프롬프팅, 가이드라인, 스킬, /commands 등 기존 Junie 기능은 그대로 작동한다.

M5를 최소 요구 사양으로 잡은 이유는 코딩 에이전트의 병목이 토큰 생성 속도가 아니라 프리필(prefill), 즉 모델이 파일을 읽어 맥락을 파악하는 단계에 있다는 판단 때문이다. M5의 뉴럴 액셀러레이터는 M4에는 없는 8비트 연산 명령을 지원하는데, 이를 활용해 프리필 처리량을 약 40% 끌어올렸다. JetBrains는 이 최적화를 MLX-VLM 프로젝트에 패치로 제출할 계획이라고 밝혔다.1 최신 버전인 Qwen3.8 대신 Qwen3.6을 택한 이유도 같은 맥락이다. Qwen3.8은 안정적으로 동작하려면 추론(reasoning) 기능을 켜야 하는데, 이 경우 작업 속도가 약 4배 느려진다.

기술 블로그에서는 구체적인 최적화 방식도 설명했다.2 로컬 모델은 프리필이 느리기 때문에, 세션 내 이전 작업에서 읽은 파일 정보를 다시 읽지 않도록 매 요청을 롤링 컨텍스트에 누적하는 방식으로 바꿨다. 세션 시작 시 보내는 시스템 프롬프트와 초기 컨텍스트도 순서를 조정해, 사용자 요청 직전까지의 구간을 캐시로 재사용하도록 했다. 또 Qwen3.6이 진행 상황을 알리는 XML 형식 지시를 잘 따르지 않는 대신 도구 호출과 함께 평문 설명을 생성한다는 점을 파악해, 이 평문을 그대로 진행 업데이트로 활용했다. 이 밖에 불필요한 LLM 호출 제거와 KV-캐시 재사용 등의 최적화도 적용했으며, 이 중 추측 디코딩(speculative decoding) 설정으로 생성 속도를 약 2배 높였다고 밝혔다.

성능은 JetBrains 자체 비공개 테스트셋으로 평가했다.

모델조건평가 결과
Qwen3.6-27B (로컬)추론 비활성화기준
Sonnet 4.5추론 토큰 1만 개 한도Qwen3.6-27B와 대등
GPT-5medium effortQwen3.6-27B보다 소폭 우수

주목할 점은 비교 조건이다. 로컬 모델은 추론을 아예 끈 상태로 배포되는데, 테스트 결과 추론을 켜도 품질 향상은 미미한 반면 토큰 소모는 2~3배 늘었기 때문이다. 반면 비교 대상인 Sonnet 4.5와 GPT-5는 추론을 켠 상태로 측정했다. JetBrains는 일상적인 작업에서는 격차를 체감하기 어렵지만, 복잡한 아키텍처 판단이 필요한 작업에서는 차이가 드러날 것이라고 설명했다.1

이런 성능 차이를 감안하더라도, 비용이 사라진다는 점 자체가 사용 방식을 바꾼다는 게 JetBrains의 주장이다. 크레딧 소모를 신경 써야 할 때는 시도하지 않던 다중 파일 리팩터링, 밀린 테스트 커버리지 보완, 의존성 업그레이드, 낯선 저장소 파악 같은 반복적이고 기계적인 작업을 로컬 모델에 맡길 수 있다는 것이다. 코드가 기기 밖으로 나가지 않는 만큼, NDA 아래 작업하는 팀은 별도 데이터 정책 검토 없이 쓸 수 있다는 점도 강조했다.

다만 현재 버전은 M5 맥, 64GB RAM이라는 특정 하드웨어에 한정돼 있고, 성능 비교도 JetBrains 자체 비공개 테스트셋에 근거한 것이어서 외부 검증은 아직 확인되지 않았다.

Footnotes

  1. JetBrains Blog, “Junie Local: Run the AI Coding Agent on Your Mac” ↩ ↩2 ↩3

  2. JetBrains Blog, “How We Optimized Qwen 3.6 for Junie” ↩ ↩2

읽기 목록은 이 브라우저에 저장됩니다.

출처

  1. Junie Local: Run the AI Coding Agent on Your Mac | JetBrains — JetBrains Blog
  2. How We Optimized Qwen 3.6 for Junie | Jetbrains Coding Agent — JetBrains Blog

이 글은 위 출처를 근거로 자동 생성된 뒤 발행됐습니다. 원문을 함께 확인해 주세요.