최신 보도, 해설 및 관련 기술 스토리를 확인하세요.
JetBrains는 M5 칩이 탑재된 MacBook에서 Qwen3.6-27B를 로컬로 실행하기 위해 Junie와 추론 엔진을 어떻게 수정했는지 설명했다. 이번 실험은 로컬 코딩 에이전트의 성능이 토큰 생성 속도뿐 아니라 컨텍스트 관리와 prefill 단계에도 좌우된다는 점을 보여준다.
CohereLabs가 24억 개의 매개변수를 포함하고 원본 해상도 이미지 처리를 지원하는 Apache 2.0 라이선스의 오픈 웨이트 비전-언어 모델 North-Micro-Vision-Instruct를 출시했다. 이 모델은 문서와 차트 이해, OCR 및 맞춤형 미세 조정 애플리케이션을 대상으로 하며, MLX-VLM을 위한 커뮤니티 지원과 NVIDIA 그래픽 처리 장치에 배포할 수 있는 AutoModel 레시피도 포함한다.