최신 보도, 해설 및 관련 기술 스토리를 확인하세요.
JetBrains가 Apache 2.0 라이선스로 제공되는 오픈 모델 Mellum2.1을 출시했다. 이 모델은 프로그래밍 에이전트와 하위 에이전트를 사용자의 로컬 환경이나 자체 인프라에서 실행하는 데 초점을 맞춘다. 실제 소프트웨어 환경에서 강화 학습을 활용해 훈련했으며, 코드 저장소 처리와 추론 속도를 크게 개선했다.
CNCF 기사는 엔터프라이즈 AI 인프라를 단일 모델이나 클러스터 하나를 배포하는 일이 아니라, 여러 팀이 공유하는 GPU 장치 풀을 관리하면서 활용률, 격리, 비용의 균형을 맞추는 일로 본다. 이 기사는 프로비저닝, 할당, 스케줄링, 네트워킹, 스토리지, 모니터링, 과금 등을 포함하는 기술 계층을 소개한다.
Perplexity가 사용자의 기기에서 에이전트를 로컬로 실행하는 Portable Computer 플랫폼을 출시했다. Nvidia DGX Spark와 최소 24GB 메모리의 RTX 그래픽카드를 탑재한 Linux 컴퓨터부터 지원한다. 이 시스템은 기본적으로 모델, 파일, 작업을 기기에 유지하며, 특정 단계를 더 강력한 클라우드 모델로 확장하기 전에 사용자 승인을 요청할 수 있다.
CohereLabs가 24억 개의 매개변수를 포함하고 원본 해상도 이미지 처리를 지원하는 Apache 2.0 라이선스의 오픈 웨이트 비전-언어 모델 North-Micro-Vision-Instruct를 출시했다. 이 모델은 문서와 차트 이해, OCR 및 맞춤형 미세 조정 애플리케이션을 대상으로 하며, MLX-VLM을 위한 커뮤니티 지원과 NVIDIA 그래픽 처리 장치에 배포할 수 있는 AutoModel 레시피도 포함한다.
VIDRAFT의 AX-Ray 프로젝트는 성능 점수를 넘어서는 모델 평가 방법을 제시한다. 이 프로젝트는 Zyphra/Zamba2-1.2B와 nvidia/Nemotron-H-8B-Base-8K 모델에서 인과적 누출이라고 설명한 결함을 식별하고 반복적으로 재현했다. 이 프레임워크는 이러한 사례를 배포를 막는 결함으로 분류하며, 서비스 경로나 API 문제와 구분한다.
Liquid AI가 Hugging Face에서 LFM2.5-2.6B 및 LFM2.5-2.6B-Base 모델을 공개했으며, 로컬에서 도구 호출과 다단계 워크플로를 지원한다. 이 모델은 컴퓨터와 휴대전화에서 빠른 에이전트를 실행하는 것을 목표로 하며, 메모리 사용량은 2.5GB 미만이다.