Aktuelle Berichte, Erklärungen und verbundene Technologiethemen.
JetBrains erläutert die Änderungen an Junie und der Inferenz-Engine, um Qwen3.6-27B lokal auf MacBooks mit M5-Chip auszuführen. Das Experiment zeigt, dass die Leistung lokaler Programmieragenten ebenso stark von der Kontextverwaltung und der Prefill-Phase abhängt wie von der Geschwindigkeit der Token-Generierung.
CohereLabs hat das North-Micro-Vision-Instruct-Modell vorgestellt, ein Vision-Language-Modell mit offenen Gewichten, 2,4 Milliarden Parametern und Unterstützung für die Verarbeitung von Bildern in ihrer Originalauflösung unter der Apache-2.0-Lizenz. Das Modell richtet sich an Anwendungen zum Verständnis von Dokumenten und Diagrammen, OCR und individueller Feinabstimmung. Zudem umfasst es Community-Unterstützung für MLX-VLM sowie ein AutoModel-Rezept für die Bereitstellung auf NVIDIA-Grafikprozessoren.