Sigue la cobertura, explicaciones e historias tecnológicas relacionadas.
JetBrains ha lanzado Junie Local, que ejecuta el agente de programación Junie localmente en un Mac mediante el modelo Qwen3.6-27B, sin enviar el código ni las indicaciones a la nube. El funcionamiento requiere un Mac con procesador M5 y 64 gigabytes de memoria, además de una descarga de aproximadamente 20 gigabytes.
JetBrains explica las modificaciones realizadas en Junie y en el motor de inferencia para ejecutar Qwen3.6-27B localmente en MacBook equipados con el chip M5. La experiencia muestra que el rendimiento de los agentes de programación locales depende tanto de la gestión del contexto y de la etapa de prefill como de la velocidad de generación de tokens.
Los centros de datos avanzan hacia clústeres heterogéneos que combinan CPUs, GPUs, NPUs, aceleradores personalizados y conectividad óptica, en lugar de depender de una sola GPU para todas las tareas. Este cambio convierte el software, la gestión de redes y la energía en factores decisivos para reducir el costo de los tokens y mejorar el aprovechamiento del hardware.
La startup Etched recaudó 700 millones de dólares con una valoración de 21.000 millones de dólares, después de que Jane Street probara el primer sistema completo de inteligencia artificial enviado por la empresa y comprara el sistema para operarlo en su centro de datos. La financiación refleja la apuesta por los diseños de la empresa para acelerar la inferencia de modelos de inteligencia artificial y reducir su coste.
Sharad Chol, de Expedera, analiza cómo la transición de los dispositivos periféricos desde las redes de visión tradicionales hacia modelos LLM y VLM está cambiando la naturaleza del cuello de botella: de la capacidad computacional al movimiento de datos en memoria. También presenta el papel del procesamiento basado en paquetes para reducir la transferencia externa de datos y mejorar la ejecución de modelos en automóviles y dispositivos integrados.