Suivez les dernières actualités, explications et histoires technologiques associées.
Un article de l’UC Berkeley et de FuriosaAI étudie l’utilisation de la mémoire flash à haute bande passante pour étendre la mémoire des accélérateurs d’intelligence artificielle lors de l’exécution de grands modèles de langage. Les simulations indiquent une réduction du temps d’achèvement pouvant atteindre 87 %, ainsi que des améliorations potentielles de la consommation d’énergie et de la durée de vie en écriture grâce à une planification tenant compte de la mémoire cache.
La capacité de production des substrats ne suffit plus à répondre aux besoins du packaging avancé ; la taille du boîtier, le nombre de couches, la précision des interconnexions et les fonctions intégrées rendent chaque conception plus proche d’un processus de fabrication spécialisé. Cela influe sur les matériaux, les équipements, la qualification et les sources d’approvisionnement, en particulier pour les boîtiers destinés à l’intelligence artificielle, au calcul haute performance, à l’optique intégrée et à l’automobile.