Acompanhe as últimas notícias, explicações e histórias tecnológicas relacionadas.
Um artigo da UC Berkeley e da FuriosaAI investiga o uso de High Bandwidth Flash para ampliar a memória de aceleradores de inteligência artificial durante a execução de grandes modelos de linguagem. As simulações indicam uma redução de até 87% no tempo de conclusão, com possíveis melhorias no consumo de energia e no prolongamento da vida útil de gravação por meio de escalonamento consciente do cache.