PASTA : des modèles d’IA accélèrent les réponses complexes en répartissant le travail
Les grands modèles de langage produisent habituellement leurs réponses mot après mot, un procédé qui peut devenir lent sur les demandes élaborées. Des chercheurs du MIT et de Google proposent PASTA, une méthode qui apprend à repérer les parties indépendantes d’une réponse afin de les générer simultanément.



