Robotique et matériel

IA : un algorithme d’addition promet jusqu’à 95 % d’énergie en moins

Remplacer une partie des multiplications en virgule flottante par des additions d’entiers pourrait alléger fortement la facture énergétique de l’IA. Une méthode évoque jusqu’à 95 % d’énergie économisée, sous des conditions expérimentales précises. Derrière ce chiffre spectaculaire, la question est aussi celle de l’adaptation des modèles et des puces.

Serveurs et puces illustrant le remplacement de multiplications par des additions pour une IA plus sobre
Illustration : Actu.ai

L’intelligence artificielle ne se résume pas à des logiciels et à des conversations avec un assistant : elle repose sur une immense quantité d’opérations mathématiques réalisées par des processeurs spécialisés. À mesure que les modèles gagnent en taille et que leurs usages se multiplient, le coût énergétique de ces calculs devient un enjeu central. Une approche fondée sur de simples additions d’entiers pourrait, selon les résultats expérimentaux évoqués, réduire les besoins énergétiques de certains traitements d’IA jusqu’à 95 %.

L’idée est séduisante parce qu’elle s’attaque à une brique très élémentaire du calcul. Plutôt que d’effectuer systématiquement des multiplications en virgule flottante, courantes dans les réseaux de neurones, l’algorithme s’appuie sur des additions d’entiers et sur une multiplication simplifiée. Les chercheurs à l’origine de ces travaux avancent que cette voie peut produire des résultats comparables, voire supérieurs, tout en mobilisant beaucoup moins de ressources.

Ce résultat ne doit toutefois pas être interprété comme la promesse d’une baisse immédiate de 95 % de l’électricité consommée par toute l’IA. Il décrit le potentiel d’une méthode dans les conditions où elle a été évaluée. Entre une opération mathématique isolée, un modèle complet et un centre de données, les postes de consommation ne sont pas les mêmes. C’est précisément ce qui rend cette piste à la fois prometteuse et plus complexe qu’un simple changement de formule.

Pourquoi les calculs de l’IA consomment-ils autant ?

Une grande partie de l’apprentissage automatique moderne consiste à comparer et à combiner des nombres. Dans un réseau de neurones, une couche effectue typiquement une succession de produits entre des données d’entrée et des paramètres, puis additionne les résultats. Ces calculs sont répétés un très grand nombre de fois, lors de l’entraînement comme lors de l’utilisation d’un modèle.

Les calculs dits « en virgule flottante » sont particulièrement répandus. Ils permettent de manipuler des valeurs très petites, très grandes ou décimales avec une précision adaptée à de nombreuses tâches scientifiques et d’IA. Cette souplesse a un coût : les unités matérielles qui les exécutent, ainsi que les transferts de données nécessaires pour alimenter ces unités, consomment de l’énergie.

L’addition d’entiers est une opération plus simple. Les entiers sont des nombres sans partie décimale, représentés dans un format généralement plus léger à traiter que la virgule flottante. L’intérêt de la méthode décrite est donc de réduire la complexité de certaines opérations fondamentales, sans perdre la qualité de calcul attendue par le modèle concerné.

En quoi consiste l’approche par additions d’entiers ?

L’innovation présentée repose sur un changement de manière de calculer. Là où les architectures d’IA traditionnelles s’appuient largement sur les multiplications en virgule flottante, l’algorithme privilégie des additions d’entiers associées à une multiplication simplifiée. L’objectif est de conserver l’information utile au modèle, tout en évitant une partie des opérations les plus gourmandes.

Il ne s’agit pas de dire que toute multiplication disparaît sans contrepartie de tous les systèmes d’IA. Les réseaux de neurones ont été largement conçus autour des multiplications et accumulations classiques. Pour exploiter pleinement une autre arithmétique, il peut être nécessaire d’adapter la façon dont les données, les paramètres et les calculs sont représentés.

Les éléments disponibles indiquent que les expérimentations ont obtenu des résultats comparables, voire supérieurs, en préservant la précision recherchée. Mais ils ne détaillent pas les modèles, les jeux de données, les puces ni les scénarios de mesure concernés. Ces paramètres comptent beaucoup : une économie mesurée sur une tâche ciblée ne se transpose pas automatiquement à tous les usages, par exemple à un grand modèle de langage, à un système de recommandation ou à un logiciel de vision par ordinateur.

Élément à comparerCalcul classique en IAApproche évoquée
Opération dominanteMultiplications en virgule flottante et additionsAdditions d’entiers avec multiplication simplifiée
Objectif principalAssurer des calculs précis et polyvalentsRéduire les ressources de calcul nécessaires
Gain énergétique annoncéVariable selon le matériel et le modèleJusqu’à 95 % dans les résultats expérimentaux évoqués
Niveau de performanceRéférence des systèmes existantsRésultats annoncés comme comparables ou parfois supérieurs
Condition de déploiementÉcosystème matériel et logiciel déjà établiAdaptation possible des modèles et des systèmes existants

Que signifie réellement une baisse de 95 % ?

Le chiffre de 95 % est le cœur de l’annonce, mais il doit être lu avec précision. L’expression « jusqu’à » désigne un gain maximal observé dans certains cas, et non une moyenne universelle. Le résultat dépend notamment du type d’algorithme, du volume de données, de la précision demandée, de l’architecture matérielle et de la façon dont l’énergie est mesurée.

Il faut aussi distinguer plusieurs notions souvent confondues. Réduire la puissance nécessaire à un calcul peut raccourcir son exécution ou limiter l’énergie consommée par l’opération. En revanche, la facture totale d’un service d’IA inclut l’ensemble de son fonctionnement : mémoire, stockage, réseau, refroidissement, disponibilité des serveurs et parfois traitement des données avant ou après l’inférence.

La « performance » elle-même peut recouvrir plusieurs réalités. Elle peut désigner l’exactitude d’un modèle, sa vitesse de réponse, le nombre de requêtes traitées simultanément ou encore la stabilité des résultats. Affirmer qu’une technique conserve les performances implique donc de préciser l’indicateur observé. C’est une étape indispensable avant de comparer rigoureusement cette méthode aux approches conventionnelles.

Calculs classiques et additions d’entiers : ce qui change

Approche classique

  • S’appuie largement sur les multiplications en virgule flottante.
  • Bénéficie d’outils matériels et logiciels déjà très répandus.
  • Offre une grande souplesse de représentation numérique.
  • Peut mobiliser davantage de ressources pour les opérations répétées.

Approche par additions d’entiers

  • Privilégie des opérations arithmétiques plus simples à exécuter.
  • Vise une forte réduction des besoins énergétiques de certains calculs.
  • Annonce des résultats comparables dans les expérimentations évoquées.
  • Demande de vérifier la précision et la compatibilité selon chaque usage.

Pourquoi ce type d’algorithme intéresse les centres de données

La montée en puissance de l’IA intervient dans un contexte de forte attention portée à l’énergie. La publication d’origine évoque une estimation selon laquelle la consommation des systèmes d’IA pourrait atteindre, d’ici 2027, un niveau équivalent à celui d’un pays développé. Quel que soit le scénario exact retenu, la direction est claire : plus les modèles sont sollicités, plus l’efficacité de chaque calcul devient stratégique.

Une réduction des besoins de calcul peut avoir deux effets complémentaires. Le premier est économique : moins d’électricité et moins de matériel mobilisé par tâche peuvent réduire les coûts d’exploitation. Le second est environnemental : à quantité de services identique, une baisse de la consommation électrique peut réduire l’empreinte associée aux infrastructures, en fonction du mode de production de l’électricité utilisée.

Cette dernière nuance est importante. L’efficacité énergétique ne détermine pas à elle seule les émissions de carbone. Celles-ci dépendent également du mix électrique local, de la construction et du renouvellement des équipements, ainsi que de l’effet de rebond : un calcul moins cher et plus rapide peut encourager de nouveaux usages et donc accroître le volume global de calculs.

Quelles applications pourraient bénéficier de cette méthode ?

Les perspectives mentionnées vont au-delà d’un seul type de programme. Le machine learning dans son ensemble, les systèmes de recommandation et les tâches de traitement intensif de données figurent parmi les domaines susceptibles d’explorer cette voie. Des usages comme la reconnaissance d’images ou le traitement automatique du langage reposent en effet sur de nombreuses opérations répétitives, ce qui en fait des candidats naturels à l’optimisation.

Les systèmes de recommandation constituent un cas particulièrement intéressant. Ils doivent fréquemment analyser de nombreux signaux pour proposer un contenu, un produit ou une information pertinente. Lorsqu’ils traitent un grand nombre de requêtes, même une économie modeste par calcul peut devenir significative à l’échelle d’un service.

Pour la vision par ordinateur et le langage, la difficulté est différente : ces applications peuvent exiger une grande précision pour distinguer des objets proches, interpréter le sens d’une phrase ou gérer des contextes complexes. Une technique fondée sur des entiers devra donc montrer qu’elle ne dégrade pas les résultats sur les tâches visées. La promesse énergétique ne dispense pas de cette vérification.

Les obstacles avant une adoption à grande échelle

Passer d’un résultat expérimental à une technologie largement employée suppose de résoudre plusieurs questions. La première concerne la compatibilité avec les modèles existants. De nombreux outils logiciels, bibliothèques et accélérateurs matériels ont été optimisés pendant des années pour les calculs en virgule flottante. Tirer parti d’une approche différente peut nécessiter de repenser certaines étapes de conception ou de déploiement.

La seconde concerne la précision. Les entiers offrent une plage de représentation limitée : il faut s’assurer que les valeurs manipulées restent suffisamment fidèles au comportement attendu du modèle. Selon le cas, la conversion des données et des paramètres, ainsi que la gestion des valeurs extrêmes, peuvent devenir des sujets techniques déterminants.

Enfin, le gain énergétique doit être évalué de manière reproductible. Une démonstration convaincante doit indiquer ce qui est mesuré, sur quel matériel, pour quelle tâche et avec quelle référence de comparaison. La consommation d’une opération, celle d’une puce et celle d’un serveur complet ne produisent pas le même verdict. Cette transparence est nécessaire pour déterminer si le seuil de 95 % peut être atteint dans des conditions proches des usages industriels.

Ce qu’il faut surveiller pour mesurer la portée de cette avancée

La piste des additions d’entiers illustre une idée essentielle : rendre l’IA plus durable ne passe pas uniquement par des centres de données plus grands ou de nouvelles puces, mais aussi par des algorithmes plus sobres. En modifiant la nature même des opérations répétées des milliards de fois, une amélioration mathématique peut avoir des conséquences matérielles et environnementales considérables.

Pour apprécier sa portée, plusieurs éléments devront être suivis : la publication de protocoles détaillés, la diversité des modèles testés, les mesures d’énergie sur différents matériels et la capacité de la méthode à préserver précision, vitesse et fiabilité. Il faudra également observer si des fabricants de puces ou des éditeurs de logiciels intègrent ce type de calcul dans leurs outils.

Si les résultats sont confirmés et transposables, l’enjeu dépasse l’optimisation d’un seul algorithme. Il pourrait s’agir d’une façon de rapprocher deux objectifs parfois présentés comme contradictoires : développer des systèmes d’IA plus puissants, tout en limitant les ressources nécessaires pour les faire fonctionner.

Questions fréquentes

Comment un algorithme d’addition peut-il réduire l’énergie consommée par l’IA ?

Les réseaux de neurones réalisent un très grand nombre d’opérations mathématiques. Les additions d’entiers sont généralement plus simples à exécuter que les multiplications en virgule flottante. En remplaçant une partie des calculs coûteux par cette arithmétique, l’algorithme cherche à réduire les ressources matérielles et l’énergie nécessaires, tout en conservant des résultats utiles.

La réduction de 95 % de l’énergie concerne-t-elle toutes les intelligences artificielles ?

Non. Le chiffre annoncé est un maximum issu des résultats expérimentaux évoqués pour cette approche. Il ne signifie pas qu’un assistant conversationnel, un générateur d’images ou un centre de données entier consommera automatiquement 95 % d’énergie en moins. Le gain dépend du modèle, de la tâche, du matériel employé et de la méthode de mesure.

Les additions d’entiers peuvent-elles remplacer toutes les multiplications dans un réseau de neurones ?

La méthode ne doit pas être comprise comme un remplacement universel et immédiat de toute multiplication. Les modèles d’IA ont largement été conçus autour de calculs conventionnels. L’enjeu consiste à adapter les opérations pour exploiter les additions d’entiers sans perdre la précision requise par une application donnée.

Quels usages de l’IA pourraient profiter de cette technique ?

Les domaines qui enchaînent de nombreux calculs répétitifs sont les premiers concernés. L’article évoque notamment le machine learning et les systèmes de recommandation. Des tâches comme la reconnaissance d’images ou le traitement du langage peuvent aussi être intéressées, à condition que les résultats restent suffisamment précis et que les logiciels puissent être adaptés.

Une IA moins énergivore est-elle forcément moins polluante ?

Une consommation électrique réduite peut diminuer l’empreinte environnementale d’un service d’IA, mais le résultat dépend du contexte. Le bilan dépend aussi de l’électricité utilisée, du refroidissement des centres de données, de la fabrication du matériel et du volume total de calculs. L’efficacité est donc un levier important, sans être l’unique réponse.

Sources

Références consultées pour la rédaction de cet article. Les adresses sont indiquées à titre informatif et ne sont pas des liens.

  1. Agence internationale de l’énergie, rapport Electricity 2024, contexte sur la demande électrique et les centres de donnéeswww.iea.org/reports/electricity-2024