Sujet

LLM · page 3

Tous les articles d’Actu.ai consacrés à LLM : actualités, analyses et explications sur ce sujet lié à l’intelligence artificielle. 84 articles

Pourquoi les LLM ne suffisent pas à prédire le chemin vers l’AGI

Les grands modèles de langage impressionnent par leur capacité à écrire, résumer ou dialoguer. Mais, pour Neila Murray de Meta, ils ne tracent pas à eux seuls le chemin vers l’intelligence artificielle générale. La mémoire, le raisonnement et l’expérience concrète du monde restent des défis majeurs.

9 min

Les énigmes façon Indiana Jones soulignent les limites persistantes des LLM

Les scénarios d’évasion inspirés d’Indiana Jones offrent une image parlante des difficultés rencontrées par les grands modèles de langage. Face à des indices ambigus, des consignes contradictoires ou des instructions dissimulées, ces outils peuvent produire des réponses imprévisibles. Une limite importante pour évaluer leur fiabilité, surtout dans les usages sensibles.

8 min

Les IA face au test cognitif MoCA : ce que révèlent réellement leurs échecs

Des chercheurs ont soumis ChatGPT, Claude et Gemini à un test clinique destiné à repérer les troubles cognitifs chez l’humain. Seul GPT-4o atteint le seuil de 26 sur 30, tandis que les autres modèles butent notamment sur la mémoire et les tâches visuospatiales. Cette expérience ne prouve pas que les IA vieillissent, mais elle rappelle leurs limites dans les usages sensibles.

8 min

Pourquoi ChatGPT emploie certains mots plus souvent que les humains

Certains mots et formules reviennent avec une régularité frappante dans les textes attribués à ChatGPT. Un recensement cité par la publication d’origine met notamment en avant « reimagined », « bioluminescent » ou « delve ». Ces répétitions éclairent le fonctionnement probabiliste des modèles de langage, mais ne suffisent pas à identifier une réponse d’IA avec certitude.

10 min

Qwen 2.5-Max : Alibaba revendique l’avantage sur DeepSeek V3

Alibaba place son nouveau modèle Qwen 2.5-Max devant DeepSeek V3 dans plusieurs évaluations de référence, dont Arena-Hard, LiveBench et GPQA-Diamond. Préentraîné sur plus de 20 000 milliards de tokens, ce modèle de type Mixture-of-Experts vise à conjuguer raisonnement, code et facilité d’intégration pour les développeurs.

9 min

Pourquoi les LLM les plus performants ressemblent davantage au cerveau pour le langage

Des chercheurs de l’Université Columbia et de Northwell Health ont comparé l’activité cérébrale de personnes écoutant des récits aux représentations internes de douze modèles de langage. Leur étude suggère qu’à mesure que ces LLM gagnent en performance, leur manière d’organiser l’information linguistique s’aligne davantage avec celle du cerveau humain.

8 min

Cybersécurité : 12 projets France 2030 pour renforcer les technologies critiques

Lors de l’European Cyber Week, l’État a dévoilé douze lauréats de l’appel à projets France 2030 consacré aux technologies critiques de cybersécurité. Les initiatives soutenues vont de la cartographie des actifs numériques à l’audit de modèles de langage, avec une attention particulière aux besoins de l’assurance, des entreprises et des réglementations européennes.

9 min