Sujet

LLM · page 2

Tous les articles d’Actu.ai consacrés à LLM : actualités, analyses et explications sur ce sujet lié à l’intelligence artificielle. 84 articles

DeepSeek R1-0528 : des réponses plus verrouillées sur les sujets politiques sensibles

La version R1-0528 du modèle de raisonnement de DeepSeek est accusée de refuser davantage les discussions politiques sensibles, notamment lorsqu’elles concernent la Chine. Des observations partagées en ligne pointent une différence troublante entre ce que le modèle semble savoir et ce qu’il accepte d’expliquer. Un débat qui dépasse largement le seul cas de DeepSeek.

8 min

GPT-4 rivalise avec l’humain dans certains tests de raisonnement analogique

GPT-4 peut atteindre un niveau comparable à celui d’humains dans certaines tâches de raisonnement analogique, selon une étude publiée dans PNAS Nexus. Les chercheurs l’ont notamment confronté à des énigmes contre-factuelles conçues pour limiter l’effet de la mémorisation. Le résultat est notable, mais il ne tranche pas à lui seul la question de la compréhension par l’IA.

8 min

ZeroSearch d’Alibaba veut entraîner les LLM sans factures de recherche

Plutôt que d’interroger un moteur de recherche à chaque étape d’entraînement, Alibaba propose de simuler ses résultats avec des documents générés par IA. Baptisée ZeroSearch, cette méthode annonce un coût de 70,80 dollars pour 64 000 requêtes, contre 586,70 dollars avec des API de Google, mais suppose aussi de disposer de GPU puissants.

9 min

Code généré par l’IA : une méthode du MIT pour gagner en précision

Un code qui semble convaincant peut contenir une erreur de syntaxe ou, plus difficile à repérer, ne pas répondre au besoin initial. Des chercheurs du MIT ont mis au point une approche qui guide les modèles de langage pendant la génération, afin de privilégier les résultats conformes aux règles attendues. Les essais couvrent notamment Python, SQL, les molécules et la robotique.

10 min

Faux paquets générés par les LLM : le risque caché du vibe coding

Demander du code à un assistant d’IA peut aussi conduire à installer une dépendance qui n’existe pas. Les modèles de langage sont capables d’inventer des noms de paquets plausibles, qu’un attaquant peut ensuite enregistrer et détourner. Voici pourquoi cette faille de la chaîne logicielle impose de vérifier chaque recommandation.

9 min