Rubrique

Modèles et LLM · page 5

ChatGPT, Gemini, Claude, Llama, Mistral et les autres : nouveaux modèles, capacités, benchmarks et coulisses des grands modèles de langage. 182 articles

Chatbot Arena : les modèles d’IA réellement en tête en février 2025

Le classement Chatbot Arena met en lumière une course serrée entre les grands modèles conversationnels. En février 2025, Chocolate, associé à une première version de Grok-3, atteint 1 402 points Elo, devant Gemini-2 Flash Thinking Exp 01-21 à 1 385 points. Mais ces scores ne suffisent pas, à eux seuls, à désigner le meilleur outil pour chaque usage.

9 min

Les énigmes façon Indiana Jones soulignent les limites persistantes des LLM

Les scénarios d’évasion inspirés d’Indiana Jones offrent une image parlante des difficultés rencontrées par les grands modèles de langage. Face à des indices ambigus, des consignes contradictoires ou des instructions dissimulées, ces outils peuvent produire des réponses imprévisibles. Une limite importante pour évaluer leur fiabilité, surtout dans les usages sensibles.

8 min

Pourquoi ChatGPT emploie certains mots plus souvent que les humains

Certains mots et formules reviennent avec une régularité frappante dans les textes attribués à ChatGPT. Un recensement cité par la publication d’origine met notamment en avant « reimagined », « bioluminescent » ou « delve ». Ces répétitions éclairent le fonctionnement probabiliste des modèles de langage, mais ne suffisent pas à identifier une réponse d’IA avec certitude.

10 min

IA en 2025 : petits modèles, supervision humaine et confiance numérique

En 2025, l’intelligence artificielle ne se résume plus à la course aux modèles géants. Les organisations cherchent des systèmes plus ciblés, mieux reliés à leurs données et encadrés par l’expertise humaine. Open source, IA agentique, lutte contre les deepfakes et règles éthiques dessinent les priorités de cette nouvelle étape.

9 min

DeepSeek : cinq repères pour comprendre l’IA chinoise face à ChatGPT

Avec ses modèles R1 et V3, DeepSeek s’est imposé en janvier 2025 comme une alternative chinoise très visible à ChatGPT. Ses performances revendiquées, son coût d’entraînement affiché et son accès gratuit ont frappé les esprits. Mais les chiffres méritent d’être nuancés, tandis que les restrictions sur les sujets politiques posent une limite claire.

9 min

DeepSeek-R1 relance la course à l’IA entre les États-Unis et la Chine

Le modèle DeepSeek-R1, lancé par une jeune entreprise chinoise, a ébranlé l’idée d’une avance américaine incontestable dans l’IA de raisonnement. Au-delà de la réaction des marchés, son arrivée remet au premier plan la bataille des puces, la souveraineté technologique et l’urgence d’un dialogue sur la sécurité des systèmes les plus puissants.

9 min

DeepSeek, le choc qui oblige l’Europe à repenser sa stratégie de l’IA

L’émergence de DeepSeek rappelle que la course à l’intelligence artificielle ne se joue plus seulement entre les grands groupes américains. Pour la spécialiste Asma Mhalla, ce modèle chinois constitue un choc stratégique pour l’Europe, confrontée à un enjeu décisif : renforcer ses capacités d’innovation sans renoncer à ses exigences de souveraineté et de régulation.

9 min

DeepSeek : ce que son essor révèle vraiment sur la course mondiale à l’IA

Avec DeepSeek-V3 puis DeepSeek-R1, la startup chinoise a imposé son nom dans le débat mondial sur l’intelligence artificielle. Ses résultats techniques et ses annonces de coûts ont secoué les marchés, sans pour autant justifier tous les raccourcis. Performances, innovation, rivalité avec OpenAI et protection des données : ce que l’on sait réellement début février 2025.

9 min