Rubrique

Modèles et LLM · page 6

ChatGPT, Gemini, Claude, Llama, Mistral et les autres : nouveaux modèles, capacités, benchmarks et coulisses des grands modèles de langage. 182 articles

Qwen 2.5-Max : Alibaba revendique l’avantage sur DeepSeek V3

Alibaba place son nouveau modèle Qwen 2.5-Max devant DeepSeek V3 dans plusieurs évaluations de référence, dont Arena-Hard, LiveBench et GPQA-Diamond. Préentraîné sur plus de 20 000 milliards de tokens, ce modèle de type Mixture-of-Experts vise à conjuguer raisonnement, code et facilité d’intégration pour les développeurs.

9 min

DeepSeek bouscule l’IA : ce que le modèle chinois change vraiment

Le lancement de DeepSeek-R1 le 20 janvier 2025 a propulsé une start-up chinoise au centre de la compétition mondiale de l’IA. Ses performances, son coût d’entraînement mis en avant et l’ouverture de ses poids interrogent les certitudes du secteur. Mais l’épisode soulève aussi des questions de sécurité, de transparence et de dépendance technologique.

9 min

DeepSeek lance Janus-Pro, un modèle ouvert qui défie DALL-E 3

DeepSeek présente Janus-Pro, une famille de modèles multimodaux capables de comprendre et de générer des images. Sa version à 7 milliards de paramètres affiche de solides résultats sur les tests MMBench et GenEval, devant DALL-E 3 sur ce dernier. Mais ses limites de résolution rappellent que les benchmarks ne racontent pas toute l’histoire.

9 min

Lucie suspendue : ce que son lancement raté révèle des IA françaises

Mise en ligne le 23 janvier 2025, Lucie devait incarner une approche française, ouverte et éducative de l’intelligence artificielle. Quelques jours plus tard, le projet porté par Linagora et le CNRS a suspendu son activité, après la diffusion virale de réponses absurdes. Au-delà des moqueries, l’épisode éclaire les limites concrètes des modèles de langage.

8 min

Hyperparamètres : le réglage qui peut transformer un modèle d’IA

Avant qu’un modèle n’apprenne, ses hyperparamètres définissent déjà une part décisive de sa trajectoire. Taux d’apprentissage, taille des lots, nombre de couches ou dropout : comprendre leur rôle et les tester avec méthode aide à gagner en précision, sans confondre bonne performance sur les données connues et réelle capacité de généralisation.

8 min

IA en 2025 : modèles efficaces, agents et calcul au plus près des données

À l’approche de 2025, l’intelligence artificielle ne se résume plus à des assistants conversationnels. Modèles plus faciles à adapter, traitement local des données et agents capables d’enchaîner des tâches dessinent de nouveaux usages. Mais cette accélération pose aussi des questions de fiabilité, de données personnelles et de responsabilité.

10 min

GPT-5 ou Orion : OpenAI face au mur des données d’entraînement

Le prochain grand modèle d’OpenAI, désigné dans la presse comme GPT-5 ou Orion, accuserait un retard face à un obstacle central : trouver assez de données fiables pour l’entraîner. Alors que son coût pourrait atteindre 500 millions de dollars, ce dossier révèle les limites du modèle de croissance des grands systèmes d’IA.

8 min