Rubrique

Modèles et LLM · page 7

ChatGPT, Gemini, Claude, Llama, Mistral et les autres : nouveaux modèles, capacités, benchmarks et coulisses des grands modèles de langage. 182 articles

Llama 3.3 70B : Meta promet la puissance du 405B à un dixième du coût

Meta enrichit sa famille Llama avec Llama 3.3 70B, un grand modèle de langage orienté vers les usages textuels. L’entreprise affirme atteindre un niveau proche de Llama 3.1 405B avec un modèle bien plus compact, donc moins coûteux à exploiter. Une promesse importante pour les entreprises et développeurs qui veulent maîtriser leur infrastructure d’IA.

9 min

OpenAI : le modèle Orion face au mur des rendements décroissants

Le modèle interne Orion devait prolonger la dynamique ouverte par GPT-4. Mais ses résultats intermédiaires, selon des informations rapportées en novembre 2024, alimentent le débat sur des gains de performance moins spectaculaires. Pour OpenAI, l’enjeu dépasse un modèle : il concerne les données, les coûts et la prochaine méthode de progrès de l’IA.

9 min

Claude 3.5 Sonnet peut utiliser un ordinateur : ce que change Computer Use

Anthropic ouvre en bêta une fonction qui permet à Claude 3.5 Sonnet d’agir sur une interface informatique, en cliquant, saisissant du texte et faisant défiler des pages. Cette avancée vise l’automatisation de tâches numériques, mais elle reste destinée aux développeurs et soulève des questions majeures de fiabilité et de sécurité.

9 min

IBM Granite 3.0 : l’open source au service des développeurs et du code

IBM a présenté Granite 3.0, une nouvelle génération de modèles d’intelligence artificielle intégrée à sa plateforme watsonx. Orientée notamment vers l’assistance au développement logiciel, cette famille mise sur l’open source pour élargir l’accès aux outils d’IA générative, favoriser l’adaptation des modèles et encourager la collaboration technique.

8 min

Les modèles d’IA les plus puissants en octobre 2024 : comment les comparer

En octobre 2024, les modèles d’IA progressent sur plusieurs fronts : raisonnement, conversation, contexte long, image et automatisation. OpenAI, Google, Anthropic, xAI et Mistral figurent parmi les acteurs cités. Mais comparer ces outils exige de distinguer leurs usages, car un chatbot, un modèle de raisonnement et un générateur d’images ne se mesurent pas avec les mêmes critères.

11 min

Algorithmes génératifs : ils simulent le langage sans parler comme nous

Les IA génératives produisent des textes de plus en plus naturels, mais leurs réponses ne constituent pas pour autant une langue au sens humain du terme. Elles modélisent des régularités, recombinent des formes et simulent la conversation. Comprendre cette différence aide à mieux évaluer leurs usages, de la traduction à la création, et leurs risques.

9 min

Entraîner une grande IA : pourquoi le calendrier dépasse largement les GPU

L’entraînement d’un grand modèle d’intelligence artificielle ne se résume pas à lancer des milliers de puces pendant quelques jours. Données, puissance de calcul, tests de sécurité et déploiement déterminent un calendrier souvent long et difficile à prévoir. Voici les étapes qui expliquent ces délais, et les leviers pour les maîtriser.

8 min