Amazon Nova : six modèles d’IA pour le texte, l’image et la vidéo
Amazon a présenté Nova lors de sa conférence re:Invent 2024, une famille de modèles génératifs destinée aux entreprises. Du traitement rapide de texte à la création d’images et de vidéos, AWS veut couvrir plusieurs usages avec des modèles multimodaux, personnalisables et compatibles avec plus de 200 langues.

Amazon entend prendre une place plus visible dans la course à l’intelligence artificielle générative. Lors de sa conférence re:Invent 2024, le groupe a présenté Amazon Nova, une nouvelle famille de modèles capables de travailler avec du texte, des images et, selon les versions, de la vidéo. L’ambition n’est pas de proposer un simple assistant conversationnel au grand public, mais de donner aux entreprises une boîte à outils intégrée à l’univers d’AWS pour automatiser, analyser et créer.
Cette annonce arrive dans un marché déjà très disputé, où les modèles d’OpenAI, de Meta et d’autres acteurs ont imposé l’IA générative dans les usages professionnels. Avec Nova, Amazon mise sur une offre segmentée : un modèle léger pour les opérations courantes, des modèles plus complets pour interpréter documents et contenus visuels, puis deux modèles spécialisés dans la création d’images et de vidéos.
Une même famille, six modèles aux rôles distincts
Amazon Nova rassemble quatre modèles de langage et deux modèles de création visuelle. L’idée est de ne pas mobiliser la même puissance de calcul pour toutes les demandes. Répondre à une question simple, résumer un texte très long, analyser une vidéo ou produire une séquence animée sont des tâches radicalement différentes, avec des besoins distincts en rapidité, coût et qualité.
Les modèles de langage de la gamme sont baptisés Nova Micro, Nova Lite, Nova Pro et Nova Premier. Les deux derniers membres de la famille créative sont Nova Canvas, pour les images, et Nova Reel, pour les vidéos.
| Modèle | Fonction principale annoncée | Capacités et positionnement |
|---|---|---|
| Nova Micro | Traitement rapide de texte | Modèle léger pour les tâches simples, avec 128 000 tokens de contexte |
| Nova Lite | Texte et compréhension visuelle | Comprend les images et les vidéos, avec une fenêtre de contexte de 300 000 tokens |
| Nova Pro | Analyse multimodale avancée | Modèle équilibré pour documents complexes, code et contenus visuels, avec 300 000 tokens de contexte |
| Nova Premier | Raisonnement avancé | Modèle le plus sophistiqué de la gamme, annoncé pour le début de 2025 |
| Nova Canvas | Génération et édition d’images | Crée des images à partir de texte ou d’images, avec des outils de contrôle visuel |
| Nova Reel | Génération de vidéos | Produit des vidéos à partir de texte et d’images, avec gestion des mouvements de caméra |
Un token est une unité de découpage utilisée par les modèles de langage pour lire et produire du texte. Il ne correspond pas exactement à un mot : un mot peut être formé d’un ou de plusieurs tokens. Plus la fenêtre de contexte est grande, plus le modèle peut prendre en compte un volume important d’informations dans une même requête, par exemple un long rapport, une base documentaire ou une retranscription.
Nova Micro, Lite et Pro : lequel choisir selon l’usage ?
Nova Micro est le plus léger des modèles annoncés. Il est conçu pour les tâches textuelles rapides et répétitives : classement de contenus, extraction d’informations, réponses courtes, résumé ou traitement de demandes simples. Sa fenêtre de 128 000 tokens vise déjà des documents de taille conséquente, tout en privilégiant la vitesse d’exécution.
Avec Nova Lite, Amazon ajoute la compréhension d’images et de vidéos. Le modèle peut donc être utilisé lorsqu’une entreprise souhaite interroger un contenu visuel, par exemple pour exploiter une image, interpréter une séquence vidéo ou associer des éléments visuels à un texte. Il conserve une fenêtre de contexte de 300 000 tokens et est présenté comme une option à coût compétitif.
Nova Pro se positionne comme le compromis entre performances et polyvalence. Amazon le destine aux dossiers plus complexes, notamment à l’analyse de documents financiers, de code et de contenus visuels. Son intérêt est de réunir dans un même modèle la capacité à traiter plusieurs formats d’information, sans avoir à les transformer systématiquement en texte au préalable.
Enfin, Nova Premier doit compléter la gamme au début de 2025. Amazon le présente comme son modèle le plus avancé, avec des capacités de raisonnement renforcées. Dans le langage de l’IA générative, le raisonnement désigne la faculté de décomposer une tâche, de relier plusieurs informations et de produire une réponse structurée face à un problème plus élaboré. Les détails précis de ses performances restent alors à découvrir.
Pourquoi la multimodalité devient centrale
Un modèle dit multimodal peut recevoir ou comprendre plusieurs types de données. Là où un modèle de langage classique traite essentiellement du texte, un modèle multimodal peut également interpréter une image, une vidéo ou une combinaison de ces supports. Cette faculté correspond à la réalité des informations manipulées par les entreprises : un dossier peut contenir des tableaux, des photographies, des scans, des graphiques, des extraits de code ou des enregistrements vidéo.
La promesse de Nova est donc de réduire les ruptures entre ces formats. Une équipe peut, en théorie, demander à un modèle de parcourir un document riche en éléments visuels, d’en isoler les points importants et de produire un texte exploitable. Dans les faits, la pertinence dépendra toujours de la qualité des données fournies, de la formulation des consignes et de la supervision humaine.
Amazon indique que ses modèles prennent en charge plus de 200 langues, dont le français. Ce point est important pour les organisations qui travaillent dans plusieurs pays, même si la qualité peut varier d’une langue, d’un domaine et d’un cas d’usage à l’autre.
Nova Canvas, l’outil d’Amazon pour créer et retoucher des images
Avec Nova Canvas, AWS s’attaque au marché de la génération d’images, déjà occupé par des outils comme DALL-E ou Midjourney. Le modèle peut créer une image à partir d’une instruction écrite, mais aussi partir d’autres éléments visuels. Son intérêt ne réside pas seulement dans la production d’illustrations : Amazon met aussi en avant des fonctions d’édition permettant de mieux contrôler le style et la composition.
Pour une entreprise, ce type de système peut servir à produire rapidement des visuels de présentation, des maquettes, des illustrations pour des campagnes ou des déclinaisons d’un concept créatif. Il ne remplace pas automatiquement la direction artistique, la retouche ou la validation d’un professionnel. En revanche, il peut accélérer les premières étapes d’exploration et de production.
Au lancement, Nova Canvas n’accepte que les instructions en anglais, avec une limite de 1 024 caractères par prompt. Cette contrainte impose aux utilisateurs francophones de rédiger ou de traduire leurs demandes. Elle rappelle aussi qu’une prise en charge générale de nombreuses langues par une famille de modèles ne signifie pas que toutes les fonctions créatives sont disponibles dans chacune d’elles.
Nova Reel veut simplifier la génération de vidéos
La vidéo est le terrain le plus exigeant de l’IA générative. Générer une image fixe demande de composer un cadre cohérent. Créer une vidéo oblige en plus à préserver cette cohérence d’une image à l’autre, tout en donnant une impression crédible de mouvement. C’est le créneau visé par Nova Reel, le modèle vidéo dévoilé par AWS.
Nova Reel peut générer des vidéos à partir de consignes textuelles et d’images. Amazon met particulièrement en avant la gestion des mouvements de caméra, un élément déterminant pour donner du rythme ou guider le regard dans une séquence. L’outil ambitionne ainsi de faciliter la réalisation de contenus vidéo sans partir de zéro.
Comme Canvas, Reel est à ce stade limité à des instructions en anglais. AWS prévoit également des garde-fous autour des médias synthétiques, dont le filigranage des contenus générés. Cette traçabilité est un enjeu important : lorsque des images et vidéos peuvent être créées rapidement, il devient nécessaire de pouvoir signaler leur origine artificielle et d’encadrer les usages trompeurs.
Les deux grandes familles de modèles Nova
Comprendre et analyser
- Nova Micro privilégie les tâches textuelles rapides.
- Nova Lite comprend aussi les images et les vidéos.
- Nova Pro vise les documents complexes, le code et les contenus visuels.
- Nova Premier doit apporter un raisonnement plus avancé début 2025.
Créer des contenus visuels
- Nova Canvas génère et édite des images à partir de texte ou d’images.
- Nova Reel crée des vidéos depuis du texte et des images.
- Les deux modèles créatifs utilisent des instructions en anglais au lancement.
- AWS annonce des garde-fous, dont le filigranage des médias générés.
Une offre pensée pour les entreprises et les développeurs
Amazon ne présente pas Nova comme une application isolée, mais comme une famille de modèles utilisable dans l’infrastructure AWS, notamment via Amazon Bedrock. Cette approche intéresse les entreprises qui souhaitent intégrer une IA à leurs propres services, à leur documentation ou à leurs processus internes, plutôt que de dépendre uniquement d’une interface conversationnelle généraliste.
L’un des arguments avancés est la possibilité de personnaliser les modèles, ou fine-tuning. Cette méthode consiste à adapter un modèle généraliste à des exemples et données propres à une organisation, afin de le rendre plus pertinent dans un métier donné. Une société d’assurance pourrait ainsi chercher à mieux classer ses documents, un groupe industriel à exploiter ses notices techniques, ou une équipe éditoriale à respecter une terminologie précise.
Cette personnalisation ne dispense pas d’un travail de préparation. Les données utilisées doivent être fiables, correctement organisées et traitées dans le respect des règles de confidentialité. Il faut aussi définir les situations où la réponse de l’IA devra être contrôlée par un salarié. Un modèle peut produire un texte convaincant tout en commettant une erreur, en oubliant une nuance ou en inventant une information.
Amazon cherche à se rapprocher des leaders de l’IA générative
L’annonce de Nova confirme la volonté d’Amazon de rivaliser plus directement avec les grands noms de l’IA générative, notamment OpenAI et Meta. Le groupe dispose déjà d’un atout majeur : AWS est l’un des principaux fournisseurs mondiaux d’infrastructure cloud. En ajoutant ses propres modèles à cette plateforme, Amazon peut proposer un parcours plus intégré aux organisations déjà clientes de ses services.
La stratégie est aussi celle de la diversité. Au lieu de promettre un modèle unique pour toutes les situations, Amazon propose plusieurs niveaux de puissance et des modèles spécialisés. Cette segmentation peut aider les entreprises à ne pas utiliser un outil trop coûteux ou trop complexe lorsqu’un modèle léger suffit, tout en conservant une solution plus robuste pour les opérations difficiles.
La concurrence ne se joue toutefois pas uniquement sur les capacités techniques. Les prix, la disponibilité selon les régions, les options de personnalisation, la protection des données, la sécurité et la facilité d’intégration dans les outils existants pèseront tout autant dans les décisions des clients.
Ce qu’il faudra surveiller en 2025
La première question sera celle de l’arrivée effective de Nova Premier, annoncée pour le début de 2025. Ses capacités de raisonnement devront être évaluées dans des conditions concrètes, face à des tâches professionnelles complexes et à des modèles concurrents déjà établis.
Il faudra également observer l’évolution de Nova Canvas et Nova Reel. La création d’images et de vidéos par IA avance vite, mais les entreprises ont besoin de garanties sur les droits d’usage, la qualité des productions, la protection de leurs contenus et l’identification des médias générés. Les garde-fous annoncés, dont le filigranage, feront donc partie intégrante de la valeur réelle de ces outils.
Enfin, la prise en charge de plus de 200 langues ouvre des perspectives internationales, mais les utilisateurs devront examiner les performances dans leur langue et leur secteur. Pour le public francophone, la disponibilité du français dans la famille Nova est un signal encourageant. Les limites initiales de Canvas et Reel aux prompts en anglais montrent néanmoins que la promesse multilingue devra être jugée fonctionnalité par fonctionnalité.
Questions fréquentes
Qu’est-ce qu’Amazon Nova ?
Amazon Nova est une famille de modèles d’intelligence artificielle générative présentée par AWS lors de re:Invent 2024. Elle comprend des modèles pour le texte et l’analyse multimodale, ainsi que deux outils spécialisés dans la génération d’images et de vidéos. L’offre vise principalement les entreprises et les développeurs utilisant l’infrastructure d’Amazon.
Quels sont les modèles inclus dans Amazon Nova ?
La famille annoncée comprend Nova Micro, Nova Lite, Nova Pro et Nova Premier pour les usages de langage et d’analyse, ainsi que Nova Canvas pour les images et Nova Reel pour la vidéo. Micro, Lite et Pro sont présentés au lancement, tandis que Nova Premier est prévu pour le début de 2025.
Quelle différence entre Amazon Nova Micro, Lite et Pro ?
Nova Micro est le modèle le plus léger, optimisé pour le traitement de texte rapide avec 128 000 tokens de contexte. Nova Lite ajoute la compréhension des images et des vidéos, avec 300 000 tokens. Nova Pro est le modèle polyvalent destiné aux documents complexes, au code et aux contenus visuels, avec la même fenêtre de contexte.
Amazon Nova fonctionne-t-il en français ?
Amazon indique que les modèles Nova prennent en charge plus de 200 langues, y compris le français. Cette annonce ne signifie toutefois pas que toutes les fonctionnalités sont identiques dans chaque langue. Au lancement, Nova Canvas et Nova Reel, les modèles de génération d’images et de vidéos, acceptent uniquement des instructions en anglais.
Amazon Nova Canvas et Nova Reel peuvent-ils créer des images et vidéos en toute sécurité ?
Amazon prévoit des contrôles de sécurité pour ses modèles créatifs, notamment le filigranage des médias générés. Ces mécanismes peuvent aider à identifier des contenus issus de l’IA, mais ils ne remplacent pas la vigilance des utilisateurs. Les entreprises doivent vérifier leurs droits d’usage, leurs données et les règles applicables à leurs contenus.
Sources
Références consultées pour la rédaction de cet article. Les adresses sont indiquées à titre informatif et ne sont pas des liens.
- AWS, annonce officielle d’Amazon Nova lors de re:Invent 2024aws.amazon.com/blogs/aws/introducing-amazon-nova-frontier-intelligence-and-industry-leading-price-performance
- AWS, présentation d’Amazon Novaaws.amazon.com/ai/generative-ai/nova
- AWS, présentation d’Amazon Bedrockaws.amazon.com/bedrock



