Sujet

Sécurité de l’IA · page 2

Tous les articles d’Actu.ai consacrés à Sécurité de l’IA : actualités, analyses et explications sur ce sujet lié à l’intelligence artificielle. 91 articles

Meta renforce la sécurité de Llama avec de nouveaux outils de défense

Meta dévoile une série d’outils destinés à mieux protéger les modèles Llama et les applications qui les utilisent. Filtres pour le texte et l’image, défense contre les injections de prompts, évaluation des cyberdéfenses, détection de voix synthétiques : l’entreprise veut couvrir plusieurs maillons de la sécurité de l’IA.

10 min

Zizians : ce que l’on sait du groupe lié à plusieurs affaires criminelles aux États-Unis

Les Zizians sont un petit groupe américain gravitant autour de Jack LaSota, dite Ziz, et de communautés en ligne préoccupées par l’éthique, les animaux et l’intelligence artificielle. Plusieurs personnes présentées comme proches du mouvement ont été impliquées dans de graves affaires criminelles aux États-Unis. Voici ce que les éléments connus permettent, et ne permettent pas, d’affirmer au 2 mars 2025.

8 min

Les énigmes façon Indiana Jones soulignent les limites persistantes des LLM

Les scénarios d’évasion inspirés d’Indiana Jones offrent une image parlante des difficultés rencontrées par les grands modèles de langage. Face à des indices ambigus, des consignes contradictoires ou des instructions dissimulées, ces outils peuvent produire des réponses imprévisibles. Une limite importante pour évaluer leur fiabilité, surtout dans les usages sensibles.

8 min

Claude : les classificateurs constitutionnels font chuter les jailbreaks

Anthropic présente les classificateurs constitutionnels, une couche de sécurité conçue pour empêcher les utilisateurs de contourner les garde-fous des chatbots. Lors de tests sur Claude 3.5 Sonnet, le taux de réussite des jailbreaks est passé de 86 % à 4,4 %. Une avancée prometteuse, qui ne signifie pas pour autant la fin des attaques.

8 min