Sécurité des IA : préserver les garde-fous après la réduction des modèles
Faire fonctionner une IA sur un appareil peu puissant impose souvent d’alléger son architecture. Mais retirer certaines couches peut aussi faire disparaître ses garde-fous. Des chercheurs de l’Université de Californie, Riverside, proposent une méthode de réentraînement pour que les modèles conservent leurs réflexes de sécurité après cette compression.





