Avec Shieldstral, Mistral AI enrichit son offre de modèles ouverts avec un outil dédié à la modération et à la gouvernance des contenus générés par l'intelligence artificielle. Open source et léger, il permet aux développeurs de définir leurs propres règles de sécurité en langage naturel afin de filtrer textes et images.

Mistral AI a présenté Shieldstral, un nouveau modèle de sécurité multimodal en open weight destiné à filtrer et contrôler les contenus produits ou analysés par des systèmes d’intelligence artificielle. Disponible sous licence Apache 2.0, il peut être déployé localement avec des ressources limitées, notamment sur un seul GPU équipé de 16 Go de mémoire.

Sa particularité réside dans son fonctionnement : plutôt que de s’appuyer uniquement sur des catégories de risques prédéfinies, les développeurs peuvent définir leurs propres règles de modération en langage naturel. Le modèle évalue ensuite si un texte ou une image respecte ces critères, avant ou après la génération de contenu.

Mistral affirme que Shieldstral offre des performances comparables, voire supérieures, à celles de modèles de sécurité open source beaucoup plus volumineux, avec des résultats élevés sur les tests de sécurité textuelle et multimodale. Le modèle prend en charge douze langues et est disponible sur Hugging Face.

Restez informés en temps réel
S'inscrire à
la newsletter
En fournissant votre email vous acceptez de recevoir la newsletter de Incyber et vous avez pris connaissance de notre politique de confidentialité. Vous pourrez vous désinscrire à tout moment en cliquant sur le lien de désabonnement présent dans tous nos emails.
Restez informés en temps réel
S'inscrire à
la newsletter
En fournissant votre email vous acceptez de recevoir la newsletter de Incyber et vous avez pris connaissance de notre politique de confidentialité. Vous pourrez vous désinscrire à tout moment en cliquant sur le lien de désabonnement présent dans tous nos emails.