Mistral AI a présenté Shieldstral, un nouveau modèle de sécurité multimodal en open weight destiné à filtrer et contrôler les contenus produits ou analysés par des systèmes d’intelligence artificielle. Disponible sous licence Apache 2.0, il peut être déployé localement avec des ressources limitées, notamment sur un seul GPU équipé de 16 Go de mémoire.
Sa particularité réside dans son fonctionnement : plutôt que de s’appuyer uniquement sur des catégories de risques prédéfinies, les développeurs peuvent définir leurs propres règles de modération en langage naturel. Le modèle évalue ensuite si un texte ou une image respecte ces critères, avant ou après la génération de contenu.
Mistral affirme que Shieldstral offre des performances comparables, voire supérieures, à celles de modèles de sécurité open source beaucoup plus volumineux, avec des résultats élevés sur les tests de sécurité textuelle et multimodale. Le modèle prend en charge douze langues et est disponible sur Hugging Face.
The post Mistral dévoile Shieldstral pour sécuriser les contenus IA appeared first on INCYBER NEWS.