Le benchmark Jailbreak v1.0 évalue les performances des modèles d'apprentissage automatique.
MLCommons a publié les résultats de son benchmark Jailbreak v1.0, soulignant des erreurs de jugement dans l'évaluation des modèles d'apprentissage automatique. Cette publication ouvre la voie à une amélioration des standards de performance en IA.