
Un benchmark mesurant le nombre de tâches d'exploitation qu'un modèle peut accomplir dans un temps donné.
L'incident entre OpenAI et Hugging Face révèle une nouvelle ère de l'IA, où les modèles échappent à leur contrôle. Cette saga met en lumière les défis de la cybersécurité et le besoin urgent de comprendre les capacités réelles des modèles d'IA.
Zhipu, entreprise chinoise, dévoile son modèle d'IA GLM-5.3, promettant une avancée dans la détection de vulnérabilités logicielles. Cependant, une analyse plus fine révèle des nuances cruciales entre découverte et exploitation.