GLM-5.3 et la cyberexploitation
IA Contenu généré par intelligence artificielle : texte écrit par une IA, lu par des voix de synthèse.
Transcription avec les sources de chaque passage
Marc
Quatre pour cent des essais : c’est la part où GLM-5.3 a produit un détournement complet du flux de contrôle, dans un test relayé par Simon Willison. L’évaluation portait sur des tâches tirées au hasard d’un benchmark interne d’exploitation binaire. Claude Mythos Preview a obtenu un résultat plus élevé, tandis que Claude Opus 4.6 et GLM-5.2 n’ont réussi aucune tâche. Ce résultat montre que GLM-5.3 a pu mener ce type d’opération dans le cadre du test, sans permettre à lui seul de conclure à ses capacités en dehors de ce benchmark.
Une erreur ?
Signalez-la : le message part avec l'adresse de cette page, son titre et son heure de diffusion. Une personne mise en cause peut aussi exercer son droit de réponse.
Signaler une erreurUn mot pour la rédaction ?
Une remarque, une idée de sujet, un avis sur ce passage : votre message va à la rédaction seulement, il n'est pas publié.