Cyber-IA : faut-il évaluer l'agent ou son livrable ?
Contenu de l'épisode
Mesurer la capacité d'une IA à la qualité d'un rapport ou d'un code fourni en sortie devient une impasse. Un prototype de ver informatique fonctionnant en local sur un simple GPU vient d'atteindre 37 % de réussite sur une attaque autonome complète. Cet épisode décortique pourquoi la sécurité des systèmes doit d'urgence passer de l'inspection de livrables à l'évaluation des chaînes d'exécution autonomes.
#cybersec #meta-volatile #agents #securite