CyberSecEval 2: Un Marco Integral para Evaluar la Ciberseguridad de los Modelos de Lenguaje Grandes
El lanzamiento de CyberSecEval 2 marca la disponibilidad de una estructura de evaluación diseñada para analizar los riesgos y capacidades de ciberseguridad inherentes a los modelos de lenguaje grandes (LLM). Este marco tiene como objetivo proporcionar una metodología comprensiva para que desarrolladores e investigadores puedan medir de forma rigurosa cómo los LLM se comportan ante…







