23 matches found
vulnrepro-benchmark
VulnRepro Un benchmark que verifica si un modelo de IA realmente puede revisar código vulnerable, o si solo suena seguro. La mayoría de los benchmarks de seguridad preguntan: ¿puede el modelo encontrar el fallo? Eso es solo la mitad del trabajo. La otra mitad, la que realmente desgasta en una...
6AI score
SaveExploits0
20