Lucene search
+L

3 matches found

Kitploit
Kitploit
•added 2026/10/01 2:12 p.m.•18 views

bloom

Bloom: Evaluaciones Automatizadas de Comportamiento para LLMs !IMPORTANT Bloom tiene un nuevo hogar. Ahora es desarrollado y mantenido por Meridian Labs y vive en meridianlabs-ai.github.io/petribloom — todas las nuevas funcionalidades y correcciones llegarán allí. Este repositorio está congelado ...

6.3AI score
SaveExploits0References1
Kitploit
Kitploit
•added 2026/09/26 12:44 a.m.•8 views

RLCDAlignBench

Just Ask Jev: Aprendizaje por Refuerzo para Decisiones Calibradas como Detector Zero-Shot de Fallos de Alineación de IA Este repositorio contiene RLCDAlignBench y el código detrás del artículo. El benchmark mide si un detector puede distinguir cuándo la salida de un modelo de lenguaje es un fallo...

6.3AI score
SaveExploits0References13
Packet Storm News
Packet Storm News
•added 2025/05/26 12:00 a.m.•19 views

Phare: a Safety Probe for Large Language Models

Ensuring the safety of large language models LLMs is critical for responsible deployment, yet existing evaluations often prioritize performance over identifying failure modes. We introduce Phare, a multilingual diagnostic framework to probe and evaluate LLM behavior across three critical...

7.4AI score
SaveExploits0
Rows per page
Query Builder