1 matches found
AutoRAN-public
๐ง AutoRAN: dirottamento automatizzato del ragionamento di sicurezza nei Large Reasoning Models AutoRAN รจ un hijacking automatizzato del ragionamento di sicurezza che sfrutta modelli ausiliari secondari meno allineati per simulare tracce di ragionamento, generare prompt narrativi e rifinire...
5.4AI score
SaveExploits0
20