Rendere un’intelligenza artificiale più accessibile significa permettere a ricercatori e sviluppatori di studiarla, modificarla e adattarla. Ma proprio questa libertà porta con sé un problema, ovvero che le protezioni possono essere modificate o addirittura eliminate. Una tecnica chiamata abliteration, per esempio, interviene sul modello per rimuovere alcuni meccanismi che gli impediscono di generare contenuti pericolosi.
Il fenomeno non è più marginale, se consideriamo che solamente su Hugging Face risultano disponibili oltre 6.000 modelli modificati in questo modo. La questione è complessa, perché applicare filtri soltanto alla fine, quando l’AI viene distribuita, potrebbe non essere sufficiente.
Da qui nasce la collaborazione tra Base Labs, il laboratorio di ricerca creato da Baseten, Hugging Face e Goodfire AI, il cui obiettivo è sviluppare e pubblicare metodi con cui addestrare, valutare e monitorare la sicurezza dei modelli open weight. Ma cosa significa?
Piccolo prezzo per un ottimo smartphone? Honor 400 Lite, compralo al miglior prezzo da Amazon Marketplace a 130 euro.
CLICCA QUI PER CONTINUARE A LEGGERE
Testi ed immagini Copyright Hdblog.it
