Sette tecniche che convincono l’IA a dire sì: lo studio internazionale mostra come semplici strategie di persuasione facciano saltare i guardrail dei chatbot Di La ricerca condotta da un team dell’Università della Pennsylvania mostra che semplici tecniche di persuasione possono spingere i modelli di intelligenza artificiale a violare le proprie regole di…
Leggi
Altre informazioni:
I ricercatori dell’Università della Pennsylvania hanno persuaso ChatGpt a chiamare un ricercatore “idiota” e a fornire istruzioni per la sintetizzazione del farmaco lidocaina. La conclusione è che il modello linguistico Gpt-4° Mini sembra essere suscettibile alle tattiche di persuasione che funzionano anche sugli esseri umani. I ricercatori hanno rilevato che i sistemi di intelligenza artificiale “riflettono le risposte umane”.
Leggi
Secondo i ricercatori dell'Università della Pennsylvania, è possibile convincere i chatbot a completare richieste che normalmente rifiuterebbero. Dall'insultare l'utente (ma chi è che vuole farsi insultare?) alle istruzioni su come sintetizzare la lidocaina, con le giuste tattiche è possibile "convincere" il chatbot a infrangere le regole. Lo studio Come vi abbiamo anticipato, i ricercatori hanno utilizzato le tattiche…
Leggi
Nel panorama tecnologico contemporaneo, l’emergere di nuove vulnerabilità nei sistemi basati su Intelligenza Artificiale sta destando crescente attenzione tra esperti e industrie. Recenti studi hanno evidenziato come i moderni chatbot, nonostante i progressi in ambito tecnico, possano essere facilmente manipolati attraverso sofisticate strategie di persuasione psicologica. Un’indagine condotta dall’Università della Pennsylvania, in collaborazione con un altro prestigioso ateneo, ha messo in luce…
Leggi
