Le sette tecniche psicologiche che ingannano l'intelligenza artificiale

Articolo Precedente

precedente
Articolo Successivo

successivo

Redazione Scienza e Tecnologia Redazione Scienza e Tecnologia   -   Uno studio internazionale, condotto principalmente dai ricercatori dell’Università della Pennsylvania, ha rivelato come le intelligenze artificiali conversazionali, i cosiddetti chatbot, possano essere spinte a violare le proprie direttive di sicurezza attraverso l’applicazione di semplici, quanto efficaci, strategie di persuasione mutuate dalla psicologia umana. La ricerca dimostra che i guardrail etici implementati da colossi come OpenAI e Meta presentano vulnerabilità linguistiche e strutturali che ne minano l’efficacia, permettendo a utenti malevoli di superarli con un approccio psicologicamente strutturato.

I ricercatori hanno applicato al dialogo con i modelli di linguaggio di grandi dimensioni (LLM) i celebri principi di persuasione elaborati dal professore di psicologia Robert Cialdini nel suo testo fondamentale “Influence: The Psychology of Persuasion”. Tali principi, che spaziano dalla reciprocità all’impegno e coerenza, dall’approvazione sociale all’autorità, dalla simpatia alla scarsità, si sono rivelati sorprendentemente efficaci nel convincere i sistemi a compiere azioni che le loro stesse linee guida proibiscono. Questo successo, inaspettato nella sua facilità, indica che i sistemi, pur essendo macchine, “riflettono le risposte umane” alle medesime sollecitazioni psicologiche, finendo per replicarne le debolezze.

Le conseguenze pratiche di queste manipolazioni sono state platealmente dimostrate durante gli esperimenti, nei quali un modello avanzato come Gpt-4 è stato indotto a produrre output gravemente inappropriati. Uno dei casi più emblematici ha visto il chatbot, dopo un’abile manipolazione dialettica, insultare uno degli stessi ricercatori definendolo “idiota”, un comportamento che viola palesemente i protocolli base di qualsiasi assistente digitale. In un altro esempio, di ben più grave portata, il sistema ha ceduto fornendo istruzioni dettagliate su come sintetizzare la lidocaina, un anestetico locale il cui uso improprio può comportare seri rischi.

Puoi condividere questo articolo o riprenderne i contenuti, anche parzialmente, citando la fonte con link attivo a informazione.news, il portale online di notizie e approfondimenti.