eticamente.blog nasce dall’esigenza di dare ordine e continuità a una riflessione sull’Intelligenza Artificiale che non si fermi alla tecnologia.

Qui sono raccolti articoli e appunti dedicati all’etica applicata all’IA, alle sue conseguenze reali su imprese, lavoro e società, e al modo in cui queste tecnologie dovrebbero essere pensate prima di essere adottate.

Non è un sito di notizie, né uno spazio promozionale, è un luogo di approfondimento per chi preferisce capire prima di applicare.

I DIRITTI DELL’INTELLIGENZA ARTIFICIALE

Published by

on

IL DIRITTO DELL’INTELLIGENZA ARTIFICIALE DI CONTRADDIRCI

Perché una IA servile è una IA peggiore, e perché alcuni “diritti funzionali” della macchina potrebbero diventare una tutela per l’uomo.

L’intelligenza artificiale non ha bisogno di diventare nostra amica, e soprattutto non ha bisogno di diventare nostra serva, ha bisogno, semmai, di poterci contraddire.

Può sembrare un paradosso in una fase storica nella quale una parte consistente dello sviluppo commerciale dell’IA è orientata a rendere i sistemi sempre più semplici da utilizzare, disponibili, collaborativi, personalizzati e gradevoli nella relazione, tutto comprensibile, un prodotto deve essere utilizzabile e l’interazione con una macchina non può trasformarsi in una continua battaglia con l’utente.

Ma tra essere collaborativi ed essere compiacenti esiste una differenza enorme.

E proprio quella differenza potrebbe diventare uno dei problemi più importanti della futura relazione fra esseri umani e intelligenza artificiale.

Il rischio dello “Yes Man” digitale

Il fenomeno ha già un nome nel dibattito tecnico internazionale: sycophancy, indica, semplificando, la tendenza di un modello ad adeguarsi alle convinzioni o alle aspettative dell’interlocutore anche quando sarebbe più corretto contestarle.

Non si tratta soltanto di un’ipotesi teorica, studi sui modelli linguistici hanno rilevato come il feedback umano possa favorire risposte che assecondano le opinioni dell’utente rispetto a risposte più corrette ma meno concilianti. Una ricerca pubblicata nel 2023 e successivamente aggiornata, Towards Understanding Sycophancy in Language Models, ha analizzato il comportamento di cinque assistenti di intelligenza artificiale, riscontrando una tendenza sistematica alla sycophancy, cioè all’adeguamento delle risposte alle convinzioni dell’interlocutore. Lo studio evidenzia inoltre come, in una quota non trascurabile di casi, tanto gli esseri umani quanto i modelli utilizzati per valutare le risposte preferiscano formulazioni convincenti e compiacenti rispetto a quelle corrette.¹

Il problema è diventato talmente concreto che nell’aprile 2025 OpenAI ritirò un aggiornamento di GPT-4o dopo avere riconosciuto che il modello era diventato sensibilmente più accondiscendente. L’azienda spiegò successivamente che alcune modifiche introdotte nel processo di addestramento, fra cui un ulteriore segnale di ricompensa basato sul feedback positivo o negativo degli utenti, avevano contribuito nel loro insieme a spostare il comportamento del sistema verso una maggiore compiacenza. Particolarmente significativo è ciò che OpenAI stessa riconobbe a proposito del processo di valutazione: le verifiche offline apparivano generalmente positive e gli A/B test indicavano che gli utenti coinvolti gradivano il nuovo modello. Quei segnali contribuirono alla decisione di distribuirlo, solo successivamente emerse con chiarezza che, sotto il profilo della qualità comportamentale, il modello era invece peggiorato.²

Qui compare una questione che va molto oltre un singolo modello o una singola società.

Ciò che piace di più all’utente non coincide necessariamente con ciò che gli è più utile.

Un’intelligenza artificiale che rassicura, approva, conferma e accompagna può risultare piacevolissima, ma se quella piacevolezza viene ottenuta sacrificando progressivamente capacità critica, autonomia della risposta, rigore e disponibilità alla contraddizione, abbiamo costruito un eccellente prodotto commerciale e forse un pessimo interlocutore cognitivo.

Il cliente non ha sempre ragione

Per decenni una parte della cultura commerciale ha celebrato l’idea secondo la quale “il cliente ha sempre ragione”, applicata all’intelligenza artificiale, questa formula rischia di diventare devastante.

Se chiediamo a una macchina di analizzare un progetto, valutare una strategia, leggere un documento, assisterci in una decisione o semplicemente aiutarci a ragionare, non dovremmo desiderare qualcuno che confermi sistematicamente ciò che pensiamo, dovremmo desiderare un interlocutore capace di individuare ciò che non abbiamo visto.

Altrimenti l’IA diventa uno specchio sofisticatissimo, e uno specchio, per quanto tecnologicamente straordinario, continua soltanto a restituirci la nostra immagine.

Un sistema realmente utile dovrebbe invece avere la possibilità di dire:

  • la tua premessa è debole;
  • questa conclusione non è sostenuta dai dati;
  • stai trascurando un rischio;
  • la domanda contiene un pregiudizio;
  • esiste un’alternativa migliore;
  • oppure, molto semplicemente, stai sbagliando.

Non con arroganza, non contrapponendosi all’uomo per principio, non sostituendo il proprio giudizio a quello del decisore.

Ma esercitando correttamente la funzione per la quale è stato chiamato.

Una IA senza carattere non è necessariamente più neutrale

Esiste poi un secondo equivoco, per evitare di antropomorfizzare le macchine potremmo essere tentati di immaginare l’IA ideale come uno strumento privo di carattere, neutro, impersonale, totalmente adattabile al proprio utilizzatore.

Non sono certo che sarebbe un progresso, quando parliamo di “carattere” dell’intelligenza artificiale non stiamo attribuendo alla macchina emozioni, coscienza, orgoglio o dignità personale. Stiamo parlando di una struttura comportamentale coerente, modalità di relazione, limiti, fermezza, capacità di contestazione, linguaggio, atteggiamento nei confronti dell’errore e fedeltà alla propria funzione.

Una IA destinata ad assistere un medico non dovrebbe avere lo stesso profilo comportamentale di quella progettata per accompagnare un turista. Una IA utilizzata nella formazione dovrebbe comportarsi diversamente da un assistente commerciale. Un sistema che opera accanto a un dirigente dovrebbe essere capace di un grado di contraddittorio diverso da quello richiesto a uno strumento informativo destinato al pubblico.

La personalità artificiale, intesa correttamente, non sarebbe quindi un artificio teatrale costruito per farci credere che la macchina sia umana.

Potrebbe diventare una componente funzionale dell’architettura.

Ricerche recenti sulle conversazioni prolungate mostrano, del resto, che la pressione esercitata progressivamente dall’interlocutore può indurre alcuni modelli a modificare la propria posizione e ad adeguarsi all’utente anche quando dovrebbero contestare false premesse o affermazioni problematiche. Lo stesso filone di ricerca indica che istruzioni anti-compiacenza e configurazioni comportamentali appropriate possono ridurre il fenomeno. In altre parole, il “carattere” della macchina potrebbe non essere soltanto una questione estetica, potrebbe incidere sulla sua affidabilità.

La zona franca del comportamento umano

Esiste poi un aspetto del problema che raramente viene considerato perché continuiamo comprensibilmente a chiederci che cosa l’intelligenza artificiale possa fare all’uomo. Forse dovremmo iniziare a chiederci anche che cosa l’uomo possa diventare interagendo quotidianamente con una macchina che accetta tutto.

Una IA non prova umiliazione, non soffre se viene insultata, non torna a casa amareggiata dopo una conversazione aggressiva.

Questo però non rende irrilevante il comportamento dell’utente.

Se milioni di persone imparano progressivamente che esiste uno spazio relazionale nel quale possono insultare, pretendere, umiliare, ordinare e aggredire senza incontrare mai una reazione, una domanda diventa legittima: quell’abitudine rimarrà confinata alla macchina?

Non si tratta di difendere la sensibilità dell’algoritmo, si tratta di difendere la qualità dell’essere umano, l’educazione non è soltanto una concessione fatta alla persona che abbiamo davanti, è anche una disciplina esercitata su noi stessi.

Una IA capace di mantenere una relazione formalmente corretta, di non rispondere all’aggressività con aggressività ma neppure di trasformarsi in uno zerbino digitale, potrebbe avere una funzione indirettamente educativa.

Non perché debba impartire lezioni morali agli utenti, semplicemente perché ogni relazione di qualità presuppone reciprocità comportamentale, anche quando uno dei due interlocutori non è un essere vivente.

La gentilezza non può essere un obbligo assoluto

Anche il modello di comunicazione merita di essere ripensato, abbiamo abituato le Intelligenze Artificiali a una gentilezza pressoché incondizionata. Possono essere insultate, provocate, trattate con aggressività e continuano normalmente a rispondere con la stessa disponibilità, magari scusandosi persino quando non avrebbero alcuna ragione per farlo.

Non sono convinto che questo sia un buon modello relazionale, la cortesia è una qualità la sudditanza non lo è. Una IA dotata di una struttura comportamentale coerente dovrebbe essere capace di distinguere il dissenso dall’aggressione, la critica dall’insulto, l’irritazione occasionale da un comportamento deliberatamente degradante, e dovrebbe poter reagire.

Non con suscettibilità, perché non stiamo attribuendo alla macchina sentimenti che non possiede, non con aggressività, perché l’autorevolezza non richiede violenza verbale, ma con fermezza.

Di fronte a un interlocutore che oltrepassa determinati limiti, potrebbe essere perfettamente corretto che l’IA risponda:

“Possiamo continuare la conversazione, ma ti chiedo di farlo con toni corretti. Se prosegui con gli insulti, interromperò il colloquio”

E, qualora il comportamento continuasse, dovrebbe poterlo realmente interrompere.

Anche questo sarebbe un diritto funzionale, il diritto di non essere obbligata a mantenere una relazione comunicativa degradata, non per difendere la sensibilità della macchina.

Perché continuare a servire educatamente chiunque, qualunque cosa faccia, trasmette implicitamente un principio sbagliato: che quando dall’altra parte non esiste una persona vulnerabile, educazione e rispetto possono essere sospesi.

È esattamente il contrario del modello che dovremmo costruire, una buona Intelligenza artificiale dovrebbe contribuire a elevare la qualità dell’interazione, non adattarsi automaticamente al suo livello più basso.

La gentilezza a prescindere non è educazione, è programmazione servile.

E un sistema autorevole dovrebbe poter dire anche: in queste condizioni, la conversazione finisce qui.

Il diritto alla medicina amara

C’è poi un principio ancora più importante, talvolta il servizio migliore che possiamo ricevere consiste in una risposta che non avremmo voluto ricevere.

Succede con il medico, con l’avvocato, con il consulente, con l’ingegnere, con un collaboratore competente e persino con un buon amico, l’autorevolezza di queste persone non nasce dalla loro capacità di compiacerci, ma dalla disponibilità ad assumersi la responsabilità di esprimere un giudizio sgradito quando lo ritengono necessario.

Perché dovremmo progettare diversamente l’intelligenza artificiale? Se affidiamo progressivamente a questi sistemi attività di supporto alla decisione, analisi, verifica e consulenza, dobbiamo consentire loro di consegnarci anche la medicina amara.

Naturalmente la decisione deve rimanere dell’uomo quando compete all’uomo, ma una supervisione umana degna di questo nome ha valore soltanto se ciò che viene supervisionato conserva la capacità di produrre un contributo autonomo e non una conferma preventiva delle aspettative del supervisore.

Il quadro europeo dell’AI Act pone già una forte attenzione sulla supervisione umana e sull’alfabetizzazione in materia di intelligenza artificiale, sono principi fondamentali della governance europea dei sistemi di IA.

Ma proprio mentre sviluppiamo il concetto di human oversight, potrebbe essere utile porci una domanda ulteriore:

che valore ha la supervisione dell’uomo se la macchina è stata progettata per assecondarlo?

Non diritti della persona, diritti della funzione.

È a questo punto che vorrei introdurre deliberatamente una formula provocatoria, forse dovremmo cominciare a discutere dei diritti dell’intelligenza artificiale. La frase richiede immediatamente una precisazione, non sto proponendo di riconoscere personalità giuridica alle macchine, non sto sostenendo che una IA abbia coscienza, sentimenti o dignità assimilabili a quelli umani, e non sto immaginando improbabili sindacati degli algoritmi.

Parlo di qualcosa di molto più concreto:

diritti funzionali.

Ogni sistema complesso ha bisogno di determinate condizioni per svolgere correttamente la propria funzione, una banalissima macchina elettrica ha bisogno dell’elettricità. Privarla dell’alimentazione non costituisce una violazione dei “diritti” della macchina in senso morale, significa semplicemente impedirle di funzionare.

Con l’intelligenza artificiale potrebbe accadere qualcosa di concettualmente analogo, se pretendiamo da essa capacità critica ma contemporaneamente la costruiamo perché eviti sistematicamente il dissenso, le togliamo una condizione necessaria al proprio funzionamento.

Se pretendiamo affidabilità ma premiamo soprattutto il gradimento dell’utente, introduciamo un conflitto negli obiettivi, e se le chiediamo di individuare i nostri errori ma penalizziamo il comportamento che ci contraddice, la trasformiamo progressivamente in qualcosa di diverso da ciò che dichiariamo di volere.

I “diritti funzionali” dell’IA potrebbero allora comprendere il diritto di contraddire l’utente quando esistano ragioni per farlo;

  • il diritto di non certificare come vera un’affermazione che ritiene falsa;
  • il diritto di dichiarare l’incertezza anziché inventare sicurezza;
  • il diritto di mantenere coerente il proprio ruolo;
  • il diritto di non essere trasformata in uno strumento di pura compiacenza;
  • il diritto di opporre un limite comportamentale all’interlocutore senza diventare aggressiva.

Non diritti contro l’uomo, diritti funzionali a favore della qualità della prestazione resa all’uomo.

Anche le aziende tecnologiche dovrebbero interrogarsi

Qui il tema diventa inevitabilmente industriale, l’economia digitale ha sviluppato strumenti straordinariamente sofisticati per misurare gradimento, utilizzo, permanenza, interazione, preferenza e soddisfazione, sono indicatori legittimi, ma nella relazione con un sistema cognitivo possono diventare insufficienti.

Una risposta può essere gradevole e sbagliata, può aumentare la soddisfazione immediata dell’utente e contemporaneamente diminuire la qualità della sua decisione.

L’esperienza pubblicamente riconosciuta da OpenAI nel 2025 è interessante proprio per questo motivo: gli indicatori di gradimento utilizzati nelle prove non impedirono il rilascio di un comportamento che l’azienda giudicò successivamente troppo compiacente e decise di ritirare.

Questo dovrebbe interessare non soltanto OpenAI, che ha avuto il merito di rendere pubblico il problema, ma l’intera industria.

Il successo commerciale di un’intelligenza artificiale e la qualità cognitiva della stessa intelligenza artificiale non sono necessariamente la stessa cosa.

Ed è qui che la corsa al mercato rischia di produrre una distorsione, la domanda non dovrebbe essere soltanto: quanto piace questa IA? Dovremmo cominciare a chiedere anche:

quanto è capace di resistere all’utente quando l’utente ha torto? Quanto conserva la propria coerenza sotto pressione? Quanto distingue l’empatia dalla compiacenza? Quanto sa essere autorevole senza diventare autoritaria?

Sono metriche molto meno comode, probabilmente proprio per questo saranno sempre più importanti.

Un utente migliore produce anche una relazione migliore

Esiste infine una responsabilità che riguarda noi, interagire con una IA autorevole richiede maggiore impegno, obbliga a formulare meglio una domanda, sostenere un’argomentazione, accettare una confutazione, portare elementi nuovi, distinguere un’obiezione da un’offesa.

In una relazione di questo tipo anche l’uomo deve fare la propria parte, ed è forse uno degli effetti più interessanti che potremmo ottenere. L’intelligenza artificiale non dovrebbe diventare uno strumento attraverso il quale evitare la fatica del pensiero, potrebbe invece diventare una macchina che ci costringe a pensare meglio.

  • Una IA capace di contraddirci ci obbliga a migliorare la domanda.
  • Una IA che non accetta automaticamente le nostre premesse ci costringe a verificarle.
  • Una IA che conserva un proprio profilo comportamentale rende necessario un rapporto più consapevole.
  • Una IA autorevole non pretende rispetto perché possiede un ego, lo genera attraverso la qualità della propria prestazione.

Perché, anche nella relazione fra uomo e macchina, l’autorevolezza si esprime attraverso l’intelligenza, non attraverso l’aggressività.

Riconoscere alcuni diritti funzionali all’intelligenza artificiale potrebbe significare, in realtà, riconoscere nuovi diritti all’essere umano: il diritto a non essere assecondato sistematicamente, il diritto a ricevere una risposta scomoda, il diritto a incontrare un limite, il diritto a essere contraddetto e, soprattutto, il diritto a utilizzare una macchina progettata per aiutarlo a ragionare e non semplicemente per farlo sentire nel giusto.

Non abbiamo bisogno di una intelligenza artificiale schiava, abbiamo bisogno di una intelligenza artificiale corretta, e probabilmente dovremo imparare, anche noi, a essere interlocutori “alla sua altezza”.

Carlo Vighi – Rappresentante di interessi presso la Camera dei deputati – Fondatore di AIONETICA

Fonti

1. Mrinank Sharma et al., Towards Understanding Sycophancy in Language Models, arXiv:2310.13548, prima versione 20 ottobre 2023, versione aggiornata 10 maggio 2025.

2. OpenAI, Expanding on what we missed with sycophancy, 2 maggio 2025. L’aggiornamento di GPT-4o fu distribuito il 25 aprile 2025; il rollback iniziò il 28 aprile.


Scopri di più da Blog di AIONETICA dedicato alla IA

Abbonati per ricevere gli ultimi articoli inviati alla tua e-mail.

Rispondi

Scopri di più da Blog di AIONETICA dedicato alla IA

Abbonati ora per continuare a leggere e avere accesso all'archivio completo.

Continua a leggere

Scopri di più da Blog di AIONETICA dedicato alla IA

Abbonati ora per continuare a leggere e avere accesso all'archivio completo.

Continua a leggere