Illustrazione editoriale realizzata con intelligenza artificiale: un documento giudiziario con evidenziata la frase attribuita al chatbot.
Una risposta riconducibile a un assistente AI è rimasta in una sentenza della Corte di giustizia tributaria di Palermo. Il caso porta al centro il tema del controllo umano sugli output dell’intelligenza artificiale, della verifica delle fonti e della responsabilità di chi utilizza questi strumenti nelle decisioni professionali.
Una frase rimasta per errore dentro una sentenza ha reso visibile qualcosa che, senza quella svista, probabilmente sarebbe rimasto nascosto.
Nella sentenza n. 981 della Sezione 11 della Corte di giustizia tributaria di primo grado di Palermo, decisa il 13 febbraio e depositata il 17 febbraio 2026, tra la ricostruzione del processo e i motivi della decisione compare un passaggio estraneo al linguaggio di un provvedimento giudiziario: «Perfetto. Ho eliminato duplicazioni, snellito le parti ridondanti». Il messaggio prosegue spiegando di avere accorpato alcuni passaggi, armonizzato i raccordi logici e sistemato la parte finale, prima di presentare il testo come pronto per essere inserito nella sentenza.
La vicenda, emersa sulla stampa nazionale e successivamente ripresa da diverse testate, ha attirato l’attenzione soprattutto per il copia e incolla rimasto nel documento definitivo. Ma il tema più rilevante è un altro: quanto può intervenire un sistema di intelligenza artificiale nella preparazione di un testo di cui resta responsabile una persona?
La sentenza riguarda un ricorso contro Agenzia delle Entrate-Riscossione relativo a un preavviso di fermo amministrativo. Il testo pubblicato documenta che un output riconducibile a un assistente generativo è arrivato fino alla versione definitiva del provvedimento e descrive operazioni di riorganizzazione, eliminazione di ripetizioni e raccordo tra diversi passaggi.
Non sappiamo invece quale sistema sia stato utilizzato, quale istruzione gli sia stata impartita, quali contenuti gli siano stati forniti e quale porzione del documento finale derivi dal suo intervento. Non ci sono quindi elementi sufficienti per sostenere che l’intelligenza artificiale abbia deciso la controversia o scritto autonomamente l’intera sentenza.
Correggere un refuso o migliorare una frase non equivale a selezionare gli argomenti da mantenere, stabilire quali parti siano ridondanti o riorganizzare la struttura logica di una motivazione. Sono attività diverse e, quando riguardano un provvedimento giudiziario, il confine tra intervento formale e intervento sul contenuto può diventare sottile.
La frase dimenticata è quindi l’elemento più visibile della vicenda. Non necessariamente quello più importante.
Il messaggio rimasto nella sentenza è un errore facile da riconoscere proprio perché evidente. Il problema diventa più difficile quando l’intervento dell’AI produce invece un testo corretto nella forma, plausibile e coerente.
Un sistema può sintetizzare molte informazioni correttamente e ometterne una decisiva. Può riportare una fonte realmente esistente ma isolarne un passaggio dal contesto. Può organizzare informazioni vere modificando il peso che assumono nel ragionamento finale.
Non si tratta soltanto delle cosiddette allucinazioni, nelle quali un modello può generare informazioni inesatte o riferimenti inesistenti. Nell’uso professionale esiste un rischio meno appariscente: la fonte può essere autentica e il problema trovarsi nella sua interpretazione.
È un aspetto che le stesse linee guida del Consiglio di Presidenza della Giustizia Tributaria affrontano espressamente. Il documento ricorda che gli output dei sistemi generativi sono probabilistici, che non esiste una garanzia uniforme sulla loro affidabilità e che deve sempre esserci una verifica umana su accuratezza, completezza e pertinenza delle risposte, confrontandole con fonti attendibili e normative aggiornate.
Un passaggio della decisione di Palermo rende particolarmente concreto questo problema.
La sentenza richiama l’ordinanza n. 32062 del 12 dicembre 2024 della Corte di Cassazione e riporta il principio secondo cui, in materia di fermo amministrativo, sarebbe irrilevante una notevole sproporzione tra il valore della sanzione e quello del bene sottoposto alla misura.
La frase esiste realmente nell’ordinanza della Corte di Cassazione. Al punto 4.2 la Corte richiama infatti un proprio precedente orientamento. Subito dopo, però, al punto 4.3, il Collegio afferma di non aderire a quelle conclusioni e introduce la necessità di valutare la proporzionalità tra lo strumento utilizzato dal creditore e il sacrificio imposto al debitore. Nel caso concreto, la Corte conclude poi che non vi fosse una sproporzione evidente.
Anche la sentenza di Palermo, immediatamente dopo il richiamo alla pronuncia, precisa che l’azione amministrativa deve rispettare i principi di ragionevolezza e proporzionalità e conclude che, nel caso esaminato, non emergeva un’evidente sproporzione tra credito e misura adottata.
Non ci sono quindi elementi sufficienti per attribuire al chatbot un’errata lettura della Corte di Cassazione. Non conosciamo il prompt, l’output completo né la parte del testo effettivamente elaborata dal sistema.
Il passaggio offre però un esempio utile di un problema più generale: verificare che una fonte esista non basta. Occorre verificare anche che cosa quella fonte stia realmente dicendo nel suo contesto.
La cronologia è importante.
Quando la Corte di giustizia tributaria di primo grado di Palermo ha deciso la causa, il 13 febbraio 2026, la legge italiana n. 132 del 23 settembre 2025 sull’intelligenza artificiale era già in vigore dal 10 ottobre 2025. L’articolo 15 stabilisce che, nei casi di utilizzo dell’AI nell’attività giudiziaria, restano riservate al magistrato le decisioni sull’interpretazione e sull’applicazione della legge, sulla valutazione dei fatti e delle prove e sull’adozione dei provvedimenti.
Mancavano invece ancora le specifiche indicazioni operative del Consiglio di Presidenza della Giustizia Tributaria. La delibera n. 275/2026 è stata approvata il 3 marzo, due settimane dopo il deposito della sentenza.
Il documento delimita in maniera netta l’impiego dell’intelligenza artificiale nella giustizia tributaria. Nella fase indicata dalla delibera viene escluso l’utilizzo non autorizzato di sistemi di AI nell’attività giudiziaria in senso stretto. Le sperimentazioni devono avvenire in ambiente protetto, con anonimizzazione e tracciabilità dei dati, mentre viene esclusa l’immissione di dati sensibili contenuti negli atti processuali nei sistemi generalisti.
Le linee guida insistono soprattutto sul riesame umano. Il Consiglio di Presidenza della Giustizia Tributaria afferma che l’AI non deve sostituire il pensiero libero e critico del giudice e indica la necessità di garantire al magistrato strumenti e tempo sufficienti per controllare gli output generati. La formazione continua viene considerata parte del presidio necessario a mantenere autonomia critica e capacità di governare i limiti dello strumento.
Anche il quadro europeo presta particolare attenzione agli impieghi dell’intelligenza artificiale nell’amministrazione della giustizia.
L’Allegato III dell’AI Act comprende tra i sistemi che possono essere classificati ad alto rischio quelli destinati a essere utilizzati da un’autorità giudiziaria, o per suo conto, per assisterla nella ricerca e interpretazione dei fatti e del diritto e nell’applicazione della legge a un caso concreto.
Questo non significa che qualsiasi utilizzo di un chatbot generalista da parte di un magistrato trasformi automaticamente quel servizio in un sistema ad alto rischio. La classificazione dipende dalla finalità prevista del sistema e dalle caratteristiche del concreto utilizzo. Lo stesso AI Act contempla condizioni nelle quali determinati sistemi elencati nell’Allegato III possono non essere considerati ad alto rischio, ad esempio quando svolgono compiti procedurali limitati o preparatori senza influenzare sostanzialmente la valutazione umana.
Anche sulle scadenze è necessario distinguere. L’AI Act è entrato in vigore il 1° agosto 2024 e gran parte delle sue disposizioni è diventata applicabile il 2 agosto 2026, con diverse eccezioni. Dopo le modifiche introdotte dall’AI Omnibus, entrato in vigore il 27 luglio 2026, le regole relative ai sistemi ad alto rischio dell’Allegato III si applicheranno dal 2 dicembre 2027.
Il punto resta però chiaro anche prima della piena applicazione di quelle disposizioni: nel sistema italiano la responsabilità dell’interpretazione, della valutazione e della decisione giudiziaria resta in capo al magistrato.
La vicenda di Palermo assume particolare rilievo perché riguarda una sentenza, ma il problema che mette in evidenza non appartiene soltanto alla giustizia.
Un’impresa può chiedere all’AI di analizzare un contratto. Un professionista può utilizzarla per confrontare due norme. Un dipendente può affidarle la sintesi di una documentazione complessa. Un cittadino può chiedere a un chatbot di valutare le condizioni di una polizza o di un servizio.
In ciascuno di questi casi una parte del lavoro cognitivo viene affidata alla macchina. Non necessariamente la decisione finale, ma la selezione delle informazioni, il loro ordine, la sintesi e talvolta la rappresentazione delle alternative.
È una delega facile da sottovalutare perché l’output può apparire ordinato, documentato e convincente. Proprio questa qualità formale può ridurre la propensione a controllarlo.
Per questo la vigilanza umana non può limitarsi alla domanda più semplice: “l’AI ha inventato qualcosa?”. Occorre chiedersi anche quali informazioni abbia selezionato, quali abbia escluso, come abbia interpretato le fonti e quanto queste operazioni abbiano contribuito alla valutazione successiva.
La frase rimasta nella sentenza di Palermo ha reso visibile il passaggio dell’intelligenza artificiale. La questione più difficile comincia quando quella traccia non rimane.
L’AI può contribuire al lavoro. La responsabilità di capire, verificare e decidere resta umana.