← Ultimi articoli
🤖 AI

A criterion for Artificial General Intelligence: hypothetic-deductive reasoning, tested on ChatGPT

Il documento propone il ragionamento ipotetico-deduttivo come criterio fondamentale per l'Intelligenza Artificiale Generale e dimostra, attraverso dei test, che i modelli attuali come ChatGPT possiedono solo una capacità limitata per questo tipo di ragionamento in contesti complessi.

Autori originali: Louis Vervoort, Vitaliy Mizyakov, Anastasia Ugleva

Pubblicato 2026-06-23
📖 4 min di lettura☕ Lettura da pausa caffè

Autori originali: Louis Vervoort, Vitaliy Mizyakov, Anastasia Ugleva

Articolo originale sotto licenza CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Questa è una spiegazione generata dall'IA dell'articolo qui sotto. Non è stata scritta né approvata dagli autori. Per precisione tecnica, consulta l'articolo originale. Leggi il disclaimer completo

La Grande Domanda: L'IA sta davvero "pensando"?

Immaginate di avere uno studente che ha letto ogni libro della biblioteca. Può recitare fatti, risolvere problemi matematici e scrivere saggi che suonano incredibilmente intelligenti. Ma se gli chiedete: "Come ci sei arrivato?" o "Perché succede questo?", potrebbe balbettare. Potrebbe dare la risposta corretta indovinando il pattern delle parole, ma non comprende realmente le regole dietro la risposta.

Questo articolo si chiede: ChatGPT sta davvero "pensando" o è solo un eccellente indovino?

Gli autori, Louis Vervoort e il suo team, sostengono che per essere considerata una vera "macchina pensante" (o Intelligenza Artificiale Generale, nota come AGI), un'IA debba padroneggiare una competenza specifica chiamata Ragionamento Ipotetico-Deduttivo.

Le Due Competenze Chiave

Il documento suddivide il "pensare" in due capacità principali:

1. Ragionamento Causale (Il test dei "Domino")

  • Cos'è: Capire che se spingi il primo domino, l'ultimo cade. Si tratta di sapere cosa causa cosa.
  • Il test del documento: I ricercatori hanno utilizzato "diagrammi di neuroni" (come complessi diagrammi di flusso di domino). Hanno chiesto all'IA: "Se tiro questa leva, quali altre leve si muoveranno e quali no?".
  • Il risultato: L'IA era brava con catene semplici, ma quando i domino diventavano intricati (con alcune leve che ne bloccavano altre), l'IA si confondeva. Spesso sbagliava la causa radice o la sequenza. Era come una persona che conosce la parola "causa", ma non è in grado di tracciare realmente il percorso di un domino che cade in una stanza disordinata.

2. Ragionamento Ipotetico-Deduttivo (Il test della "Ricetta")

  • Cos'è: Questo è il modo di pensare dello "Scienziato". Comporta due passaggi:
    1. Ipotizzare: Scegliere il libro delle regole (teoria) corretto per il problema.
    2. Dedurre: Seguire i passaggi di quel libro delle regole per ottenere la risposta.
  • Il test del documento: I ricercatori hanno sottoposto all'IA enigmi di fisica e logica (ad esempio: "Se spingo una fila di cubi dove uno è fatto di ghiaccio, cosa succede quando la stanza si scalda?").
  • L'arma segreta: I ricercatori non hanno solo chiesto la risposta. Hanno chiesto all'IA di elencare le regole (ipotesi) che ha usato per arrivare a quella risposta.
    • Analogia: Immaginate di chiedere a uno chef: "Come hai preparato questa zuppa?". Se risponde "Ho solo buttato dentro delle cose", potrebbe essere stato fortunato. Se dice "Ho usato la regola secondo cui il sale si scioglie nell'acqua calda e la regola secondo cui le cipolle cuociono più velocemente delle carote", allora sta effettivamente pensando.

Cosa è successo quando hanno testato ChatGPT?

I ricercatori hanno testato sia la versione precedente (ChatGPT-3.5) che la versione più recente e intelligente (ChatGPT-4).

  • Il problema del "Risposta corretta, motivo sbagliato":
    ChatGPT-4 spesso dava la risposta corretta agli enigmi. Era molto impressionante! Tuttavia, quando le veniva chiesto di elencare le regole che aveva usato, spesso inventava delle cose.

    • Esempio: In un test, l'IA ha indovinato correttamente che un secchio d'acqua si sarebbe rovesciato. Ma quando le è stato chiesto perché, ha inventato una regola falsa riguardante "camicie isolanti" che non aveva nulla a che fare con la fisica della situazione.
    • La metafora: È come uno studente che risolve il problema di matematica perché ha memorizzato il numero finale, ma quando gli viene chiesto di mostrare i passaggi, scrive una formula inventata sul momento.
  • Il Verdetto:
    Il documento conclude che, sebbene ChatGPT sia incredibile nel mimare la conversazione umana e nel risolvere problemi semplici, attualmente manca di una comprensione genuina.

    • È come un pappagallo che può dire "Il cielo è blu" perfettamente, ma non capisce perché il cielo sia blu o cosa significhi realmente "blu" in termini di fisica.
    • Quando i problemi diventavano leggermente complessi (combinando idee diverse), l'IA iniziava a fallire. Non riusciva a collegare costantemente le regole giuste alle risposte giuste.

L L'asticella dell' "AGI"

Gli autori hanno fissato un traguardo molto alto per ciò che conta come "Intelligenza Artificiale Generale" (AGI). Sostengono che un'IA non sia veramente "pensante" finché non è in grado di:

  1. Risolvere un problema.
  2. Elencare esplicitamente le regole e le teorie che ha usato per risolverlo.
  3. Farlo correttamente attraverso molti tipi diversi di problemi (non solo uno).

La Conclusione:
In questo momento, ChatGPT è un brillante improvvisatore. Può "improvvisare" e sembrare intelligente. Ma non ha ancora dimostrato di possedere una mappa logica profonda di come funziona il mondo. Per essere una vera "macchina pensante", deve smettere di limitarsi a indovinare la parola successiva e iniziare a dimostrare perché quella parola è quella giusta, passo dopo passo, usando regole reali.

Finché un'IA non sarà in grado di superare questi test di "elenco delle regole" in modo costante, il documento afferma che non è ancora una vera AGI.

Sommerso dagli articoli nel tuo campo?

Ricevi digest giornalieri degli articoli più recenti corrispondenti alle tue parole chiave di ricerca — con riassunti tecnici, nella tua lingua.

Prova Digest →