lf.Una rivista personaleEnglish
IA / 014liminalfinds.it

Il sito dei problemi di Erdős non dice più quali sono risolti

Il problema numero 1, che Erdős faceva risalire al 1931, è stato confutato da un modello di OpenAI e a settembre portava la scritta DISPROVED. Dal 6 ottobre nessun problema del sito ha più uno stato.

Uno schizzo a grafite di un cassetto di schedario in legno, aperto e pieno di schede bianche tutte uguali; accanto, un timbro di gomma rovesciato su un fianco e tre piccole linguette di carta bianche.

Nel 1931, a diciotto anni, Paul Erdős si pose una domanda sui numeri interi le cui somme non si ripetono mai. Più tardi l’avrebbe chiamata «forse il mio primo problema serio». Su erdosproblems.com, il sito che raccoglie i suoi problemi, è il numero 1, con un premio di 500 dollari. A settembre la sua pagina mostrava, sopra l’enunciato, una parola in maiuscolo: DISPROVED, confutato. Oggi quella parola non c’è più, e con lei sono sparite tutte le altre etichette. Dal 6 ottobre nessuno dei 1.221 problemi del sito dice se sia aperto o risolto.

La domanda è semplice da formulare. Si scelgono n numeri interi diversi in modo che due gruppi diversi di questi numeri non diano mai la stessa somma; l’esempio più ovvio sono le potenze di due: 1, 2, 4, 8 e così via. Quanto può essere piccolo il più grande di questi numeri? Erdős sospettava che non si potesse fare molto meglio delle potenze di due: il numero più grande doveva essere sempre almeno una certa frazione fissa di 2 elevato alla n. Un modello di OpenAI non ancora pubblico, GPT-6 Astra, ha dimostrato il contrario. Per quanto piccola sia la frazione scelta, esistono insiemi sempre più grandi che scendono sotto quella soglia. La dimostrazione è stata verificata in Lean, un linguaggio in cui un computer controlla ogni passaggio.

La confutazione è nata da un test. Il 6 settembre Epoch AI, un gruppo che misura le capacità dei sistemi di intelligenza artificiale, ha pubblicato FrontierMath Erdős: 68 problemi ancora aperti ad agosto, scelti tra i 652 aperti sul sito, che un modello deve risolvere in Lean da solo. A selezionarli è stato uno dei due autori, Thomas Bloom, il matematico dell’Università di Manchester che ha creato erdosproblems.com nel 2023 e che lo gestisce ancora oggi. Con le regole del test, 300 dollari per problema, GPT-6 Astra ha ottenuto il 3% e altri quattro modelli zero. In tentativi più ampi, fuori da quelle regole, ha confutato anche il problema 1. Secondo l’articolo, per i cinque problemi che ha risolto sono serviti in tutto oltre 220.000 dollari di calcolo.

Il sito ha registrato il risultato a tappe, come mostrano le copie dell’Internet Archive. Il 3 settembre la pagina del problema 1 diceva «DISPROVED (FORMALIZED)», con la nota «No explanation available»: nessuna spiegazione disponibile. Il 18 settembre diceva «DISPROVED (LEAN)»: risolto in senso negativo, dimostrazione verificata al computer. Sotto l’enunciato c’è una spiegazione scritta dallo stesso Bloom, modificata l’ultima volta il 3 settembre, per aiutare i matematici a coglierne rapidamente le idee principali. Lavorandoci, racconta, ha trovato legami con un risultato del 1929 di Carl Ludwig Siegel che nella dimostrazione originale di GPT restavano in ombra.

Il 6 ottobre Bloom ha spiegato le sue ragioni. Quando nell’agosto 2025 aveva aperto i commenti, attorno ai problemi era nata una comunità; oggi il sito ha fra i 10.000 e i 25.000 visitatori unici al giorno. Ma l’uso pubblico principale, scrive, è diventato pubblicizzare dimostrazioni generate dall’AI, spesso senza alcun tentativo di spiegarle, per rivendicare una priorità che conta sempre meno. Ha quindi sospeso i nuovi commenti e le rivendicazioni di dimostrazione sui problemi, tolto gli stati e il conteggio dei problemi risolti, abbandonato il linguaggio del merito. Archivi di dimostrazioni prodotte dall’AI devono esistere, dice, ma separati da un sito che vuole tenere vive le domande: non si apre un ristorante in un macello. Togliere «risolto» serve a scoraggiare chi copia i problemi nella propria AI per godersi il passaggio da OPEN a SOLVED. E considerare «chiuso» un problema è anche, secondo lui, contrario allo spirito di Erdős.

Per questa nota il sito è stato controllato il 7 ottobre. La pagina del problema 1 non ha più etichette, e i pulsanti «Random Solved» e «Random Open» che aveva a settembre sono diventati un unico «Random». Persino i vecchi indirizzi che filtravano i problemi per stato ora restituiscono la stessa cosa: i sedici problemi legati a una sola voce della bibliografia di Erdős compaiono identici sotto /solved, /open e /all. La home page riporta un solo numero: 1.221 problemi nel database. Il testo, invece, resta. Il problema 1 dice ancora che è stato confutato da GPT-6 Astra, perché la nuova regola vale per i risultati futuri: dove prima avrebbe scritto «Bloom proved that x > y» (Bloom ha dimostrato che x > y), ora, dice, scriverà «It is known that x > y» (è noto che x > y), con un link a chi ha spiegato la dimostrazione.

Non è stata verificata la correttezza della dimostrazione: questa nota non l’ha esaminata. Non si sa che cosa mostrasse la pagina tra il 18 settembre e il 6 ottobre, né se la home page esponesse prima un conteggio dei problemi risolti: durante il controllo l’Internet Archive non rispondeva, e il post di Bloom dice che conteggio e percentuale non saranno più mostrati. Lo stesso giorno del post, OpenAI ha pubblicato su GitHub una serie di nuovi risultati matematici ottenuti da un suo modello interno. Un mese dopo aver contribuito a costruire un test che misura l’AI su questi problemi, chi gestisce il sito ha smesso di mostrare quella misura sulle sue pagine. I 1.221 problemi sono ancora tutti lì, dello stesso colore neutro.

02 / La scoperta

Changes — Thomas Bloom, erdosproblems.com

Post del 6 ottobre 2026 del matematico che gestisce erdosproblems.com: sospensione dei commenti e delle rivendicazioni di dimostrazione sui problemi, eliminazione degli stati «aperto/risolto» e del linguaggio del merito. Controllato il 7 ottobre: il problema 1 non mostra alcuno stato (le copie dell’Internet Archive del 3 e del 18 settembre riportano DISPROVED); i filtri per stato restituiscono elenchi identici; la home page mostra solo il totale di 1.221 problemi. Contesto da FrontierMath Erdős (arXiv, 6 settembre 2026), di cui Bloom è coautore. Non verificati: la dimostrazione, la pagina tra il 18 settembre e il 6 ottobre, un eventuale conteggio dei problemi risolti in passato sulla home page.

Leggi il post di Thomas Bloom Apri il problema di Erdős numero 1 sul sito Guarda il problema 1 com’era archiviato il 18 settembre Leggi l’articolo FrontierMath Erdős Leggi il post di OpenAI del 6 ottobre sulla matematica

Se questa lettura ti ha lasciato qualcosa, puoi sostenere Liminal Finds (si apre in una nuova scheda).