I test di matematica sono stati a lungo il metodo di riferimento per valutare le capacità dei modelli di intelligenza artificiale come ChatGPT e Claude . OpenAI afferma che i suoi modelli stanno ottenendo risultati così buoni che i test di matematica esistenti stanno diventando meno utili. Per questo motivo, i ricercatori hanno cercato di affrontare una sfida più complessa.
Hanno sottoposto a un modello inedito circa 4.000 problemi matematici irrisolti. I risultati sono stati sorprendenti e preoccupanti.
L'intelligenza artificiale ha prodotto 722 manoscritti, raggruppati in 372 famiglie di risultati correlati. OpenAI afferma che ogni risultato ha richiesto in media circa tre ore di elaborazione.
"Ci attendono giorni davvero entusiasmanti per la comunità matematica!", ha affermato Stefano Gogioso, membro del Future Tech and AI Experts Council di BeInCrypto
L'intelligenza artificiale sta diventando troppo potente troppo in fretta?
Questa è la notizia più importante. L'IA di frontiera sta iniziando ad andare oltre la semplice risposta a domande note, per arrivare a generare possibili risposte a domande sconosciute.
Ciò potrebbe aumentare notevolmente la quantità di lavoro intellettuale che un ricercatore, un ingegnere o un analista possono intraprendere.
Ma i risultati non sono la verità assoluta. Molti articoli di OpenAI presentano prove Lean verificabili tramite computer. Altri no. OpenAI avverte che alcuni risultati non verificati "potrebbero presentare dei problemi".
Ciò crea un nuovo collo di bottiglia: gli esseri umani potrebbero faticare a verificare i risultati delle ricerche con la stessa rapidità con cui l'intelligenza artificiale è in grado di produrli.
Un'intelligenza artificiale potrebbe ora eseguire analisi predittive e prendere decisioni di investimento?
Forse, ma la finanza è più difficile in un modo diverso.
Una dimostrazione matematica può essere, alla fine, ritenuta giusta o sbagliata. I mercati sono rumorosi e in continua evoluzione.
Recenti studi di riferimento nel settore finanziario mostrano che l'intelligenza artificiale all'avanguardia fatica ancora ad affrontare ricerche complesse sugli investimenti, mentre le ricerche sul market timing rilevano un vantaggio predittivo limitato.
L'opportunità a breve termine risiede in un'analisi più approfondita piuttosto che in una previsione perfetta.
Un'intelligenza artificiale in grado di ragionare ininterrottamente per ore potrebbe esaminare simultaneamente documenti, conference call sugli utili, dati macroeconomici e scenari alternativi, per poi testare un numero di ipotesi di gran lunga superiore a quello che un singolo analista potrebbe formulare.
Questo potrebbe essere il segnale più importante emerso dall'esperimento di OpenAI . L'intelligenza artificiale sta diventando capace di produrre analisi di alto livello a volumi straordinari. Il problema successivo è decidere di quali analisi ci si possa fidare.
L'articolo OpenAI ha dato al suo nuovo modello 4.000 problemi matematici irrisolti" è apparso per la prima volta su BeInCrypto.