-
MotoGP: ufficiale il calendario completo del 2027
-
Carney, 'governo canadese si è preparato per un'invasione da parte degli Usa'
-
Azerbaijan: Antonelli a muro in Q1, partirà 16/o in gara
-
Kiev, 'raid russo su palazzo di uffici in pieno giorno, 3 morti'
-
Salvato a Bari un neonato di 45 giorni con sindrome emolitico-uremica
-
Studio, l'assunzione di acido folinico in gravidanza può prevenire l'autismo
-
L'Italia conferisce a Nelson Moda le insegne dell'Ordine della Stella d'Italia
-
Malagò 'grande attesa per la Nazionale, dobbiamo recuperare entusiasmo'
-
Ufi Hydrogen inaugura in Trentino il nuovo polo per le tecnologie dell'idrogeno
-
Pichetto Fratin, 'sfida dell'idrogeno si vince unendo ricerca, industria e territorio'
-
Borsa: l'Europa sale e guarda al Medio Oriente, Milano +1%
-
Unem, raffinerie italiane al 77% del tasso di utilizzo
-
Dall'Ue 73 milioni all'Italia per gli allevatori colpiti da aviaria e peste suina
-
Sinner salta anche Pechino, "non sono in grado di competere"
-
Figc: Malagò 'caso tesseramento ha poco a che fare con lo sport'
-
Bankitalia, dopo ispezione richiede a Ifis nuovi piani e misure governance
-
Vitale (Inps), in 2 anni raddoppiate aziende agricole di qualità
-
Infrazione Ue a Italia e tutti in Ue su emissioni industriali e di allevamenti
-
Infrazione Ue a 26 Paesi su gas e idrogeno, Italia unica in regola
-
Zangrillo, tessera digitale dalla prossima tornata elettorale
-
Nicchiarelli, Catania e Smutniak in gara alla Festa del cinema di Roma
-
Serie A, Premier, Liga e Bundesliga unite 'serve la riforma della governance Fifa'
-
Vertice Africa-Turchia l'8 e 9 dicembre a Tripoli
-
Multe e bollo auto 'rottamabili' in 1.500 enti locali, online l'elenco
-
Istat, per donne oltre 4 ore lavoro familiare al giorno, si riduce divario
-
'Oltre un'impresa su 4 stima fatturato in crescita, 70% teme caro-energia'
-
Azerbaijan, Verstappen precede Russell nelle libere 3
-
Borsa: l'Europa positiva con il calo del petrolio, si guarda a Hormuz
-
Torna Giornata nazionale del Sì alla donazione degli organi, eventi 'clou' a Modena
-
Rete dei Comuni Sostenibili, 15 proposte per la sostenibilità e la Giornata EcoTrek
-
Urso, 'a breve un nuovo decreto imprese che riguarderà anche l'IA'
-
Morta a Roma la sceneggiatrice e produttrice Silvia d'Amico, figlia di Suso Cecchi
-
Mef, da 19 a 23 ottobre primo collocamento 'doppio' Btp Valore e Btp Valore Insieme
-
L'Inaf al festival Logos di Palermo per raccontare due secoli di astronomia
-
Tra Parma e Busseto la 26/a edizione del Festival Verdi col tema 'Mondi lontani'
-
I cani imparano a distinguere le parole come gli umani
-
Legambiente, sbagliato sospendere stop ad euro 5
-
Così la pelle si espande senza perdere la capacità di rigenerarsi
-
Ghiaccio artico ai minimi del 2026, al decimo posto tra gli anni più scarsi
-
Le prime galassie disseminavano l'universo di elementi pesanti prima del previsto
-
Associazioni terziario, bene eurodigitale ma azzerare commissioni micropagamenti
-
Cnr e Forum Nazionale Terzo Settore firmano accordo quadro
-
Zelensky, 'ok di Trump alle licenze per i Patriot'
-
Sla, proteina ha ruolo cruciale in malattia e apre la strada a nuove terapie
-
'L'Elisir d'amore', il gioco dei sentimenti fra musica e narrazione al Galli di Rimini
-
Sofia Goggia debilitata da due differenti infezioni virali
-
Prometeia rivede al rialzo Pil Italia, in 2025 +0,9%
-
Ft, la base Maga e gli strateghi Gop contro il sostegno di Trump all'IA
-
Peng Liyuan a Washington, la Cina punta sul soft power culturale
-
Taiwan, 'Xi distorce i fatti sulla questione dell'isola'
L'IA battuta dagli umani in un difficile test di matematica
Messi alla prova 4 modelli tra cui ChatGpt, il risultato migliore è stato 6 quesiti su 10
L'Intelligenza Artificiale è stata battuta dagli esseri umani nel più difficile e rigoroso test di matematica al quale è stata sottoposta finora: sono stati messi alla prova quattro diversi modelli, tra cui ChatGpt 5.5 Pro, e nessuno di loro è riuscito a rispondere correttamente a tutti e 10 i quesiti. Il risultato migliore, come riporta la rivista Nature sul suo sito, lo ha ottenuto il modello del Politecnico Federale di Zurigo (Eth), che ha risolto 6 problemi su 10. ChatGpt di OpenAI è arrivato terzo dietro il modello dell'Università della California a Los Angeles, mentre si è classificato ultimo quello dell'Università di Princeton, che a differenza degli altri si basava su Gemini di Google. Il test fa parte di First Proof, il progetto indipendente promosso per seguire l'evoluzione delle capacità dell'intelligenza artificiale nella ricerca matematica, che pubblica i risultati sul suo sito. Le domande poste nell'esame non erano mai state pubblicate prima né nella letteratura scientifica né su Internet, per ridurre il rischio che i modelli si limitassero a ripetere informazioni apprese durante l'addestramento. Un gruppo di 30 matematici ha poi verificato le risposte. Un'altra regola prevedeva che i modelli partecipanti dovessero essere disponibili al grande pubblico e questo ha fatto sì che OpenAI sia stata l'unica grande azienda a prendere parte al test. Due degli altri tre modelli partecipanti si basavano comunque su ChatGpt, grazie a sistemi automatici nei quali le risposte date da questo modello linguistico vengono controllate e migliorate da altri chatbot, spesso con ripetuti scambi di messaggi. Il gruppo dell'Eth ha anche condotto un'indagine preliminare per capire perché alcuni problemi non sono stati risolti da nessuno dei concorrenti. In alcuni casi sembra che ai modelli mancasse un'intuizione cruciale che avrebbe permesso di arrivare alla soluzione finale, mentre in altri l'approccio di base era corretto, ma i sistemi non sono riusciti cogliere tutti i dettagli.
D.Cunningha--AMWN