I recenti progressi nei modelli fondazionali hanno prodotto sistemi di ragionamento in grado di raggiungere un livello da medaglia d'oro alle Olimpiadi Internazionali della Matematica. Il passaggio dalla risoluzione di problemi a livello agonistico alla ricerca professionale, tuttavia, richiede la consultazione di una vasta letteratura e la costruzione di dimostrazioni a lungo termine. In questo lavoro, presentiamo Aletheia, un agente di ricerca matematica che genera, verifica e rivede iterativamente le soluzioni end-to-end in linguaggio naturale. Nello specifico, Aletheia è basato su una versione avanzata di Gemini Deep Think per problemi di ragionamento complessi, una nuova legge di scala temporale inferenziale che si estende oltre i problemi di livello olimpico e un utilizzo intensivo di strumenti per affrontare le complessità della ricerca matematica. Dimostriamo la capacità di Aletheia di passare dai problemi delle Olimpiadi agli esercizi di livello di dottorato e, in particolare, attraverso diverse pietre miliari distinte nella ricerca matematica assistita dall'intelligenza artificiale: (a) un articolo di ricerca (Feng26) generato dall'intelligenza artificiale senza alcun intervento umano nel calcolo di alcune costanti di struttura in geometria aritmetica chiamate autopesi; (b) un articolo di ricerca (LeeSeo26) che dimostra la collaborazione uomo-IA nella dimostrazione di limiti su sistemi di particelle interagenti chiamati insiemi indipendenti; e (c) un'ampia valutazione semi-autonoma (Feng et al., 2026a) di 700 problemi aperti sul database delle congetture di Erdos di Bloom, incluse soluzioni autonome a quattro domande aperte. Per aiutare il pubblico a comprendere meglio gli sviluppi relativi all'IA e alla matematica, suggeriamo di quantificare i livelli standard di autonomia e novità dei risultati assistiti dall'IA, nonché di proporre un nuovo concetto di schede di interazione uomo-IA per la trasparenza. Concludiamo con riflessioni sulla collaborazione uomo-IA in matematica e condividiamo tutti i suggerimenti e gli output del modello a questo URL https
arxiv.org/abs/2602.10177
@matematica
Recent advances in foundational models have yielded reasoning systems capable of achieving a gold-medal standard at the International Mathematical Olympiad.
arXiv.org
TiTiNoNero
in reply to macfranc • • •Scusa ho letto bene?
Eeeh?
In quale punto dell'articolo si dice questa cosa?
Edit: vedo la correzione. Ma comunque non mi pare di aver letto un passaggio relativo al tema della trasmissione del patrimonio genetico. Lo rileggo meglio dopo...
macfranc
in reply to TiTiNoNero • • •nel riscrivere la frase mi è saltato un "non".
(Naturalmente è un'affermazione sarcastica)
@scienza
TiTiNoNero
in reply to macfranc • • •macfranc
in reply to macfranc • • •Ah, nel frattempo il morbillo si diffonde nello Utah, nell'Oregon e in California...
Dei 300 casi di questa epidemia in corso, il Dipartimento della Salute ha dichiarato che 255 erano persone non vaccinate, 23 erano vaccinate e i restanti avevano uno stato vaccinale sconosciuto. Un caso su 12 nello Utah ha richiesto il ricovero ospedaliero.
msn.com/en-us/health/other/mea…
@scienza
MSN
www.msn.comScienza e tecnologia reshared this.