- Inizio
- 16 apr 2025AFFIDABILITÀ 95%da help.openai.com
Usciti OpenAI o3 e o4-mini
Tradotto automaticamente dall’originale
Titolo originale: OpenAI o3 and o4-mini Released
- OpenAI ha rilasciato o3, definito il suo modello di ragionamento più avanzato, e o4-mini, un modello di ragionamento economico, il 16 aprile 2025, con o4-mini-high, agli utenti ChatGPT Pro, Plus e Team[1][2][3]
- OpenAI aveva previsto o3-pro per ChatGPT Pro nelle settimane successive (rilasciato il 10 giugno 2025); Altman ha indicato che o3 e o4-mini potrebbero essere gli ultimi modelli di ragionamento autonomi prima di GPT-5[1][2][3]
- o3 era stato annunciato originariamente il 20 dicembre 2024; OpenAI ha poi annunciato il suo ritiro da ChatGPT per il 26 agosto 2026, senza effetti sull'API[1][2]
Caratteristiche principali
- Sono stati i primi modelli in grado di «pensare con le immagini» (schizzi su lavagna, ingrandimento e rotazione mentre ragionano) e possono usare gli strumenti di ChatGPT, tra cui navigazione web, Python e generazione di immagini[3]
- OpenAI afferma che o3 ha stabilito nuovi risultati allo stato dell'arte su Codeforces, SWE-bench e MMMU e ha commesso il 20 percento in meno di errori gravi rispetto a o1 su compiti difficili del mondo reale nelle valutazioni di esperti esterni; entrambi i modelli sono stati addestrati con apprendimento per rinforzo a ragionare su quando e come usare gli strumenti[4]
- o4-mini è stato il modello con le migliori prestazioni nei benchmark AIME 2024 e 2025, con il 99,5% pass@1 su AIME 2025 con un interprete Python (o3 98,4%), e supporta limiti di utilizzo notevolmente più alti di o3[4]
- Sono stati aggiunti anche alle API Chat Completions e Responses: o3 a 10 dollari per milione di token in ingresso e 40 in uscita, o4-mini a 1,10 e 4,40[3]
- Su SWE-bench Verified TechCrunch riporta o3 al 69,1% e o4-mini al 68,1%, contro o3-mini al 49,3% e Claude 3.7 Sonnet al 62,3%[3]
Fonti 4AFFIDABILITÀ 88%Affidabilità complessiva: 88%Quanto la fonte e le altre fonti del pin ne confermano le date.Media ponderata di quanto 4 fonti, compresa quella principale, confermano gli orari di inizio e fine del pin; una fonte conta la metà per ogni 180 giorni in più rispetto alla più recenteMostra tutti i pin con affidabilità pari o superiore al 75%
La prima voce è sempre la fonte del pin. L’affidabilità complessiva è una media ponderata di quanto ogni fonte conferma gli orari di inizio e fine indicati sopra; una fonte conta la metà per ogni 180 giorni in più rispetto alla più recente.
- [1]95%OpenAI Model Release Notes: OpenAI o3 and o4-mini (April 16, 2025)help.openai.com· Postato il 19 set 2026· Inizio 16 apr 2025· 44% del punteggio
Le note di rilascio dei modelli di OpenAI datano questa voce al 16 aprile 2025
- [2]80%OpenAI o3 - Wikipediaen.wikipedia.org· Aggiunto il 19 set 2026· 44% del punteggio
States OpenAI[1] released o3 and o4-mini on April 16, 2025.
- [3]90%OpenAI launches a pair of AI reasoning models, o3 and o4-minitechcrunch.com· Pubblicato il 16 apr 2025· 6% del punteggio
TechCrunch report dated April 16, 2025 on the o3 and o4-mini launch.
- [4]88%Introducing OpenAI o3 and o4-mini | OpenAI (Wayback Machine copy)web.archive.org· Pubblicato il 16 apr 2025· 6% del punteggio
Archived copy of OpenAI's[1] o3 and o4-mini announcement, which says o3 "sets a new SOTA on benchmarks including Codeforces, SWE-bench ... and MMMU", makes "20 percent fewer major errors than OpenAI o1", and o4-mini "achieves 99.5% pass@1" on AIME 2025 with Python.
Suggerisci una correzione
Manca qualcosa o c’è un errore? Dillo con parole tue: un link che conferma questo pin, una data di inizio o fine diversa e perché, o un fatto che manca o è sbagliato. L’IA lo confronta con le fonti del pin, ne cerca di migliori e aggiunge qualsiasi pagina ti dia ragione. Le fonti del pin contano comunque di più. Anche un’immagine che mostra altro, o lo mostra male, viene esaminata e spostata in basso o sostituita.