Confronto
Olmo 3.1 32B ThinkAllen Institute for AI · togli
Mostra anche le 17 righe uguali
Qualità · indice Artificial Analysis
7,1
Accetta / produce
Accetta: testo · Produce: testo (dalla categoria)
Azienda
Allen Institute for AI
Famiglia
Olmo
Categoria
Linguaggio
Finestra di contesto
non pubblicato
AIME 2025 · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
77,3 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
Artificial Analysis Intelligence Index · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
7.1 · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
Artificial Analysis Math Index · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
77.3 · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
GPQA Diamond · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
59,1 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
Humanity's Last Exam · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
6,3 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
IFBench · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
66 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
LCR · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
0 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
LiveCodeBench · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
69,5 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
MMLU-Pro · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
76,3 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
Terminal-Bench Hard · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
0 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
τ²-Bench · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
0 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela