Confronto
Llama 3.1 Instruct 70BMeta · togli
Mostra anche le 18 righe uguali
Qualità · indice Artificial Analysis
6,6
Accetta / produce
Accetta: testo · Produce: testo (dalla categoria)
Azienda
Meta
Famiglia
Llama
Categoria
Linguaggio
Finestra di contesto
non pubblicato
AIME 2025 · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
4 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
AIME · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
17,3 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
Artificial Analysis Intelligence Index · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
6.6 · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
Artificial Analysis Math Index · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
4 · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
GPQA Diamond · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
40,9 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
Humanity's Last Exam · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
4,5 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
IFBench · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
34,4 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
LiveCodeBench · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
23,2 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
MATH-500 · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
64,9 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
MMLU-Pro · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
67,6 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
Terminal-Bench Hard · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
3 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
τ²-Bench · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
15,2 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela