Confronto
DeepHermes 3 - Llama-3.1 8B PreviewNous Research · togli
Mostra anche le 13 righe uguali
Qualità · indice Artificial Analysis
5,1
Accetta / produce
Accetta: testo · Produce: testo (dalla categoria)
Azienda
Nous Research
Famiglia
DeepHermes
Categoria
Linguaggio
Finestra di contesto
non pubblicato
AIME · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
0 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
Artificial Analysis Intelligence Index · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
5.1 · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
GPQA Diamond · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
27 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
Humanity's Last Exam · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
4,3 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
LiveCodeBench · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
8,5 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
MATH-500 · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
21,8 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela
MMLU-Pro · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
36,5 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 22 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 22 settembre 2026, 14:57 · Confrontabile con cautela