Confronto
Qwen3-4B-Thinking-2507Alibaba Cloud · togli
Mostra anche le 17 righe uguali
Qualità · indice Artificial Analysis
8,8
Accetta / produce
Accetta: testo · Produce: testo (dalla categoria)
Azienda
Alibaba Cloud
Famiglia
Qwen
Categoria
Linguaggio
Finestra di contesto
non pubblicato
AIME 2025 · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
82,7 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 21 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 21 settembre 2026, 14:57 · Confrontabile con cautela
Artificial Analysis Intelligence Index · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
8.8 · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 21 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 21 settembre 2026, 14:57 · Confrontabile con cautela
Artificial Analysis Math Index · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
82.7 · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 21 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 21 settembre 2026, 14:57 · Confrontabile con cautela
GPQA Diamond · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
66,7 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 21 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 21 settembre 2026, 14:57 · Confrontabile con cautela
Humanity's Last Exam · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
6,2 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 21 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 21 settembre 2026, 14:57 · Confrontabile con cautela
IFBench · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
49,8 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 21 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 21 settembre 2026, 14:57 · Confrontabile con cautela
LCR · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
37,3 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 21 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 21 settembre 2026, 14:57 · Confrontabile con cautela
LiveCodeBench · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
64,1 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 21 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 21 settembre 2026, 14:57 · Confrontabile con cautela
MMLU-Pro · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
74,3 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 21 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 21 settembre 2026, 14:57 · Confrontabile con cautela
Terminal-Bench Hard · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
1,5 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 21 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 21 settembre 2026, 14:57 · Confrontabile con cautela
τ²-Bench · non pubblicato; non pubblicato; lingua inglese; versione 2; procedura non pubblicata dalla fonte (independent)Le condizioni di misura non sono le stesse: leggere il confronto con cautela.
25,4 % · dai confronti indipendenti di Artificial Analysis
Artificial Analysis LLM data, 21 settembre
Dettagli delle fonti
- Artificial Analysis LLM data · artificialanalysis.ai/api · 21 settembre 2026, 14:57 · Confrontabile con cautela