Finestra di contesto: 131.072 token; dettaglio tecnico della fonte: 0; Token massimi in uscita: 16.384 token; dettaglio tecnico della fonte: non pubblicato; dettaglio tecnico della fonte: fp8; Stato nel catalogo: 0; dettaglio tecnico della fonte: 99.9972635726795; dettaglio tecnico della fonte: 100 → Finestra di contesto: 131.072 token; dettaglio tecnico della fonte: 0; Token massimi in uscita: 16.384 token; dettaglio tecnico della fonte: non pubblicato; dettaglio tecnico della fonte: fp8; Stato nel catalogo: 0; dettaglio tecnico della fonte: 100; dettaglio tecnico della fonte: 100
Offerta: DeepInfra · nousresearch/hermes-3-llama-3.1-405b@deepinfra/fp8Linguaggio · Nous Research, famiglia Hermes 3 405B Instruct
Hermes-3-Llama-3.1-405B
Accetta: testo · Produce: testo
- Qualità
- non pubblicato senza posizione
- Contesto
- 131.072 token
- Ingresso
- 1,00 USD
- Uscita
- 1,00 USD
Qualità: indice Artificial Analysis · testo che riesce a leggere in una volta · ingresso: per milione di token · DeepInfra · uscita: per milione di token · DeepInfra
Gli altri in cima · Linguaggio
- 60,9grok-4.6xAI · 2,00 → 6,00 USD · 500.000 token
- 56gemini-3.7-flashGoogle · gratuito, secondo la fonte → gratuito, secondo la fonte · 1.048.576 token
- 55,8grok-4.5xAI · 2,00 → 6,00 USD · 500.000 token
- 53,4Claude Fable 5.1Anthropic · 10,00 → 50,00 USD · 1.000.000 token
- 53,2DeepSeek V4 Pro 0813DeepSeek · 0,58 → 1,7424 USD · 1.048.576 token
Benchmark
non pubblicato
Prestazioni
- non pubblicato
Dove si compra · 2 fornitori
| Fornitore | Variante | Testo in ingressoper milione di token | Testo in uscitaper milione di token | Lettura dalla cacheunità non dichiarata dalla fonte | Scrittura in cacheunità non dichiarata dalla fonte |
|---|---|---|---|---|---|
| DeepInfra | Nessuna variante | 1,00 USD per milione di tokenValore pubblicatoPubblicato: 0,000001 USD per tokenOpenRouter provider endpoints, 20 agosto Dettagli delle fonti
| 1,00 USD per milione di tokenValore pubblicatoPubblicato: 0,000001 USD per tokenOpenRouter provider endpoints, 20 agosto Dettagli delle fonti
| non pubblicato | non pubblicato |
| OpenRouter | Nessuna variante | 1,00 USD per milione di tokenValore pubblicatoPubblicato: 0,000001 USD per tokenOpenRouter Models API, 19 agosto Dettagli delle fonti
| 1,00 USD per milione di tokenValore pubblicatoPubblicato: 0,000001 USD per tokenOpenRouter Models API, 19 agosto Dettagli delle fonti
| non pubblicato | non pubblicato |
Specifiche
| Testo che riesce a leggere in una volta OpenRouter provider endpoints, 20 agosto · 1 altra fonte concorda Dettagli delle fonti
| 131.072 token |
| Testo che riesce a scrivere in una volta OpenRouter provider endpoints, 20 agosto · 1 altra fonte concorda Dettagli delle fonti
| 16.384 token |
| Finestra di contesto addestrata Hugging Face official model configs, 20 agosto Dettagli delle fonti
| 131.072 token |
| Tokenizzatore OpenRouter Models API, 18 agosto Dettagli delle fonti
| Llama3 |
| Numero di parametri Hugging Face official model configs, 20 agosto Dettagli delle fonti
| 405,85 miliardi |
| Architettura Hugging Face official model configs, 20 agosto Dettagli delle fonti
| LlamaForCausalLM |
| Tipo di modello Hugging Face official model configs, 20 agosto Dettagli delle fonti
| llama |
| Conoscenza aggiornata a OpenRouter Models API, 18 agosto Dettagli delle fonti
| 31 dicembre 2023 |
| In listino dal OpenRouter Models API, 10 settembre Dettagli delle fonti
| 16 agosto 2024 |
| Dimensione del vocabolario Hugging Face official model configs, 20 agosto Dettagli delle fonti
| 128.256 |
| Precisione dei pesi Hugging Face official model configs, 20 agosto Dettagli delle fonti
| bfloat16 |
| Modalità | Accetta: testo, Produce: testo |
| Capacità | Libreria: transformers, Licenza: llama3, Ragionamento: non pubblicato, Parametri supportati: frequency_penalty, logit_bias, max_tokens, min_p, presence_penalty, repetition_penalty, response_format, seed, stop, structured_outputs, temperature, top_k, top_p, Etichette: transformers, safetensors, llama, text-generation, Llama-3, instruct, finetune, chatml, gpt4, synthetic data, distillation, function calling, json mode, axolotl, roleplaying, chat, conversational, en, arxiv:2408.11857, base_model:meta-llama/Llama-3.1-405B, base_model:finetune:meta-llama/Llama-3.1-405B, license:llama3, text-generation-inference, endpoints_compatible, deploy:azure, region:us |
Dettagli tecnici della fonte
Valori che la fonte pubblica ma il catalogo non sa ancora nominare.
- parameter dtypes · BF16
- 405.853.388.800
Hugging Face official model configs, 20 agosto
Dettagli delle fonti
- Hugging Face official model configs · huggingface.co/NousResearch · 20 agosto 2026, 03:02 · Confrontabile con cautela · Questa fonte dichiara il valore mostrato. · valore dichiarato: 405.853.388.800
- instruct type
- chatml
OpenRouter Models API, 18 agosto
Dettagli delle fonti
- OpenRouter Models API · openrouter.ai/api · 18 agosto 2026, 13:26 · Confrontabile con cautela · Questa fonte dichiara il valore mostrato. · valore dichiarato: chatml
- expiration date
- non pubblicato
Le fonti elencate hanno contribuito a questa sezione; il singolo valore non è attribuito a una fonte precisa
Dettagli delle fonti
- dal listino OpenRouter · openrouter.ai/api · 14 agosto 2026, 19:29 · Confrontabile con cautela
- hugging face id
- NousResearch/Hermes-3-Llama-3.1-405B
OpenRouter Models API, 18 agosto
Dettagli delle fonti
- OpenRouter Models API · openrouter.ai/api · 18 agosto 2026, 13:26 · Confrontabile con cautela · Questa fonte dichiara il valore mostrato. · valore dichiarato: NousResearch/Hermes-3-Llama-3.1-405B
- created
- 1.723.766.400
OpenRouter Models API, 18 agosto
Dettagli delle fonti
- OpenRouter Models API · openrouter.ai/api · 18 agosto 2026, 13:26 · Confrontabile con cautela · Questa fonte dichiara il valore mostrato. · valore dichiarato: 1.723.766.400
- huggingface repository
- NousResearch/Hermes-3-Llama-3.1-405B
Hugging Face official model configs, 20 agosto
Dettagli delle fonti
- Hugging Face official model configs · huggingface.co/NousResearch · 20 agosto 2026, 03:02 · Confrontabile con cautela · Questa fonte dichiara il valore mostrato. · valore dichiarato: NousResearch/Hermes-3-Llama-3.1-405B
- weights availability
- public_download
Hugging Face official model configs, 20 agosto
Dettagli delle fonti
- Hugging Face official model configs · huggingface.co/NousResearch · 20 agosto 2026, 03:02 · Confrontabile con cautela · Questa fonte dichiara il valore mostrato. · valore dichiarato: public_download
- license
- llama3
Hugging Face official model configs, 20 agosto
Dettagli delle fonti
- Hugging Face official model configs · huggingface.co/NousResearch · 20 agosto 2026, 03:02 · Confrontabile con cautela · Questa fonte dichiara il valore mostrato. · valore dichiarato: llama3
- license repository
- NousResearch/Hermes-3-Llama-3.1-405B
Hugging Face official model configs, 20 agosto
Dettagli delle fonti
- Hugging Face official model configs · huggingface.co/NousResearch · 20 agosto 2026, 03:02 · Confrontabile con cautela · Questa fonte dichiara il valore mostrato. · valore dichiarato: NousResearch/Hermes-3-Llama-3.1-405B
- base models
- meta-llama/Meta-Llama-3.1-405B, meta-llama/Llama-3.1-405B
Hugging Face official model configs, 20 agosto
Dettagli delle fonti
- Hugging Face official model configs · huggingface.co/NousResearch · 20 agosto 2026, 03:02 · Confrontabile con cautela · Questa fonte dichiara il valore mostrato. · valore dichiarato: meta-llama/Meta-Llama-3.1-405B, meta-llama/Llama-3.1-405B
Restrizioni e licenza
- Pesi
- Scaricabili da chiunque
- Licenza
- llama3
- Controlli del fornitore
- non pubblicato
Cosa vuol dire
mAIverse riporta soltanto ciò che è pubblicato da chi produce o distribuisce il modello. Non prova i modelli e non ne verifica il comportamento.
Il repository NousResearch/Hermes-3-Llama-3.1-405B dichiara llama3.
SPDX: non ancora acquisito
Il catalogo non ha ancora raccolto questa informazione. Non è possibile trarne alcuna conclusione.
Il repository dichiara di derivare da meta-llama/Meta-Llama-3.1-405B.
Il repository dichiara di derivare da meta-llama/Llama-3.1-405B.
mAIverse non ha confrontato questa licenza con quella del modello da cui dichiara di derivare.
Il catalogo non pubblica una conclusione da questo valore. Il valore acquisito non viene trasformato in un'affermazione sull'assenza di controlli.
Il pubblicante non descrive limiti. La scheda del repository NousResearch/Hermes-3-Llama-3.1-405B è stata consultata e non contiene tag con cui il pubblicante descrive limiti. Questo riguarda soltanto la scheda: non conferma né la presenza né l'assenza di restrizioni.
dalle schede dei modelli su Hugging Face, 20 agosto
Dettagli delle fonti
- dalle schede dei modelli su Hugging Face · huggingface.co/NousResearch · 20 agosto 2026, 03:02 · Confrontabile con cautela · Questa fonte dichiara il valore mostrato. · valore dichiarato: Sì
Storico
1 campo aggiornato: 1 dettaglio tecnico dalla fonte.
Mostra i valori prima e dopo
Finestra di contesto: 131.072 token; dettaglio tecnico della fonte: 1.723.766.400; dettaglio tecnico della fonte: non pubblicato; dettaglio tecnico della fonte: NousResearch/Hermes-3-Llama-3.1-405B; dettaglio tecnico della fonte: chatml; dettaglio tecnico della fonte: 31 dicembre 2023; Token massimi in uscita: 16.384 token; dettaglio tecnico della fonte: Llama3 → Finestra di contesto: 131.072 token; dettaglio tecnico della fonte: 1.723.766.400; dettaglio tecnico della fonte: non pubblicato; dettaglio tecnico della fonte: NousResearch/Hermes-3-Llama-3.1-405B; dettaglio tecnico della fonte: chatml; dettaglio tecnico della fonte: 31 dicembre 2023; dettaglio tecnico della fonte: 16 agosto 2024; Token massimi in uscita: 16.384 token; dettaglio tecnico della fonte: Llama3
Offerta: OpenRouter · nousresearch/hermes-3-llama-3.1-405b2 campi aggiornati: 2 dettagli tecnici dalla fonte.
Mostra i valori prima e dopo
dettaglio tecnico della fonte: LlamaForCausalLM; dettaglio tecnico della fonte: 131.072 token; dettaglio tecnico della fonte: meta-llama/Meta-Llama-3.1-405B, meta-llama/Llama-3.1-405B; Finestra di contesto: 131.072 token; dettaglio tecnico della fonte: 1.723.766.400; dettaglio tecnico della fonte: non pubblicato; dettaglio tecnico della fonte: NousResearch/Hermes-3-Llama-3.1-405B; dettaglio tecnico della fonte: NousResearch/Hermes-3-Llama-3.1-405B; dettaglio tecnico della fonte: chatml; dettaglio tecnico della fonte: 31 dicembre 2023; dettaglio tecnico della fonte: llama3; dettaglio tecnico della fonte: NousResearch/Hermes-3-Llama-3.1-405B; Token massimi in uscita: 16.384 token; dettaglio tecnico della fonte: llama; dettaglio tecnico della fonte: 405,85 miliardi; dettaglio tecnico della fonte: 405.853.388.800; Limiti dichiarati dal pubblicante: ; Scheda verificata per i limiti dichiarati: Sì; dettaglio tecnico della fonte: Llama3; dettaglio tecnico della fonte: bfloat16; dettaglio tecnico della fonte: 128.256; dettaglio tecnico della fonte: public_download → dettaglio tecnico della fonte: LlamaForCausalLM; dettaglio tecnico della fonte: 131.072 token; dettaglio tecnico della fonte: meta-llama/Meta-Llama-3.1-405B, meta-llama/Llama-3.1-405B; Finestra di contesto: 131.072 token; dettaglio tecnico della fonte: 1.723.766.400; dettaglio tecnico della fonte: non pubblicato; dettaglio tecnico della fonte: NousResearch/Hermes-3-Llama-3.1-405B; dettaglio tecnico della fonte: NousResearch/Hermes-3-Llama-3.1-405B; dettaglio tecnico della fonte: chatml; dettaglio tecnico della fonte: 31 dicembre 2023; dettaglio tecnico della fonte: llama3; dettaglio tecnico della fonte: NousResearch/Hermes-3-Llama-3.1-405B; dettaglio tecnico della fonte: 16 agosto 2024; Token massimi in uscita: 16.384 token; dettaglio tecnico della fonte: llama; dettaglio tecnico della fonte: 405,85 miliardi; dettaglio tecnico della fonte: 405.853.388.800; Limiti dichiarati dal pubblicante: ; Scheda verificata per i limiti dichiarati: Sì; dettaglio tecnico della fonte: Llama3; dettaglio tecnico della fonte: bfloat16; dettaglio tecnico della fonte: 128.256; dettaglio tecnico della fonte: public_download
Chi ha eseguito la prova: non pubblicato; Confrontabilità: Confrontabile con cautela; Distribuito tramite: OpenRouter; Tipo di fonte: interfaccia del fornitore; Indirizzo: https://openrouter.ai/api/v1/models?output_modalities=text%2Cimage%2Cvideo%2Caudio → Confrontabilità: Confrontabile con cautela; Nota sulla confrontabilità: base_context_window is the trained length; rope_scaling is present and no effective served context is computed; Tipo di fonte: scheda ufficiale del modello; Indirizzo: https://huggingface.co/NousResearch/Hermes-3-Llama-3.1-405B
Finestra di contesto: 131.072 token; dettaglio tecnico della fonte: 1.723.766.400; dettaglio tecnico della fonte: non pubblicato; dettaglio tecnico della fonte: NousResearch/Hermes-3-Llama-3.1-405B; dettaglio tecnico della fonte: chatml; dettaglio tecnico della fonte: 31 dicembre 2023; Token massimi in uscita: 16.384 token; dettaglio tecnico della fonte: Llama3 → dettaglio tecnico della fonte: LlamaForCausalLM; dettaglio tecnico della fonte: 131.072 token; dettaglio tecnico della fonte: meta-llama/Meta-Llama-3.1-405B, meta-llama/Llama-3.1-405B; Finestra di contesto: 131.072 token; dettaglio tecnico della fonte: 1.723.766.400; dettaglio tecnico della fonte: non pubblicato; dettaglio tecnico della fonte: NousResearch/Hermes-3-Llama-3.1-405B; dettaglio tecnico della fonte: NousResearch/Hermes-3-Llama-3.1-405B; dettaglio tecnico della fonte: chatml; dettaglio tecnico della fonte: 31 dicembre 2023; dettaglio tecnico della fonte: llama3; dettaglio tecnico della fonte: NousResearch/Hermes-3-Llama-3.1-405B; Token massimi in uscita: 16.384 token; dettaglio tecnico della fonte: llama; dettaglio tecnico della fonte: 405,85 miliardi; dettaglio tecnico della fonte: 405.853.388.800; Limiti dichiarati dal pubblicante: ; Scheda verificata per i limiti dichiarati: Sì; dettaglio tecnico della fonte: Llama3; dettaglio tecnico della fonte: bfloat16; dettaglio tecnico della fonte: 128.256; dettaglio tecnico della fonte: public_download
Ragionamento: non pubblicato; Parametri supportati: frequency_penalty, logit_bias, max_tokens, min_p, presence_penalty, repetition_penalty, response_format, seed, stop, structured_outputs, temperature, top_k, top_p → Libreria: transformers; Licenza: llama3; Ragionamento: non pubblicato; Parametri supportati: frequency_penalty, logit_bias, max_tokens, min_p, presence_penalty, repetition_penalty, response_format, seed, stop, structured_outputs, temperature, top_k, top_p; Etichette: transformers, safetensors, llama, text-generation, Llama-3, instruct, finetune, chatml, gpt4, synthetic data, distillation, function calling, json mode, axolotl, roleplaying, chat, conversational, en, arxiv:2408.11857, base_model:meta-llama/Llama-3.1-405B, base_model:finetune:meta-llama/Llama-3.1-405B, license:llama3, text-generation-inference, endpoints_compatible, deploy:azure, region:us
Hermes 3 405B Instruct → Hermes-3-Llama-3.1-405B
1 campo aggiornato: 1 dettaglio tecnico dalla fonte.