Trascrizione vocale · Google, famiglia Chirp
Chirp
chirp
Accetta: audio · Produce: testo (dalla categoria)
- Qualità
- 17,56 62° su 81
- Lingue riconosciute
- af, am, ar, as, ast, az, be, bg, bs, ca, ceb, ckb, cs, cy, da, de, el, en, es, et, eu, fa, fi, fil, fr, gl, gu, ha, he, hi, hr, hu, hy, id, is, it, ja, jv, ka, kam, kea, kk, km, kn, ko, ky, lb, ln, lo, lt, luo, lv, mi, mk, ml, mn, mr, ms, mt, my, ne, nl, no, nso, ny, oc, pa, pl, ps, pt, ro, ru, sd, si, sk, sl, sn, so, sq, sr, su, sv, sw, ta, te, tg, th, tr, uk, ur, uz, vi, wo, yo, yue, zh, zu
- Ingresso
- prezzo non confrontabile
- Prezzo
- non pubblicato
Qualità: tasso d'errore Open ASR, inglese breve · lingue riconosciute · ingresso: audio in ingresso
Gli altri in cima · Trascrizione vocale
- 1,25Cohere Transcribe 03-2026Cohere · prezzo non pubblicato · non pubblicato
- 1,4parakeet-tdt-1.1bNVIDIA · prezzo non pubblicato · non pubblicato
- 1,42Granite-4.0-1b-speechIBM · prezzo non pubblicato · non pubblicato
- 1,43granite-speech-3.3-8bIBM · prezzo non pubblicato · non pubblicato
- 1,45parakeet-rnnt-1.1bNVIDIA · prezzo non pubblicato · non pubblicato
Benchmark
Tasso di errore delle parole — CORAAL
più basso è migliore.
- Configurazione standard — 17,56% di parole sbagliate Verificata da terzi
Protocollo e provenienza
- Versione
- 2026-03-26
- Misura
- tasso di errore delle parole
- Serie
- inglese, audio lungo
- Sottoinsieme
- CORAAL
- Lingua
- inglese
- Data osservazione
- 8 settembre 2026, 19:04
- Misurazione
- misurato nel turno corrente
- Comparabilità
- Confrontabile direttamente
- Nota
- Misurazione indipendente di Open ASR Leaderboard.
Open ASR Leaderboard — inglese lungo, 8 settembre
Dettagli delle fonti
- Open ASR Leaderboard — inglese lungo · raw.githubusercontent.com/huggingface · 8 settembre 2026, 19:04 · Confrontabile direttamente
Tasso di errore delle parole — TED-LIUM
più basso è migliore.
- Configurazione standard — 5,52% di parole sbagliate Verificata da terzi
Protocollo e provenienza
- Versione
- 2026-03-26
- Misura
- tasso di errore delle parole
- Serie
- inglese, audio lungo
- Sottoinsieme
- TED-LIUM
- Lingua
- inglese
- Data osservazione
- 8 settembre 2026, 19:04
- Misurazione
- misurato nel turno corrente
- Comparabilità
- Confrontabile direttamente
- Nota
- Misurazione indipendente di Open ASR Leaderboard.
Open ASR Leaderboard — inglese lungo, 8 settembre
Dettagli delle fonti
- Open ASR Leaderboard — inglese lungo · raw.githubusercontent.com/huggingface · 8 settembre 2026, 19:04 · Confrontabile direttamente
Tasso di errore delle parole — Earnings22
più basso è migliore.
- Configurazione standard — 14,81% di parole sbagliate Verificata da terzi
Protocollo e provenienza
- Versione
- 2026-03-26
- Misura
- tasso di errore delle parole
- Serie
- inglese, audio lungo
- Sottoinsieme
- Earnings22
- Lingua
- inglese
- Data osservazione
- 8 settembre 2026, 19:04
- Misurazione
- misurato nel turno corrente
- Comparabilità
- Confrontabile direttamente
- Nota
- Misurazione indipendente di Open ASR Leaderboard.
Open ASR Leaderboard — inglese lungo, 8 settembre
Dettagli delle fonti
- Open ASR Leaderboard — inglese lungo · raw.githubusercontent.com/huggingface · 8 settembre 2026, 19:04 · Confrontabile direttamente
Tasso di errore delle parole — Earnings21
più basso è migliore.
- Configurazione standard — 14,29% di parole sbagliate Verificata da terzi
Protocollo e provenienza
- Versione
- 2026-03-26
- Misura
- tasso di errore delle parole
- Serie
- inglese, audio lungo
- Sottoinsieme
- Earnings21
- Lingua
- inglese
- Data osservazione
- 8 settembre 2026, 19:04
- Misurazione
- misurato nel turno corrente
- Comparabilità
- Confrontabile direttamente
- Nota
- Misurazione indipendente di Open ASR Leaderboard.
Open ASR Leaderboard — inglese lungo, 8 settembre
Dettagli delle fonti
- Open ASR Leaderboard — inglese lungo · raw.githubusercontent.com/huggingface · 8 settembre 2026, 19:04 · Confrontabile direttamente
Tasso di errore delle parole — VoxPopuli
più basso è migliore.
- Configurazione standard — 8,92% di parole sbagliate Verificata da terzi
Protocollo e provenienza
- Versione
- 2026-03-26
- Misura
- tasso di errore delle parole
- Serie
- inglese, audio breve
- Sottoinsieme
- VoxPopuli
- Lingua
- inglese
- Data osservazione
- 8 settembre 2026, 19:04
- Misurazione
- misurato nel turno corrente
- Comparabilità
- Confrontabile direttamente
- Nota
- Misurazione indipendente di Open ASR Leaderboard.
Open ASR Leaderboard — inglese breve, 8 settembre
Dettagli delle fonti
- Open ASR Leaderboard — inglese breve · raw.githubusercontent.com/huggingface · 8 settembre 2026, 19:04 · Confrontabile direttamente
Tasso di errore delle parole — TED-LIUM
più basso è migliore.
- Configurazione standard — 3,81% di parole sbagliate Verificata da terzi
Protocollo e provenienza
- Versione
- 2026-03-26
- Misura
- tasso di errore delle parole
- Serie
- inglese, audio breve
- Sottoinsieme
- TED-LIUM
- Lingua
- inglese
- Data osservazione
- 8 settembre 2026, 19:04
- Misurazione
- misurato nel turno corrente
- Comparabilità
- Confrontabile direttamente
- Nota
- Misurazione indipendente di Open ASR Leaderboard.
Open ASR Leaderboard — inglese breve, 8 settembre
Dettagli delle fonti
- Open ASR Leaderboard — inglese breve · raw.githubusercontent.com/huggingface · 8 settembre 2026, 19:04 · Confrontabile direttamente
Tasso di errore delle parole — SPGISpeech
più basso è migliore.
- Configurazione standard — 4,23% di parole sbagliate Verificata da terzi
Protocollo e provenienza
- Versione
- 2026-03-26
- Misura
- tasso di errore delle parole
- Serie
- inglese, audio breve
- Sottoinsieme
- SPGISpeech
- Lingua
- inglese
- Data osservazione
- 8 settembre 2026, 19:04
- Misurazione
- misurato nel turno corrente
- Comparabilità
- Confrontabile direttamente
- Nota
- Misurazione indipendente di Open ASR Leaderboard.
Open ASR Leaderboard — inglese breve, 8 settembre
Dettagli delle fonti
- Open ASR Leaderboard — inglese breve · raw.githubusercontent.com/huggingface · 8 settembre 2026, 19:04 · Confrontabile direttamente
Tasso di errore delle parole — LibriSpeech, altro audio
più basso è migliore.
- Configurazione standard — 6,38% di parole sbagliate Verificata da terzi
Protocollo e provenienza
- Versione
- 2026-03-26
- Misura
- tasso di errore delle parole
- Serie
- inglese, audio breve
- Sottoinsieme
- LibriSpeech, altro audio
- Lingua
- inglese
- Data osservazione
- 8 settembre 2026, 19:04
- Misurazione
- misurato nel turno corrente
- Comparabilità
- Confrontabile direttamente
- Nota
- Misurazione indipendente di Open ASR Leaderboard.
Open ASR Leaderboard — inglese breve, 8 settembre
Dettagli delle fonti
- Open ASR Leaderboard — inglese breve · raw.githubusercontent.com/huggingface · 8 settembre 2026, 19:04 · Confrontabile direttamente
Tasso di errore delle parole — LibriSpeech, audio pulito
più basso è migliore.
- Configurazione standard — 3,53% di parole sbagliate Verificata da terzi
Protocollo e provenienza
- Versione
- 2026-03-26
- Misura
- tasso di errore delle parole
- Serie
- inglese, audio breve
- Sottoinsieme
- LibriSpeech, audio pulito
- Lingua
- inglese
- Data osservazione
- 8 settembre 2026, 19:04
- Misurazione
- misurato nel turno corrente
- Comparabilità
- Confrontabile direttamente
- Nota
- Misurazione indipendente di Open ASR Leaderboard.
Open ASR Leaderboard — inglese breve, 8 settembre
Dettagli delle fonti
- Open ASR Leaderboard — inglese breve · raw.githubusercontent.com/huggingface · 8 settembre 2026, 19:04 · Confrontabile direttamente
Tasso di errore delle parole — GigaSpeech
più basso è migliore.
- Configurazione standard — 10,31% di parole sbagliate Verificata da terzi
Protocollo e provenienza
- Versione
- 2026-03-26
- Misura
- tasso di errore delle parole
- Serie
- inglese, audio breve
- Sottoinsieme
- GigaSpeech
- Lingua
- inglese
- Data osservazione
- 8 settembre 2026, 19:04
- Misurazione
- misurato nel turno corrente
- Comparabilità
- Confrontabile direttamente
- Nota
- Misurazione indipendente di Open ASR Leaderboard.
Open ASR Leaderboard — inglese breve, 8 settembre
Dettagli delle fonti
- Open ASR Leaderboard — inglese breve · raw.githubusercontent.com/huggingface · 8 settembre 2026, 19:04 · Confrontabile direttamente
Tasso di errore delle parole — Earnings22
più basso è migliore.
- Configurazione standard — 13,25% di parole sbagliate Verificata da terzi
Protocollo e provenienza
- Versione
- 2026-03-26
- Misura
- tasso di errore delle parole
- Serie
- inglese, audio breve
- Sottoinsieme
- Earnings22
- Lingua
- inglese
- Data osservazione
- 8 settembre 2026, 19:04
- Misurazione
- misurato nel turno corrente
- Comparabilità
- Confrontabile direttamente
- Nota
- Misurazione indipendente di Open ASR Leaderboard.
Open ASR Leaderboard — inglese breve, 8 settembre
Dettagli delle fonti
- Open ASR Leaderboard — inglese breve · raw.githubusercontent.com/huggingface · 8 settembre 2026, 19:04 · Confrontabile direttamente
Tasso di errore delle parole — AMI
più basso è migliore.
- Configurazione standard — 15,9% di parole sbagliate Verificata da terzi
Protocollo e provenienza
- Versione
- 2026-03-26
- Misura
- tasso di errore delle parole
- Serie
- inglese, audio breve
- Sottoinsieme
- AMI
- Lingua
- inglese
- Data osservazione
- 8 settembre 2026, 19:04
- Misurazione
- misurato nel turno corrente
- Comparabilità
- Confrontabile direttamente
- Nota
- Misurazione indipendente di Open ASR Leaderboard.
Open ASR Leaderboard — inglese breve, 8 settembre
Dettagli delle fonti
- Open ASR Leaderboard — inglese breve · raw.githubusercontent.com/huggingface · 8 settembre 2026, 19:04 · Confrontabile direttamente
Prestazioni
- non pubblicato
Dove si compra · 1 fornitore
| Fornitore | Variante | Audio in ingressounità non dichiarata dalla fonte | Audio in ingresso — da 1.000.000 a 2.000.000 di minuti mensiliunità non dichiarata dalla fonte | Audio in ingresso — oltre 2.000.000 di minuti mensiliunità non dichiarata dalla fonte | Audio in ingresso — da 500.000 a 1.000.000 di minuti mensiliunità non dichiarata dalla fonte |
|---|---|---|---|---|---|
| Google Cloud | Batch dinamico | non confrontabileValore pubblicatoPubblicato: 0,003 USD per minuto di audioDocumentazione Google Speech-to-Text, 18 agosto Dettagli delle fonti
| non pubblicato | non pubblicato | non pubblicato |
| Google Cloud | Standard | non confrontabileValore pubblicatoPubblicato: 0,016 USD per minuto di audioDocumentazione Google Speech-to-Text, 18 agosto Dettagli delle fonti
| non confrontabileValore pubblicatoPubblicato: 0,008 USD per minuto di audioDocumentazione Google Speech-to-Text, 18 agosto Dettagli delle fonti
| non confrontabileValore pubblicatoPubblicato: 0,004 USD per minuto di audioDocumentazione Google Speech-to-Text, 18 agosto Dettagli delle fonti
| non confrontabileValore pubblicatoPubblicato: 0,01 USD per minuto di audioDocumentazione Google Speech-to-Text, 18 agosto Dettagli delle fonti
|
Specifiche
| Lingue riconosciute Documentazione Google Speech-to-Text, 5 settembre Dettagli delle fonti
| 97 lingue |
| Modalità | Modalità: non pubblicato |
| Capacità | Capacità: non pubblicato |
Restrizioni e licenza
- Pesi
- non pubblicato
- Licenza
- non pubblicato
- Controlli del fornitore
- non pubblicato
Cosa vuol dire
mAIverse riporta soltanto ciò che è pubblicato da chi produce o distribuisce il modello. Non prova i modelli e non ne verifica il comportamento.
Nessun repository pubblico è indicato dalle fonti che consultiamo.
La fonte non pubblica questo campo. Non conferma né la presenza né l'assenza di controlli.
Storico
Nessuna modifica registrata.