Speech to Text: API Speech Recognition

Integrato nei vostri strumenti conversazionali: riconoscimento vocale di riferimento, pensato per gli sviluppatori.

Word Error Rate< 5%Il motore più preciso in Francia, post-LMF
Latenza< 600 msSu flussi conversazionali live, in condizioni reali
PrezzoIl più bassoSul mercato, con impegno al minuto

La fiducia di grandi aziende, integratori e ricercatori

Language Model Factory

Adattamento espresso dei modelli linguistici

Con la nostra Language Model Factory (LMF), nessun vocabolario di settore resta irriconosciuto. Addestrate modelli personalizzati in soli 15 minuti e selezionate quello più adatto al vostro caso d’uso.

  • Un modello pronto per la produzione in 15 minuti
  • Gergo, nomi propri, acronimi di settore
  • Modelli verticali pre-addestrati disponibili immediatamente
01

Modelli verticali

Pre-addestrati su verticali di settore.

02

Gergo e nomi propri

Vocabolario legato al vostro business.

03

Acronimi

Riconoscimento ed espansione automatici.

04

Espressioni aziendali

Specifiche ai vostri processi e casi d’uso.

Anonimizzazione

Protezione e anonimizzazione dei dati sensibili

Anonimizzazione automatica in tempo reale delle informazioni sensibili in base ai vostri casi d’uso: dati personali, bancari e sanitari.

Agente Acme Corp: Buongiorno, è in contatto con Acme Corp[azienda]. Come posso aiutarla oggi?

Cliente: Buongiorno, chiamo per aggiornare i miei dati personali.

Agente Acme Corp: Nessun problema, la aiuto subito. Può dirmi il suo nome completo, per favore?

Cliente: Sì, sono Jean Persona[nome] [cognome].

Agente Acme Corp: Grazie, Jean[nome]. E qual è il suo nuovo indirizzo?

Cliente: È 123 Rue de l’Élysée, 75000 Paris[indirizzo].

Agente Acme Corp: Perfetto, annotato. Ha anche un nuovo numero di telefono?

Cliente: Sì, il nuovo è 06 12 34 56 78[telefono].

Agente Acme Corp: Perfetto. Un’ultima domanda: i suoi dati di pagamento sono cambiati?

Cliente: Sì, ho una nuova carta di credito: 1234 5678 9101 1121, scadenza 12/26, CVV 321[carta di credito].

Agente Acme Corp: Grazie, Jean[nome]. I suoi dati sono aggiornati!

Batch

API Speech-to-Text delle registrazioni audio

Caricate semplicemente le vostre conversazioni telefoniche su un FTP sicuro per ottenere la trascrizione in pochi minuti, oppure utilizzate i nostri connettori:

NICEGenesysAxialysOdigo
Lingue disponibili

Francese, inglese, spagnolo, tedesco, italiano, +5 altre (Europa)

PYTHON SDK
# Upload FTP sicuro
import uhlive
client = uhlive.connect("api.uh.live")
# Trascrizione batch
job = client.transcribe_file(
    file="call_2026-04-28.wav",
    model="it-telephony-v3",
    redaction=True
)
# Risultato
transcript = job.result()
print(transcript.text)
Illustrazione: trascrizione multilingue per gli umani
Streaming · Live

API Streaming per gli umani

Connettete i vostri flussi audio direttamente tramite WebSocket per ricevere la trascrizione multi-speaker in tempo reale, oppure tramite Trunk SIP / SIP REC.

Lingue disponibili

Francese, inglese, spagnolo e tedesco

Streaming · Bot

API Streaming per i bot

API Streaming per IVR e voicebot. Trascrivete le vostre interazioni live con le nostre soluzioni avanzate.

Illustrazione: voicebot multilingue
I nostri protocolli
  • › MRCP v2
  • › WebSocket
Integrato in ogni interazione

Rilevamento dell’attività vocale, selezione del modello linguistico, grammatiche, riconoscimento degli indirizzi, date, numeri e risposte booleane.

Lingue disponibili

Francese, inglese, spagnolo e tedesco

WER < 5%Il motore più preciso in Francia
100MChiamate analizzate all’anno
40%Delle analisi in tempo reale

Pronti a trascrivere le vostre prime chiamate?

Accedete all’API Speech-to-Text di uh!ive. Configurazione in pochi minuti.

Provate gratuitamente