Intelligenza & Voce del tuo assistente AI

Imposta modello, riconoscimento e sintesi vocale in pochi passaggi guidati.

Videotutorial - Assistente AI4CALL: Intelligenza & Voce

Intelligenza e Voce: le tre componenti dell'assistente AI4CALL

La sezione Intelligenza e Voce di un assistente AI4CALL configura tre componenti. Il modello elabora la richiesta e decide la risposta. Il riconoscimento vocale trasforma in testo la voce del chiamante. La sintesi vocale restituisce la risposta in audio.

Ogni componente ha una scheda dedicata, ma ciò che il chiamante percepisce dipende da come le tre lavorano insieme. In questo videotutorial vediamo dove si trovano le impostazioni, cosa fa ogni parametro e come verificare il risultato prima di salvare.

Modello LLM: come l'assistente decide la risposta

Apri Configura nella scheda Modello LLM. Il modello segue il prompt e decide quando richiamare gli strumenti disponibili: determina quindi sia il contenuto della risposta sia il momento in cui l'assistente usa uno strumento.

Provider AI4CALL oppure le tue API key

Con un provider fornito da ai for call usi i servizi disponibili sulla piattaforma: selezioni il modello dal catalogo e consulti il listino per i relativi consumi.

La modalità con tue API key collega invece un tuo account presso il provider. Scegli il provider e la configurazione del portafoglio e, se non esiste ancora, la crei da questa schermata. In questa modalità sei tu a mantenere valide le credenziali e a controllare credito e limiti del provider. Valuta anche i tempi di risposta: durante una telefonata ogni attesa si sente.

Impostazioni avanzate: Temperature, Max Tokens e generazione

Nelle impostazioni avanzate puoi lasciare i campi vuoti e usare i valori predefiniti del modello. Temperature regola la variabilità delle risposte, Max Tokens limita la quantità di testo generato. Gli altri parametri riguardano la selezione dei token, le ripetizioni e l'arresto della generazione. La disponibilità effettiva dipende dal modello e dal provider scelti.

  • Per valutare una modifica, cambia un parametro alla volta e confronta conversazioni simili.
  • Un limite troppo basso può interrompere una risposta utile.
  • I parametri avanzati non sostituiscono un prompt chiaro.
  • Per risposte brevi, indica stile e lunghezza desiderati già nelle istruzioni.
  • Lasciare i campi vuoti significa usare i valori predefiniti del modello.

Riconoscimento vocale: trascrivere ciò che dice il chiamante

Il riconoscimento vocale trascrive ciò che viene detto durante la chiamata. Qui scegli il motore e la lingua del chiamante. Verifica il risultato con nomi, numeri e indirizzi tipici del tuo servizio.

La lingua del riconoscimento è una scelta distinta dalla voce con cui parlerà l'assistente: due impostazioni separate, da verificare separatamente.

Sintesi vocale: la voce che il chiamante ascolta

Nella scheda TTS scegli il provider, la voce e il genere: sono le impostazioni della voce con cui l'assistente parla durante le chiamate. Il nome visibile in questo esempio appartiene alla configurazione dell'assistente. Scegli la voce in base a lingua, chiarezza e naturalezza.

Il menu delle voci include le anteprime di ascolto. Confronta le candidate con frasi rappresentative del tuo servizio e controlla in particolare nomi propri, termini inglesi e numeri. Per una verifica completa, prova poi la voce nel contesto di una chiamata.

Sottofondo audio: quando usarlo e come verificarlo

La scheda Sottofondo permette di scegliere un audio ambientale o musicale: puoi consultare i sottofondi disponibili e le relative anteprime. Nessuna selezione significa nessun sottofondo. Se lo utilizzi, verifica che la voce rimanga sempre comprensibile.

Il controllo finale prima di salvare l'assistente

Prima di concludere controlla insieme modello, riconoscimento e sintesi vocale: il modello deve rispondere correttamente, il riconoscimento capire il chiamante, la voce risultare chiara. Conferma le finestre modificate e salva l'assistente.

Una chiamata di prova mostra come le tre componenti lavorano insieme: è il modo più diretto per capire se la configurazione regge in condizioni reali.

Le tre componenti in sintesi

<b>Modello:</b> elabora la richiesta, decide la risposta e quando richiamare gli strumenti disponibili. <b>Riconoscimento vocale:</b> trascrive in testo ciò che dice il chiamante, secondo motore e lingua scelti. <b>Sintesi vocale:</b> restituisce la risposta in audio, con provider, voce e genere selezionati. Conferma le finestre modificate, salva l'assistente e verifica il risultato con una chiamata di prova.

Domande frequenti

Qual è la differenza tra riconoscimento vocale e sintesi vocale?

Il riconoscimento vocale trasforma in testo la voce del chiamante, la sintesi vocale restituisce la risposta in audio. Sono due configurazioni distinte: la lingua del riconoscimento è una scelta separata dalla voce con cui parlerà l'assistente.

Conviene usare il provider AI4CALL o le proprie API key?

Con il provider fornito da ai for call usi i servizi disponibili sulla piattaforma: selezioni il modello dal catalogo e consulti il listino per i consumi. Con le tue API key colleghi un tuo account presso il provider e sei tu a mantenere valide le credenziali, controllare credito e limiti e valutare i tempi di risposta.

Cosa succede se lascio vuote le impostazioni avanzate?

Lasciare i campi vuoti significa usare i valori predefiniti del modello. È la scelta consigliata finché non hai un motivo preciso per intervenire: i parametri avanzati non sostituiscono un prompt chiaro.

Configuriamo insieme il tuo assistente vocale

Modello, riconoscimento e voce: ti mostriamo come impostarli sul tuo caso d'uso e come verificarli con una chiamata di prova.


Alcuni degli utilizzatori di ai4call
AI4Call Demo

Chiama e prova la qualità dei nostri assistenti A.I.