Voice Conversation pretvara Vašeg chatbota u glasovnog agenta u realnom vremenu. Posetioci pritisnu dugme za poziv u vidžetu za ćaskanje i vode govorni razgovor sa botom - oni govore, a bot odgovara sintetizovanim glasom. Vi birate glasovni model, glas, jezik i nekoliko bezbednosnih ograničenja.
Gde pronaći podešavanja za Voice Conversation
Izaberite svog chatbota, kliknite na karticu Settings (Podešavanja), a zatim izaberite Voice Conversation (Glasovni razgovor) u levoj bočnoj traci.
Na vrhu stranice pronaći ćete prekidač Enable voice conversation (Omogući glasovni razgovor). Ostatak podešavanja se pojavljuje tek kada se omogući glasovni razgovor.
Izaberite glasovni model
ChatLab podržava četiri glasovna modela, svaki sa sopstvenom cenom po minutu prikazanom pored njega u padajućem meniju:
- GPT Realtime - vodeći OpenAI model u realnom vremenu. Najbolji opšti kvalitet i niska latencija.
- GPT Realtime Mini - brža i jeftinija verzija modela GPT Realtime. Podrazumevani izbor za nove botove i odlično rešenje za većinu primena.
- Gemini 3.1 Flash Voice - Google-ov glasovni model (Gemini Live). Najekonomičnija opcija.
- ElevenLabs Voice - visokokvalitetni ElevenLabs glasovi. Koristi uobičajeni tekstualni model bota (podešen pod Settings > Model & Advanced) za generisanje odgovora, koje ElevenLabs zatim pretvara u govor. Cena glasovnog modela po minutu naplaćuje se dodatno uz cenu tekstualnog modela po odgovoru.
Ispod birača modela nalazi se kartica Cost breakdown (Pregled troškova) koja prikazuje cenu po minutu za model koji trenutno imate izabran, tako da uvek vidite kako će poziv biti tarifiran po ceni prikazanoj pored svakog modela u padajućem meniju.
Izaberite glas
Svaki model nudi sopstveni skup glasova u padajućem meniju Voice (Glas):
- OpenAI (GPT Realtime i GPT Realtime Mini) - Alloy, Ash, Ballad, Cedar, Coral, Echo, Fable, Marin, Onyx, Nova, Sage, Shimmer, Verse.
- Gemini - Kore (preporučeno), Charon, Puck, Fenrir, Aoede, Leda, Orus, Zephyr.
- ElevenLabs - Brian, Helen, Chris, Daniel, Jessica, Sarah, Lily, Liam, Will, Janet.
Za nove botove podrazumevani glas je Alloy. Glas možete promeniti u bilo kom trenutku - novi glas stupa na snagu pri sledećem pozivu.
Podesite jezik
Odeljak Language (Jezik) kontroliše koji jezik (ili jezike) bot govori tokom poziva.
- OpenAI i Gemini - izaberite jedan primarni jezik. Ako posetilac tokom poziva progovori na drugom podržanom jeziku, bot će prirodno preći na taj jezik.
- ElevenLabs - izaberite podrazumevani jezik i bilo koji broj dodatnih jezika koje agent sme da koristi.
Kliknite na pločicu jezika da biste otvorili birač sa zastavama zemalja i pretragom.
Glasovna poruka dobrodošlice
Polje Voice Welcome Message (Glasovna poruka dobrodošlice) predstavlja prvu rečenicu koju bot izgovara kada poziv započne. Reprodukuje se jednom na početku sesije, pa neka bude kratka i prirodna - nešto poput "Zdravo, kako mogu da Vam pomognem?" odlično funkcioniše.
Maksimalna dužina je 500 znakova.
Ograničite trajanje razgovora
Glasovni pozivi troše kredite po minutu, pa su na raspolaganju dva bezbednosna ograničenja radi zaštite budžeta vlasnika bota.
Max Conversation Duration
Polje Max Conversation Duration (Maksimalno trajanje razgovora) ograničava dužinu jednog poziva. Podrazumevana vrednost je 300 sekundi (5 minuta); dozvoljeni raspon je od 30 sekundi do 3600 sekundi (60 minuta). Kada se dostigne ograničenje, bot izgovara poruku nakon limita (koju možete prilagoditi odmah ispod polja) i poziv se završava.
Ako želite da dozvolite neograničeno trajanje pojedinačnog poziva, uključite prekidač No cap (Bez ograničenja). Prikazuje se upozorenje jer jedan poziv u tom slučaju može potrošiti sve preostale kredite.
Dnevni glasovni limit
Polje Daily voice cap (minutes) (Dnevni glasovni limit u minutima) ograničava koliko glasovnih minuta bot može da iskoristi u jednom danu, zbirno za sve posetioce. Obaveštenja o dostizanju limita šalju se vlasniku bota kada potrošnja dostigne 80% i 95% dnevnog limita.
Uključite No daily cap (Bez dnevnog limita) da biste uklonili ograničenje po danu.
Ponašanje glasa i sistemski prompt
Glasovni pozivi mogu da koriste drugačiji sistemski prompt u odnosu na tekstualno ćaskanje, što je korisno kada preko telefona želite ličnost prilagođeniju prirodnom, govornom stilu.
U odeljku Voice Behavior (Ponašanje glasa), kliknite na link Manage voice behavior and prompt in Role & Behavior settings (Upravljajte ponašanjem glasa i promptom u podešavanjima za Role & Behavior) da biste prešli na Settings > Role & Behavior, gde Vam posebna kartica Voice Conversation omogućava da nezavisno uređujete prompt specifičan za glas u odnosu na prompt za tekstualno ćaskanje.
Kako funkcioniše naplata glasa
- Prvi minut svakog poziva naplaćuje se u celosti prema ceni po minutu za izabrani model. To je minimalni iznos za svaki poziv, čak i za veoma kratke.
- Nakon prvog minuta, tarifiranje se vrši po sekundi.
- Vreme tišine ili prekida veze se ne naplaćuje - tarifiranje se zaustavlja pri poslednjem potvrđenom signalu prisustva (heartbeat) iz pretraživača posetioca.
- Pre nego što poziv počne, ChatLab proverava da li bot ima dovoljno kredita da pokrije barem prvi minut. Ako nema, poziv se ne može započeti.
- Za ElevenLabs Voice, naknada po minutu se dodaje pored cene tekstualnog modela bota po odgovoru, jer ElevenLabs koristi tekstualni model za generisanje odgovora, a zatim ih pretvara u govor.
Sinhronizacija baze znanja za ElevenLabs
Kada je izabran glasovni model ElevenLabs, ispod glasovnih podešavanja se pojavljuje statusni panel koji prikazuje da li su podaci za treniranje bota otpremljeni na ElevenLabs. Sinhronizacija se pokreće automatski nakon treniranja: ChatLab spaja do 8 MB materijala za treniranje u jedan dokument i šalje ga platformi ElevenLabs kako bi odgovori glasovnog agenta odražavali istu bazu znanja kao i tekstualno ćaskanje.
Telefonski pozivi
Kada se omogući glasovni razgovor, botu možete dodeliti i pravi telefonski broj kako bi klijenti mogli da zovu putem redovne telefonske mreže. Pogledajte poseban članak: Telefonski pozivi.
Glasovni unos u poređenju sa glasovnim razgovorom
Ove dve funkcije zvuče slično, ali se razlikuju:
- Glasovni unos (pod Settings > Chat Conversation) dodaje dugme mikrofona u traku za poruke kako bi posetioci mogli da diktiraju kucano pitanje. Bot i dalje odgovara tekstom. Ova funkcija koristi Web Speech API pretraživača.
- Glasovni razgovor (ova stranica) predstavlja potpuni poziv govor-u-govor u realnom vremenu - posetioci čuju kako im bot odgovara glasom, uz podršku modela OpenAI Realtime, Gemini Live ili ElevenLabs.