Voice Conversation gjør chatboten din om til en stemmeagent i sanntid. Besøkende trykker på ringeknappen i chat-widgeten og har en muntlig samtale med boten - de snakker, og boten svarer med en syntetisert stemme. Du velger stemmemodell, stemme, språk og noen sikkerhetsgrenser.
Hvor du finner innstillinger for Voice Conversation
Velg chatboten din, klikk på fanen Settings (Innstillinger), og velg deretter Voice Conversation (Stemmesamtale) i sidefeltet til venstre.
Øverst på siden finner du bryteren Enable voice conversation (Aktiver stemmesamtale). Resten av innstillingene vises først når stemmesamtale er aktivert.
Velg en stemmemodell
ChatLab støtter fire stemmemodeller, hver med sin egen pris per minutt vist ved siden av seg i rullegardinmenyen:
- GPT Realtime - OpenAIs flaggskipmodell for sanntid. Best generell kvalitet og lav forsinkelse.
- GPT Realtime Mini - en raskere og rimeligere versjon av GPT Realtime. Standard for nye boter og et godt valg for de fleste bruksområder.
- Gemini 3.1 Flash Voice - Googles stemmemodell (Gemini Live). Det mest økonomiske alternativet.
- ElevenLabs Voice - ElevenLabs-stemmer av høy kvalitet. Bruker botens vanlige tekstmodell (angitt under Settings > Model & Advanced) til å generere svar, og deretter konverterer ElevenLabs dem til tale. Minuttprisen for stemme belastes i tillegg til tekstmodellens kostnad per svar.
Under modellvelgeren finner du kortet Cost breakdown (Kostnadsoversikt) som viser minuttprisen for modellen du har valgt for øyeblikket, slik at du alltid ser hvordan samtalen faktureres i henhold til prisen som vises ved siden av hver modell i rullegardinmenyen.
Velg en stemme
Hver modell tilbyr sitt eget sett med stemmer i rullegardinmenyen Voice (Stemme):
- OpenAI (GPT Realtime og GPT Realtime Mini) - Alloy, Ash, Ballad, Cedar, Coral, Echo, Fable, Marin, Onyx, Nova, Sage, Shimmer, Verse.
- Gemini - Kore (anbefalt), Charon, Puck, Fenrir, Aoede, Leda, Orus, Zephyr.
- ElevenLabs - Brian, Helen, Chris, Daniel, Jessica, Sarah, Lily, Liam, Will, Janet.
Nye boter har Alloy som standard. Du kan endre stemmen når som helst - den nye stemmen trer i kraft ved neste samtale.
Angi språk
Seksjonen Language (Språk) styrer hvilket språk (eller hvilke språk) boten snakker under en samtale.
- OpenAI og Gemini - velg ett enkelt primærspråk. Hvis en besøkende snakker et annet støttet språk under samtalen, vil boten bytte til dette språket helt naturlig.
- ElevenLabs - velg et standardspråk pluss et ubegrenset antall ekstra språk agenten har lov til å bruke.
Klikk på en språkflis for å åpne en velger med landflagg og søkefelt.
Velkomstmelding for stemme
Voice Welcome Message (Velkomstmelding for stemme) er den første setningen boten sier når en samtale starter. Den spilles av én gang i begynnelsen av økten, så hold den kort og naturlig - noe sånt som "Hei, hvordan kan jeg hjelpe deg?" fungerer bra.
Maksimal lengde er 500 tegn.
Begrens samtalevarighet
Stemmesamtaler forbruker Credits per minutt, så to sikkerhetsgrenser er tilgjengelige for å beskytte boteierens budsjett.
Maksimal samtalevarighet
Feltet Max Conversation Duration (Maksimal samtalevarighet) setter et tak på lengden av en enkelt samtale. Standardverdien er 300 sekunder (5 minutter); tillatt område er 30 sekunder til 3600 sekunder (60 minutter). Når grensen nås, sier boten en melding om nådd grense (som du kan tilpasse rett under feltet), og samtalen avsluttes.
Hvis du vil tillate ubegrenset varighet for enkeltsamtaler, slår du på bryteren No cap (Ingen grense). En advarsel vises fordi en enkelt samtale da kan bruke opp alle gjenværende Credits.
Daglig stemmegrense
Feltet Daily voice cap (minutes) (Daglig stemmegrense (minutter)) setter et tak på hvor mange stemmeminutter boten kan bruke på én dag, på tvers av alle besøkende til sammen. Varsler sendes til boteieren når forbruket når 80 % og 95 % av den daglige grensen.
Slå på No daily cap (Ingen daglig grense) for å fjerne grensen per dag.
Stemmeadferd og system-prompt
Stemmesamtaler kan bruke en annen system-prompt enn tekstchat, noe som er nyttig når du ønsker en mer samtalebasert og muntlig personlighet over telefonen.
I seksjonen Voice Behavior (Stemmeadferd) klikker du på lenken Manage voice behavior and prompt in Role & Behavior settings for å gå direkte til Settings > Role & Behavior, der en egen Voice Conversation-fane lar deg redigere den stemmespesifikke prompten uavhengig av tekstchat-prompten.
Hvordan fakturering for stemme fungerer
- Det første minuttet av hver samtale belastes i sin helhet etter den valgte modellens minuttpris. Dette er minimumsprisen for enhver samtale, selv svært korte samtaler.
- Etter det første minuttet skjer faktureringen per sekund.
- Tid i stillhet eller ved frakobling belastes ikke - faktureringen stopper ved det siste bekreftede livstegnet fra den besøkendes nettleser.
- Før en samtale starter, kontrollerer ChatLab at boten har nok Credits til å dekke minst det første minuttet. Hvis ikke, kan ikke samtalen startes.
- For ElevenLabs Voice legges minuttprisen til på toppen av botens tekstmodellkostnad per svar, fordi ElevenLabs bruker tekstmodellen til å generere svar og deretter konverterer dem til tale.
Synkronisering av kunnskapsbase for ElevenLabs
Når en ElevenLabs-stemmemodell er valgt, vises et statuspanel under stemmeinnstillingene som viser om botens treningsdata har blitt lastet opp til ElevenLabs. Synkroniseringen kjører automatisk etter at modellen trenes: ChatLab samler opptil 8 MB med treningsmateriell i et enkelt dokument og sender det til ElevenLabs, slik at stemmeagentens svar gjenspeiler den samme kunnskapsbasen som tekstchatten.
Telefonsamtaler
Når stemmesamtale er aktivert, kan du også tildele boten et ekte telefonnummer slik at kunder kan ringe inn over det vanlige telefonnettet. Se den dedikerte artikkelen: Telefonsamtaler.
Stemmeinndata vs. stemmesamtale
Disse to funksjonene høres like ut, men er forskjellige:
- Stemmeinndata (under Settings > Chat Conversation) legger til en mikrofonknapp i meldingsfeltet slik at besøkende kan diktere et skriftlig spørsmål. Boten svarer fortsatt med tekst. Den bruker nettleserens Web Speech API.
- Stemmesamtale (denne siden) er en fullverdig tale-til-tale-samtale i sanntid - besøkende hører boten svare med stemme, drevet av OpenAI Realtime, Gemini Live eller ElevenLabs.