Prisändringar, latensförbättringar, engångs-SMS och mer
Kommande prisjusteringar (gäller från 1 juni)
Vi gör några ändringar i vår prismodell för att bättre matcha användningsmönster och infrastrukturkostnader. Dessa uppdateringar träder i kraft den 1 juni:
Tokenbaserad LLM-prissättning LLM-användning kommer nu att faktureras baserat på antal token. Prompter upp till 3 500 token följer den befintliga fasta taxan. Prompter som överstiger 3 500 token skalar proportionellt i kostnad. Till exempel:
En prompt med 3 200 token faktureras fortfarande till grundtaxan.
En prompt med 4 500 token faktureras till
4500 / 3500 * grundtaxa
Exempel med OpenAI GPT-4.1:
0.07 + (4500 / 3500 × 0.045) = 0.1279 per minut
Korta samtal med minimidebitering vid användning av Dynamic AI First Sentence För att ta hänsyn till LLM-användning har samtal som börjar med en Dynamic AI First Sentence nu en minsta debiterbar längd på 10 sekunder.
Att välja ”User speaks first” eller ”Static AI first sentence” (stöder dynamiska variabler) påverkas inte.
Samtal som varar längre än 10 sekunder påverkas inte av minimidebiteringen, även om du använder en Dynamic AI First Sentence.
Ej uppkopplade samtal (t.ex. inget svar, upptaget eller misslyckad uppringning) debiteras inte.
Ytterligare optimering av latens och stabilitet
Latens och stabilitet har alltid varit centrala prioriteringar hos Retell. Genom att utnyttja de senaste LLM:erna drar vi inte bara nytta av förbättrad prestanda och lägre kostnader, utan tillämpar även smartare strategier för att hålla plattformen snabb, konsekvent och pålitlig.
Vi har nyligen gjort ytterligare optimeringar för att minska latensen och förbättra stabiliteten:
Minskat genomsnittliga svarstider med 100–200 ms;
Proaktivt undvikit latenstoppar under openAI:s trafiktoppar;
Du kan nu registrera SMS-funktionen med ditt Retell-nummer och skicka SMS under ett samtal. Lägg helt enkelt till en funktionsnod i ditt konversationsflöde eller använd den i en enkel eller flerstegsprompt.
Fler handledningar kommer snart!
Detektering av användarens knappsatsinmatning (User DTMF) 2.0
Vi har förbättrat vår knappsatsinmatningsfunktion för att bättre stödja olika scenarier för datainsamling. Du kan nu välja mellan flera metoder för att avsluta inmatning:
Avsluta med en specialtangent: Låt användare trycka på # eller * för att slutföra inmatningen. Användbart för att samla in information med variabel längd, som ID-nummer eller anteckningar.
Fast antal siffror: Avsluta inmatningen automatiskt efter ett visst antal siffror. Perfekt för fasta fält som de sista 4 siffrorna i ett personnummer.
Timeout-baserad avslutning: Om ingen inmatning tas emot efter en kort stund avslutas insamlingen automatiskt. Detta är aktiverat som standard.
Dessa alternativ gör det enklare att anpassa röstagentens beteende så att det passar exakt ditt arbetsflöde.
Du kan nu välja mellan två nivåer av brusreducering:
Ta bort brus: Filtrerar bort bakgrundsljud.
Ta bort brus + bakgrundstal: Filtrerar bort både brus och oönskat tal, som röster från TV-apparater eller närliggande samtal.
Perfekt för att öka transkriptionsnoggrannheten i bullriga miljöer.
Ekvationsbaserad övergång för konversationsflöde
Ekvationsbaserad övergång för konversationsflöde är nu live.
Inget behov av att skriva saker som {{dynamic_variable}} === value i din övergångsprompt längre.
Använd i stället en ekvationsbaserad övergång för bättre resultat.
Om du samlar in information under samtalet väljer du helt enkelt {{dynamic variable}} = value eller string = value i din ekvation för att hjälpa LLM:en att förstå och dirigera korrekt.
Retell MCP Server
Retell MCP Server är nu live:
Anslut din favorit-AI-assistent (ChatGPT, Claude, Cursor, Grok, m.fl.) direkt till Retells röstagentplattform:
Utlös riktiga telefonsamtal via din AI-assistent
Automatisera hela samtal med naturliga röstagenter
Samla in insikter för analys och uppföljning
Effektivisera arbetsflöden utan några manuella steg