Introduktion
AI-talefunktioner gør det muligt for os at administrere systemer med stemmeinstruktioner, få svar fra computere på talte spørgsmål, generere undertekster ud fra lyd og meget mere. Stemmebaserede grænseflader giver en mere naturlig måde at interagere med AI-software på. Muligheden for at interagere gennem talt sprog kan øge tilgængeligheden og inklusiviteten af applikationer og agenter.
Ai-systemet skal understøtte mindst to funktioner for at aktivere denne form for interaktion:
- Tagenkendelse: evnen til at opdage og fortolke talt input
- Talesyntese: evnen til at generere talt output
Eksempler på disse funktioner inkluderer:
Klinisk diktering og notetagning i sundhedssektoren: Læger kan sige patientnoter højt under eller efter aftaler. En AI-tale-app konverterer lyden til korrekt medicinsk tekst, hvilket reducerer manuel skrivning og sparer tid.
Opkaldstransskription i kundesupport: Kontaktcentre transskriberer kundeopkald i realtid, hvilket gør det lettere at gennemgå samtaler, opdage problemer og analysere stemninger.
Automatiseret undertekstning i medier og underholdning: Videoplatforme genererer live eller optagede undertekster til shows og streams, hvilket forbedrer tilgængeligheden og understøtter flersprogede publikum.
Feedback om sprogindlæring og udtale i uddannelse: Læringsapps bruger AI-talefunktioner til at lytte til elever tale og give udtalefeedback, hvilket hjælper eleverne med at øve og forbedre talte sprogfærdigheder.
Stemmestyrede assistenter i detailhandel og e-handel: Virtuelle indkøbsassistenter bruger talegenkendelse til at forstå talte kundehenvendelser og tekst-til-tale til at svare med produktinformation eller ordrestatus.
Azure Speech i Microsoft Foundry Tools tilbyder tale-til-tekst, tekst-til-tale og taleoversættelse gennem talegenkendelse og syntese. Du kan bruge færdigbyggede og brugerdefinerede taletjenestemodeller til en række forskellige opgaver, fra transskribering af lyd til tekst med høj nøjagtighed, identificering af højttalere i samtaler, oprettelse af brugerdefinerede stemmer og meget mere. Lær dernæst, hvordan du inkorporerer talegenkendelse i en applikation med Azure Speech.
Bemærkning
Vi anerkender, at forskellige mennesker kan lide at lære på forskellige måder. Du kan vælge at gennemføre dette modul i videobaseret format, eller du kan læse indholdet som tekst og billeder. Teksten indeholder flere detaljer end videoerne, så i nogle tilfælde vil du måske henvise til den som supplerende materiale til videopræsentationen.