Automatisch trennt Stimmen nach Tonhöhe und Klang. Bei „Selbst wählen“ tippst du unten, wer gerade spricht.
Höher: Stimmen werden eher als verschiedene Personen erkannt. Niedriger: weniger Personen, dafür weniger Verwechslungen bei einer Person.
Die Umwandlung von Sprache in Text übernimmt der Spracherkennungsdienst deines Browsers. Bei Chrome und Edge wird der Ton dafür an den Browser-Hersteller gesendet. Klartext selbst speichert keine Gespräche.