← Blog

Datenschutz bei Diktier-Apps im Vergleich: Wohin geht deine Stimme?

Manche Diktier-Apps verarbeiten deine Stimme komplett auf dem Gerät. Andere laden sie zuerst auf einen Server hoch. Manche speichern dieses Audio und trainieren damit KI-Modelle; andere verwerfen es sofort oder erheben es nie. Dieser Vergleich liest die Datenschutzseite jedes Anbieters – nicht den Werbetext –, um zu zeigen, was auf wen zutrifft.

Zuletzt aktualisiert: 5. Oktober 2026 · Datenschutzseiten der Anbieter geprüft am 19. Juli 2026

Die Kurzantwort: Wer verarbeitet Audio auf dem Gerät?

Geprüft auf der jeweiligen Herstellerseite am 19. Juli 2026: Superwhisper und MacWhisper verarbeiten Audio komplett auf dem Gerät, ohne Cloud-Option. Die Apple-Diktierfunktion nutzt standardmäßig die Verarbeitung auf dem Gerät für einen Teil des Ablaufs und die Cloud für den Rest; Hovor nutzt standardmäßig die Cloud und bietet auf unterstützten Geräten optional die Verarbeitung auf dem Gerät. Googles Gboard verarbeitet die einfache Spracheingabe standardmäßig auf dem Gerät. Wispr Flow erklärt: „Transcription always happens in the cloud“. Auf den Seiten von Aqua Voice, Otter.ai und Dragon Professional war kein Modus auf dem Gerät dokumentiert.

Warum „auf dem Gerät“ oder „Cloud“ die entscheidende Frage ist

Jede Diktier-App braucht ein Spracherkennungsmodell, das aus Audio Text macht. Dieses Modell läuft entweder lokal, auf demselben Chip, der deine Stimme aufnimmt, oder auf einem entfernten Server, der dein Audio über das Netzwerk erhält. Allein diese Tatsache entscheidet, ob die Infrastruktur eines Unternehmens deine Stimme je berührt – und ob das Audio gespeichert oder zum Training künftiger Modelle genutzt werden kann.

Verschlüsselung bei der Übertragung und eine gut formulierte Datenschutzerklärung senken das Risiko im Cloud-Modell, ändern aber nichts daran, dass dein Audio auf fremder Hardware angekommen ist – und genau darum dreht sich dieser Vergleich.

Datenschutzmodelle der Mitbewerber im Vergleich

Die Tabelle unten gibt nur wieder, was der jeweilige Anbieter auf seiner eigenen Datenschutzerklärung oder Produktseite angibt, abgerufen am 19. Juli 2026. Wo eine Anbieterseite eine Frage nicht behandelt, steht in der Zelle „nicht angegeben“ statt einer Vermutung. Die Quellenlinks führen zur genau geprüften Seite.

App Wo das Audio verarbeitet wird Genannter Cloud-Anbieter Audio gespeichert? Für KI-Training genutzt? Modus auf dem Gerät
Hovor (Cloud-Modus, Standard) Hovors Server: Transkription durch OpenAI oder Hovors selbst gehostetes Sprachmodell; Textformatierung über OpenAI Ja – OpenAI; mit eigenem Schlüssel der Anbieter, den du wählst Siehe Hovors Datenschutzerklärung Für den Cloud-Weg nicht angegeben Ja – optional, auf unterstützten Geräten (kostenloser Tarif mit Limit; ohne Wochenlimit mit Pro, unbegrenzt auf dem Gerät mit Local Unlock)
Hovor (Modus auf dem Gerät) Dein Gerät (Whisper oder Parakeet), auf unterstützten Geräten Auf dem Gerät, wenn das Modell geladen ist; Server-Fallback, solange es lädt Auf dem Gerät, wenn das Modell geladen ist; Server-Fallback, solange es lädt Entfällt Ja – das ist dieser Modus
Superwhisper Dein Gerät Entfällt – keine Cloud-Verarbeitung „Data is not retained on Superwhisper servers“ „Not being used for training AI models“ Ja – die ganze App läuft auf dem Gerät
MacWhisper Dein Gerät Entfällt – „no data leaves your device“ Nicht angegeben (lokale Verarbeitung impliziert) Nicht angegeben Ja – die ganze App läuft auf dem Gerät
Apple-Diktierfunktion Gerät oder Apples Server – die Tastatureinstellungen deines Geräts zeigen, was gilt Nicht genannt – „Apple servers“ Nicht gespeichert, außer du stimmst „Improve Siri and Dictation“ zu Nur bei Zustimmung (bis zu 2 Jahre aufbewahrt) Ja, geräteabhängig – in den Tastatureinstellungen offengelegt
Google Gboard (Spracheingabe) Gerät bei der normalen Spracheingabe; Googles Server bei „Fix it“ / detaillierten Änderungen Nicht genannt „No text or audio data is stored on Google servers“ (Funktion für detaillierte Änderungen) Nicht angegeben Ja – Standard bei der einfachen Spracheingabe
Wispr Flow Cloud – „Transcription always happens in the cloud“ Nicht genannt – „secure cloud servers“ Bedingt – keine, wenn der Privacy Mode an ist; sonst verarbeitet und ggf. wie unten genutzt Bedingt – im Privacy Mode ausgeschlossen; sonst „may be used to improve Flow's features and AI models“ Nicht angegeben
Aqua Voice Cloud (aus der serverseitigen Speicherung von Transkripten abzuleiten; nicht ausdrücklich genannt) Nicht genannt – „hosting services“ Bedingt – auf Servern gespeichert, wenn der Privacy Mode aus ist; nicht erhoben, wenn er an ist Nicht angegeben (nennt eine Nutzung der Daten „to improve the product“) Nicht angegeben
Otter.ai Cloud Ja – Amazon Web Services (allgemein für Rechenleistung/Speicher) „For as long as necessary“ – keine feste Dauer angegeben Ja – ausdrücklich, mit „de-identified audio recordings and transcriptions“ Nicht angegeben
Dragon Professional (Nuance / Microsoft) Auf den geprüften Seiten nicht angegeben Nicht angegeben Nicht angegeben Nicht angegeben Auf der Herstellerseite nicht angegeben (siehe Hinweis unten)

Hinweis zu Dragon: Nuances Produktseite zu Dragon Professional beschreibt Funktionen und geschäftliche Einsatzszenarien, gibt aber auf den geprüften Seiten nicht an, ob die Spracherkennung lokal oder in der Cloud läuft, und behandelt weder die Speicherung von Audio noch eine Nutzung für Training. Wir behaupten nicht, dass Dragon Audio lokal verarbeitet oder nicht – nur, dass die eigenen Seiten des Herstellers dies zum Zeitpunkt dieser Prüfung nicht dokumentieren. Deshalb steht in den Zellen oben „nicht angegeben“, statt Behauptungen Dritter zu wiederholen.

Wie Hovors zwei Modi tatsächlich funktionieren

Hovors Standard-Tarife (kostenlos und Pro) nutzen einen Cloud-Workflow: Dein Audio wird an Hovors Server gestreamt, der es dort transkribieren lässt – je nach Konfiguration von OpenAI oder von Hovors selbst gehostetem Spracherkennungsmodell. Die Textformatierung läuft über OpenAI (gpt-4o-mini). Mit deinem eigenen Schlüssel (BYOK) gehen Anfragen direkt an den Anbieter, den du wählst. Details stehen in der Datenschutzerklärung.

Die Spracherkennung auf dem Gerät – Whisper oder Parakeet, automatisch je nach Leistungsfähigkeit des Geräts gewählt (Parakeet braucht auf iOS etwa 4 GB RAM, Whisper etwa 6 GB) – läuft schon im kostenlosen Tarif, innerhalb desselben Kontingents von 2.000 Wörtern pro Woche wie das Cloud-Diktat; Local Unlock ($20.00 einmalig, Family-Sharing-fähig) oder ein Pro-Abo hebt dieses Limit auf. Ist das Modell auf dem Gerät geladen, läuft die Transkription komplett auf deinem Gerät, und das Audio wird nicht hochgeladen. Lädt das Modell noch – nach einem App-Neustart oder während des Downloads –, weicht diese Aufnahme auf die Transkription per Server aus. Die Textbereinigung läuft in diesem Modus nur auf iPhones mit Apple Intelligence (iOS 26+) auf dem Gerät, sonst über Hovor Cloud oder deinen BYOK-Schlüssel; den lokalen EuroLLM/MLX-Formatierungscode, der in Hovors Quellcode existiert, aber auf keiner Plattform funktioniert, nutzt sie nie. BYOK – in Pro enthalten oder als separates einmaliges BYOK Unlock erhältlich ($15.00) – lässt dich die Textbereinigung oder Ton-Formatierung über deinen eigenen API-Schlüssel (OpenAI, Anthropic oder eigener Endpunkt) leiten, der nur auf deinem Gerät im sicheren Anmeldedatenspeicher des Systems liegt (auf Apple-Geräten im Schlüsselbund, Service app.hovor.byok) und direkt von deinem Gerät an den gewählten Anbieter geht – nie über Hovors Server.

Was „Speicherung von Audio“ wirklich bedeutet – und warum die meisten Anbieter es nicht sagen

„Speicherung von Audio“ beantwortet eine einzige Frage: Existiert nach der Umwandlung deiner Sprache in Text noch eine Kopie der Aufnahme auf einem Server? Von den acht geprüften Seiten der Mitbewerber gaben nur drei eine direkte, uneingeschränkte Antwort: Superwhisper und MacWhisper (keine Speicherung – das Audio erreicht nie einen Server) sowie Otter.ai (gespeichert „for as long as necessary“, mit ausdrücklich genannter Nutzung für Training).

Die übrigen fünf machten die Speicherung von einer Einstellung abhängig (Wispr Flow, Aqua Voice), beschrieben sie als Opt-in (Apple), beschränkten sie auf eine Funktion (Google Gboard, „Fix it“) oder gingen auf den auffindbaren Seiten nicht darauf ein (Dragon). Eine fehlende Antwort ist selbst eine Information: Die Frage zur Speicherung muss dann durch Ausprobieren des Produkts oder das Lesen eines längeren Rechtstexts geklärt werden – nicht auf der Seite, die die meisten Nutzer tatsächlich lesen.

Häufige Fragen

Was bedeutet „auf dem Gerät“ bei einer Diktier-App, und warum ist das für den Datenschutz wichtig?

„Auf dem Gerät“ heißt, dass das Spracherkennungsmodell auf dem Chip deines Smartphones oder Computers läuft. Ist dieses Modell geladen und aktiv, bleibt das verarbeitete Audio auf dem Gerät: Es gibt keine Netzwerkanfrage, die deine Stimme transportiert und die jemand abfangen, protokollieren oder speichern könnte, weil gar keine gesendet wird. Diese Garantie gilt nur, sobald das Modell auf dem Gerät tatsächlich geladen ist – manche Apps, darunter Hovor, können auf die Transkription per Server ausweichen, wenn das lokale Modell beim Start einer Aufnahme noch lädt. Beim Cloud-Diktat wird dein Audio dagegen bei jeder Anfrage auf einen entfernten Server hochgeladen, wo ein Unternehmen, das du nicht kontrollierst, im Prinzip darauf zugreifen kann, bevor es ein Transkript zurückgibt. Bei Cloud-Diktat steht allein die Datenschutzerklärung des Anbieters zwischen deiner Stimme und seinen Servern – deshalb liest dieser Artikel diese Erklärungen direkt, statt dem Werbetext zu vertrauen.

Welche Diktier-Apps haben die Verarbeitung auf dem Gerät auf ihren eigenen Datenschutz- oder Produktseiten bestätigt (Stand 19. Juli 2026)?

Nach der jeweiligen Herstellerseite, geprüft am 19. Juli 2026: Superwhisper und MacWhisper geben beide an, dass die gesamte Verarbeitung lokal abläuft und kein Audio das Gerät verlässt. Hovor bietet die Verarbeitung auf dem Gerät über Whisper oder Parakeet als optionalen Modus auf unterstützten Geräten, im kostenlosen Tarif innerhalb des gemeinsamen Kontingents von 2.000 Wörtern pro Woche oder mit Local Unlock ($20.00 einmalig) unbegrenzt auf dem Gerät beziehungsweise mit Pro ohne Wochenlimit, neben einem Cloud-Modus als Standard. Apples eigene Seite sagt, dass dein Gerät in den Tastatureinstellungen offenlegt, ob das Diktat auf dem Gerät verarbeitet oder an Apples Server geschickt wird, und Googles Gboard verarbeitet die normale Spracheingabe standardmäßig auf dem Gerät, mit dokumentierten Ausnahmen („Fix it“ und detaillierte Änderungen), bei denen ein Server beteiligt ist. Auf den eigenen Seiten von Wispr Flow, Aqua Voice, Otter.ai und Dragon Professional war die Verarbeitung auf dem Gerät nicht als dokumentierter Modus angegeben – genaue Formulierungen und Links stehen in der Vergleichstabelle.

Schickt Hovor meine Stimme in die Cloud?

Im Cloud-Modus ja: Dein Audio geht zur Transkription an Hovors Server (transkribiert von OpenAI oder von Hovors selbst gehostetem Spracherkennungsmodell), und die Textformatierung läuft über OpenAI. Mit deinem eigenen Schlüssel gehen die Anfragen direkt an den Anbieter, den du wählst. Details stehen in der Datenschutzerklärung. Modelle auf dem Gerät (Whisper oder Parakeet) funktionieren schon im kostenlosen Tarif, innerhalb desselben Kontingents von 2.000 Wörtern pro Woche wie das Cloud-Diktat; Local Unlock ($20.00 einmalig) oder ein Pro-Abo hebt dieses Limit auf. Ist das Modell auf dem Gerät geladen, bleibt das Audio auf deinem Gerät; die Formatierung läuft nur auf iPhones mit Apple Intelligence (iOS 26+) auf dem Gerät, sonst über Hovor Cloud oder deinen BYOK-Schlüssel. Lädt das lokale Modell beim Start einer Aufnahme noch, weicht diese Aufnahme auf die Transkription per Server aus. Hovor besitzt keine DSGVO-, HIPAA- oder SOC-2-Zertifizierung – das hier beschreibt den technischen Datenfluss, keine Compliance-Bescheinigung.

Welche Datenschutzseiten der Mitbewerber geben an, Diktat-Audio für das Training von KI-Modellen zu nutzen?

Die Datenschutzerklärung von Otter.ai nennt ausdrücklich das Training seiner „proprietary AI technology on de-identified audio recordings and on transcriptions“. Wispr Flows Erklärung besagt, dass bei ausgeschaltetem optionalem Privacy Mode „your data may be used to improve Flow's features and AI models“ – ein eingeschalteter Privacy Mode schließt diese Nutzung laut Wispr Flows eigenem Wortlaut vollständig aus. Die eigenen Seiten von Superwhisper und MacWhisper geben an, dass Audio nicht für Training verwendet wird, passend zu ihrer Architektur komplett auf dem Gerät. Die Seite von Aqua Voice nennt gespeicherte Transkriptdaten (bei ausgeschaltetem Privacy Mode) als Grundlage, „to improve the product“, ohne das Wort „training“ zu verwenden. Apple gibt an, Audio nur dann zur Verbesserung von Siri und der Diktierfunktion zu verwenden, wenn ein Nutzer separat „Improve Siri and Dictation“ zustimmt, und es sonst nicht zu speichern. Die geprüften Seiten von Dragon und Google gingen auf die Nutzung von Diktat-Audio für KI-Training nicht gezielt ein.

Auf dem Gerät diktieren, wenn es zählt – in der Cloud, wenn du Tempo willst

Hovor bietet dir beides: einen kostenlosen Tarif (2.000 Wörter pro Woche, geteilt zwischen Cloud-Diktat und Diktat auf dem Gerät) und einen optionalen Modus auf dem Gerät auf unterstützten Geräten (Whisper oder Parakeet) – im kostenlosen Tarif innerhalb desselben Kontingents von 2.000 Wörtern pro Woche, unbegrenzt auf dem Gerät mit Local Unlock, ohne Wochenlimit mit Pro. Sobald das lokale Modell geladen ist, bleibt das Audio auf deinem Gerät.

Hovor holen