← Blog

Prywatność aplikacji do dyktowania: dokąd trafia Twój głos?

Niektóre aplikacje do dyktowania przetwarzają Twój głos w całości na urządzeniu. Inne najpierw wysyłają go na serwer. Część zachowuje to nagranie i wykorzystuje je do trenowania modeli AI; inne usuwają je od razu albo w ogóle nie zbierają. To porównanie opiera się na stronach prywatności samych producentów — nie na materiałach marketingowych — i pokazuje, jak to wygląda w każdym przypadku.

Ostatnia aktualizacja: 5 października 2026 · Strony prywatności producentów sprawdzone 2026-07-19

Krótka odpowiedź: kto przetwarza dźwięk na urządzeniu

Według stanu ze stron producentów z 2026-07-19: Superwhisper i MacWhisper przetwarzają dźwięk w całości na urządzeniu, bez opcji chmurowej. Dyktowanie Apple domyślnie przetwarza część procesu na urządzeniu, a resztę w chmurze; Hovor domyślnie korzysta z chmury i oferuje opcjonalne przetwarzanie na urządzeniu na obsługiwanych urządzeniach. Gboard od Google domyślnie używa urządzenia przy podstawowym pisaniu głosowym. Wispr Flow podaje, że transkrypcja „always happens in the cloud”. Strony Aqua Voice, Otter.ai i Dragon Professional nie opisywały trybu na urządzeniu.

Dlaczego „na urządzeniu” kontra „chmura” to pytanie, które się liczy

Każda aplikacja do dyktowania potrzebuje modelu rozpoznawania mowy, który zamienia dźwięk w tekst. Taki model działa albo lokalnie, na tym samym chipie, który rejestruje Twój głos, albo na zdalnym serwerze, który odbiera dźwięk przez sieć. Ten jeden fakt decyduje, czy infrastruktura firmy kiedykolwiek styka się z Twoim głosem i czy to nagranie może być przechowywane lub użyte do trenowania przyszłych modeli.

Szyfrowanie podczas przesyłania i dobrze napisana polityka prywatności zmniejszają ryzyko w modelu chmurowym, ale nie zmieniają faktu, że Twój dźwięk trafił na cudzy sprzęt — a właśnie wokół tego faktu zbudowane jest to porównanie.

Porównanie modeli prywatności konkurencji

Poniższa tabela odzwierciedla wyłącznie to, co każdy producent podaje na własnej stronie z polityką prywatności lub stronie produktu, pobranej 2026-07-19. Gdy strona producenta nie odpowiadała na dane pytanie, w komórce stoi „nie podano”, a nie domysł. Linki do źródeł prowadzą do dokładnie tych stron, które sprawdzono.

Aplikacja Gdzie przetwarzany jest dźwięk Wskazany dostawca chmury Czy dźwięk jest przechowywany? Czy służy do trenowania AI? Tryb na urządzeniu
Hovor (tryb chmurowy, domyślny) Serwer Hovor: transkrypcja przez OpenAI lub własny model Hovor; formatowanie tekstu przez OpenAI Tak — OpenAI; z własnym kluczem dostawca wybrany przez Ciebie Zobacz politykę prywatności Hovor Nie podano dla ścieżki chmurowej Tak — opcjonalnie, na obsługiwanych urządzeniach (plan bezpłatny z limitem; bez limitu na urządzeniu z Local Unlock, bez tygodniowego limitu z Pro)
Hovor (tryb na urządzeniu) Twoje urządzenie (Whisper lub Parakeet), na obsługiwanych urządzeniach Na urządzeniu, gdy model jest załadowany; w trakcie ładowania transkrypcja na serwerze Na urządzeniu, gdy model jest załadowany; w trakcie ładowania transkrypcja na serwerze Nie dotyczy Tak — to jest ten tryb
Superwhisper Twoje urządzenie Nie dotyczy — brak przetwarzania w chmurze „Data is not retained on Superwhisper servers” „Not being used for training AI models” Tak — cała aplikacja działa na urządzeniu
MacWhisper Twoje urządzenie Nie dotyczy — „no data leaves your device” Nie podano (z kontekstu wynika, że tylko lokalnie) Nie podano Tak — cała aplikacja działa na urządzeniu
Dyktowanie Apple Urządzenie albo serwery Apple — ustawienia klawiatury na urządzeniu pokazują, co ma zastosowanie Nie wskazano — „Apple servers” Nie jest zapisywany, chyba że włączysz „Improve Siri and Dictation” Tylko po włączeniu opcji (przechowywane do 2 lat) Tak, zależnie od urządzenia — widoczne w ustawieniach klawiatury
Pisanie głosowe Google Gboard Urządzenie przy standardowym pisaniu głosowym; serwery Google dla „Fix it” / szczegółowych edycji Nie wskazano „No text or audio data is stored on Google servers” (funkcja szczegółowych edycji) Nie podano Tak — domyślnie przy podstawowym pisaniu głosowym
Wispr Flow Chmura — „Transcription always happens in the cloud” Nie wskazano — „secure cloud servers” Warunkowo — brak, jeśli Privacy Mode jest włączony; w przeciwnym razie przetwarzane i mogą być wykorzystane, jak niżej Warunkowo — wyłączone przy Privacy Mode; w przeciwnym razie „may be used to improve Flow's features and AI models” Nie podano
Aqua Voice Chmura (wynika z przechowywania transkryptów po stronie serwera; nie nazwano wprost) Nie wskazano — „hosting services” Warunkowo — zapisywane na serwerach, jeśli Privacy Mode jest wyłączony; nie są gromadzone, jeśli jest włączony Nie podano (strona wspomina, że dane mogą być użyte „to improve the product”) Nie podano
Otter.ai Chmura Tak — Amazon Web Services (ogólnie do obliczeń i przechowywania) „For as long as necessary” — nie podano stałego okresu Tak — wprost, na „de-identified audio recordings and transcriptions” Nie podano
Dragon Professional (Nuance / Microsoft) Nie podano na sprawdzonych stronach Nie podano Nie podano Nie podano Nie podano na własnej stronie producenta (zob. uwagę poniżej)

Uwaga o Dragon: strona produktu Nuance Dragon Professional opisuje funkcje i zastosowania biznesowe, ale na sprawdzonych stronach nie podaje, czy rozpoznawanie mowy działa lokalnie, czy w chmurze, ani nie odnosi się do przechowywania dźwięku i użycia go do trenowania. Nie twierdzimy, że Dragon przetwarza dźwięk lokalnie ani że nie — jedynie że jego własne strony tego nie dokumentowały w chwili sprawdzenia, dlatego komórki powyżej mówią „nie podano”, zamiast powtarzać twierdzenia osób trzecich.

Jak naprawdę działają dwa tryby Hovor

Domyślne plany bezpłatny i Pro w Hovor korzystają z przepływu w chmurze: Twój dźwięk jest przesyłany strumieniowo na serwer Hovor, gdzie jest transkrybowany — zależnie od konfiguracji przez OpenAI albo własny model rozpoznawania mowy Hovor. Formatowanie tekstu odbywa się przez OpenAI (gpt-4o-mini). Z własnym kluczem (BYOK) żądania trafiają bezpośrednio do wybranego przez Ciebie dostawcy. Szczegóły w polityce prywatności.

Rozpoznawanie mowy na urządzeniu — Whisper lub Parakeet, wybierane automatycznie zależnie od możliwości urządzenia (Parakeet wymaga mniej więcej 4 GB pamięci RAM w urządzeniu z iOS, Whisper mniej więcej 6 GB) — działa już w planie bezpłatnym, w ramach tej samej puli 2 000 słów tygodniowo co dyktowanie w chmurze; Local Unlock ($20.00 jednorazowo, do współdzielenia w rodzinie) lub subskrypcja Pro znosi ten limit. Gdy model na urządzeniu jest załadowany, transkrypcja odbywa się w całości na Twoim urządzeniu, a dźwięk nie jest wysyłany. Jeśli model jeszcze się ładuje — po ponownym uruchomieniu aplikacji albo w trakcie pobierania — to nagranie jest zamiast tego transkrybowane na serwerze. Formatowanie działa na urządzeniu tylko na iPhone'ach z Apple Intelligence (iOS 26+), a w pozostałych przypadkach przez Hovor Cloud lub Twój klucz BYOK; nigdy nie korzysta z lokalnego kodu formatowania EuroLLM/MLX, który istnieje w kodzie źródłowym Hovor, ale obecnie nie działa na żadnej platformie. BYOK — wliczony w Pro albo dostępny jako osobny jednorazowy BYOK Unlock ($15.00) — pozwala skierować porządkowanie tekstu lub formatowanie tonu do Twojego własnego klucza API OpenAI, Anthropic lub niestandardowego endpointu, przechowywanego wyłącznie na Twoim urządzeniu w systemowym magazynie poświadczeń (na urządzeniach Apple w pęku kluczy, usługa app.hovor.byok) i wysyłanego prosto z Twojego urządzenia do wybranego dostawcy — nigdy przez serwer Hovor.

Co naprawdę oznacza „przechowywanie dźwięku” — i dlaczego większość producentów o tym nie mówi

„Przechowywanie dźwięku” odpowiada na jedno pytanie: czy po zamianie mowy w tekst kopia nagrania nadal istnieje na serwerze? Spośród ośmiu sprawdzonych stron konkurentów tylko trzy dały bezpośrednią, bezwarunkową odpowiedź: Superwhisper i MacWhisper (brak przechowywania — dźwięk nigdy nie trafia na serwer) oraz Otter.ai (przechowywane „for as long as necessary”, z wprost podanym użyciem do trenowania).

Pozostałych pięć uzależniło przechowywanie od ustawienia (Wispr Flow, Aqua Voice), opisało je jako opcjonalne (Apple), ograniczyło do jednej funkcji (Gboard od Google, „Fix it”) albo nie odniosło się do niego na stronach, które udało się znaleźć (Dragon). Brak odpowiedzi sam w sobie jest informacją: oznacza, że na pytanie o przechowywanie trzeba odpowiedzieć, testując produkt albo czytając dłuższy dokument prawny, a nie sprawdzając stronę, którą przeczytałby przeciętny użytkownik.

Najczęściej zadawane pytania

Co oznacza „na urządzeniu” w aplikacji do dyktowania i dlaczego ma to znaczenie dla prywatności?

„Na urządzeniu” oznacza, że model rozpoznawania mowy działa na chipie Twojego telefonu lub komputera. Gdy ten model jest załadowany i aktywny, przetwarzany przez niego dźwięk zostaje na urządzeniu: nie ma żądania sieciowego niosącego Twój głos, które dałoby się przechwycić, zalogować lub zachować, bo żadne nie jest wysyłane. Ta gwarancja obowiązuje dopiero wtedy, gdy model na urządzeniu jest faktycznie załadowany — niektóre aplikacje, w tym Hovor, potrafią wrócić do transkrypcji na serwerze, jeśli lokalny model wciąż się ładuje w chwili rozpoczęcia nagrania. Dyktowanie w chmurze natomiast przy każdym żądaniu przesyła Twój dźwięk na zdalny serwer, gdzie firma, której nie kontrolujesz, może w zasadzie uzyskać do niego dostęp, zanim zwróci transkrypt. W dyktowaniu w chmurze między Twoim głosem a serwerami producenta stoi wyłącznie jego własna polityka prywatności — dlatego ten artykuł czyta te polityki wprost, zamiast ufać materiałom marketingowym.

Które aplikacje do dyktowania mają potwierdzone przetwarzanie na urządzeniu na własnych stronach prywatności lub produktu, według stanu na 2026-07-19?

Według strony każdego producenta, sprawdzonej 2026-07-19: Superwhisper i MacWhisper podają, że całe przetwarzanie odbywa się lokalnie, a dźwięk nie opuszcza urządzenia. Hovor oferuje przetwarzanie na urządzeniu przez Whisper lub Parakeet jako opcjonalny tryb na obsługiwanych urządzeniach, dostępny w planie bezpłatnym w ramach wspólnej puli 2 000 słów tygodniowo albo bez limitu na urządzeniu z Local Unlock ($20.00 jednorazowo), bez tygodniowego limitu z Pro, obok domyślnego trybu chmurowego. Strona Apple podaje, że ustawienia klawiatury na urządzeniu pokazują, czy Dyktowanie jest przetwarzane na urządzeniu, czy wysyłane na serwery Apple, a Gboard od Google domyślnie używa urządzenia przy standardowym pisaniu głosowym, z udokumentowanymi wyjątkami („Fix it” i szczegółowe edycje), które wymagają udziału serwera. Własne strony Wispr Flow, Aqua Voice, Otter.ai i Dragon Professional nie opisywały przetwarzania na urządzeniu jako udokumentowanego trybu — dokładne sformułowania i linki znajdziesz w tabeli porównawczej.

Czy Hovor wysyła mój głos do chmury?

W trybie chmurowym tak: Twój dźwięk trafia na serwer Hovor w celu transkrypcji (wykonuje ją OpenAI albo własny model rozpoznawania mowy Hovor), a formatowanie tekstu odbywa się przez OpenAI. Z własnym kluczem żądania trafiają bezpośrednio do wybranego przez Ciebie dostawcy. Szczegóły w polityce prywatności. Modele na urządzeniu (Whisper lub Parakeet) działają już w planie bezpłatnym, w ramach tej samej puli 2 000 słów tygodniowo co dyktowanie w chmurze; Local Unlock ($20.00 jednorazowo) lub subskrypcja Pro znosi ten limit. Gdy model na urządzeniu jest załadowany, dźwięk zostaje na Twoim urządzeniu; formatowanie działa na urządzeniu tylko na iPhone'ach z Apple Intelligence (iOS 26+), a w pozostałych przypadkach przez Hovor Cloud lub Twój klucz BYOK; jeśli lokalny model wciąż się ładuje w chwili rozpoczęcia nagrania, to nagranie jest zamiast tego transkrybowane na serwerze. Hovor nie ma certyfikacji RODO, HIPAA ani SOC 2 — to opis technicznego przepływu danych, a nie zaświadczenie o zgodności.

Które strony prywatności konkurentów ujawniały użycie dźwięku z dyktowania do trenowania modeli AI?

Polityka prywatności Otter.ai wprost podaje, że trenuje „proprietary AI technology on de-identified audio recordings and on transcriptions”. Polityka Wispr Flow podaje, że przy wyłączonym opcjonalnym Privacy Mode „your data may be used to improve Flow's features and AI models” — włączenie Privacy Mode całkowicie usuwa to wykorzystanie, według własnego sformułowania Wispr Flow. Strony Superwhisper i MacWhisper podają, że dźwięk nie jest używany do trenowania, co jest spójne z ich w pełni lokalną architekturą. Strona Aqua Voice podaje, że przechowywane dane transkryptów (przy wyłączonym Privacy Mode) są używane „to improve the product”, bez użycia konkretnego słowa „trenowanie”. Apple podaje, że dźwięk służy do ulepszania Siri i Dyktowania wyłącznie wtedy, gdy użytkownik osobno włączy „Improve Siri and Dictation”, a poza tym nie jest zapisywany. Sprawdzone strony Dragon i Google nie odnosiły się konkretnie do użycia dźwięku z dyktowania do trenowania AI.

Dyktuj na urządzeniu, gdy to ważne, i w chmurze, gdy liczy się szybkość

Hovor daje Ci jedno i drugie: bezpłatny plan z chmurą (2 000 słów tygodniowo, wspólnych dla dyktowania w chmurze i na urządzeniu) oraz opcjonalny tryb na urządzeniu na obsługiwanych urządzeniach (Whisper lub Parakeet), który działa już w planie bezpłatnym w ramach tej samej puli, a bez limitu na urządzeniu z Local Unlock, bez tygodniowego limitu z Pro — dźwięk zostaje na Twoim urządzeniu po załadowaniu lokalnego modelu.

Pobierz Hovor