← Blog

Soukromí aplikací pro diktování: kam míří váš hlas?

Některé aplikace pro diktování zpracovávají váš hlas výhradně ve vašem zařízení. Jiné ho nejdřív nahrají na server. Některé ten zvuk uchovávají a používají k trénování modelů AI; jiné ho okamžitě zahodí nebo vůbec neshromažďují. Toto srovnání čte zásady ochrany soukromí každého výrobce, ne marketingové texty, aby ukázalo, co je co.

Poslední aktualizace: 5. října 2026 · Stránky výrobců o soukromí ověřeny 19. 7. 2026

Stručná odpověď: kdo zpracovává zvuk v zařízení

Podle stránky každého výrobce k 19. 7. 2026: Superwhisper a MacWhisper zpracovávají zvuk výhradně v zařízení, bez cloudové varianty. Apple Dictation ve výchozím nastavení zpracovává v zařízení část procesu a zbytek v cloudu; Hovor ve výchozím nastavení používá cloud a na podporovaných zařízeních nabízí volitelné zpracování v zařízení. Gboard od Googlu používá pro základní hlasové psaní ve výchozím nastavení zařízení. Wispr Flow uvádí, že přepis „always happens in the cloud“. Stránky Aqua Voice, Otter.ai a Dragon Professional režim v zařízení nedokumentovaly.

Proč je rozhodující otázka „v zařízení“, nebo „v cloudu“

Každá aplikace pro diktování potřebuje model rozpoznávání řeči, který převede zvuk na text. Ten model běží buď lokálně, na stejném čipu, který zachycuje váš hlas, nebo na vzdáleném serveru, který váš zvuk přijímá po síti. Tato jediná skutečnost určuje, zda se infrastruktura nějaké firmy vašeho hlasu vůbec dotkne a zda lze ten zvuk uchovávat nebo používat k trénování dalších modelů.

Šifrování při přenosu a dobře napsané zásady ochrany soukromí riziko v cloudovém modelu snižují, ale neodstraňují skutečnost, že váš zvuk dorazil na cizí hardware — a právě kolem toho je toto srovnání postavené.

Srovnání modelů soukromí u konkurence

Tabulka níže odráží jen to, co každý výrobce uvádí ve svých zásadách ochrany soukromí nebo na stránce produktu, stažených 19. 7. 2026. Tam, kde stránka výrobce otázku neřeší, buňka uvádí „neuvedeno“, ne odhad. Odkazy na zdroje míří na přesnou ověřenou stránku.

Aplikace Kde se zvuk zpracovává Uvedený poskytovatel cloudu Uchovává se zvuk? Používá se k trénování AI? Režim v zařízení
Hovor (cloudový režim, výchozí) Server Hovoru: přepis přes OpenAI nebo vlastní model Hovoru; úprava textu přes OpenAI Ano — OpenAI; s vlastním klíčem poskytovatel, kterého si zvolíte Viz zásady ochrany soukromí Hovoru U cloudové cesty neuvedeno Ano — volitelně, na podporovaných zařízeních (tarif Zdarma s limitem; bez omezení v zařízení s Local Unlock, bez týdenního limitu s Pro)
Hovor (režim v zařízení) Vaše zařízení (Whisper nebo Parakeet, na podporovaných zařízeních) V zařízení, když je model načtený; během načítání záloha na serveru V zařízení, když je model načtený; během načítání záloha na serveru Netýká se Ano — to je tento režim
Superwhisper Vaše zařízení Netýká se — žádné cloudové zpracování „Data is not retained on Superwhisper servers“ „Not being used for training AI models“ Ano — celá aplikace běží v zařízení
MacWhisper Vaše zařízení Netýká se — „no data leaves your device“ Neuvedeno (naznačeno jen lokální zpracování) Neuvedeno Ano — celá aplikace běží v zařízení
Apple Dictation Zařízení nebo servery Apple — která možnost platí, sděluje nastavení klávesnice vašeho zařízení Neuvedeno — „servery Apple“ Neukládá se, pokud se nepřihlásíte k programu zlepšování Siri a Diktování Jen při udělení souhlasu (uchování až 2 roky) Ano, podle zařízení — uvedeno v nastavení klávesnice
Gboard od Googlu, hlasové psaní Zařízení pro standardní hlasové psaní; servery Googlu pro „Fix it“ / podrobné úpravy Neuvedeno „No text or audio data is stored on Google servers“ (funkce podrobných úprav) Neuvedeno Ano — výchozí pro základní hlasové psaní
Wispr Flow Cloud — „Transcription always happens in the cloud“ Neuvedeno — „secure cloud servers“ Podmíněně — žádné při zapnutém Privacy Mode; jinak se zpracovává a může se použít podle dalšího sloupce Podmíněně — vyloučeno při Privacy Mode; jinak „may be used to improve Flow's features and AI models“ Neuvedeno
Aqua Voice Cloud (vyplývá z ukládání přepisů na serveru; výslovně neuvedeno) Neuvedeno — „hosting services“ Podmíněně — ukládá se na serverech při vypnutém Privacy Mode; při zapnutém se neshromažďuje Neuvedeno (uvádí, že data mohou být použita „to improve the product“) Neuvedeno
Otter.ai Cloud Ano — Amazon Web Services (obecně pro výpočty/úložiště) „For as long as necessary“ — pevná doba neuvedena Ano — výslovně, na „de-identified audio recordings and transcriptions“ Neuvedeno
Dragon Professional (Nuance / Microsoft) Na ověřených stránkách neuvedeno Neuvedeno Neuvedeno Neuvedeno Na stránce samotného výrobce neuvedeno (viz poznámka níže)

Poznámka k Dragonu: stránka produktu Dragon Professional od Nuance popisuje funkce a obchodní případy použití, ale na ověřených stránkách neuvádí, zda rozpoznávání řeči běží lokálně, nebo v cloudu, ani se nezabývá uchováváním zvuku či jeho použitím k trénování. Netvrdíme, že Dragon zvuk lokálně zpracovává nebo nezpracovává — jen že jeho vlastní stránky to k datu ověření nedokumentovaly, proto buňky výše uvádějí „neuvedeno“, místo aby opakovaly tvrzení třetích stran.

Jak ve skutečnosti fungují dva režimy Hovoru

Výchozí tarify Zdarma a Pro v Hovoru používají cloudový postup: váš zvuk se streamuje na server Hovoru, kde se přepíše — podle konfigurace službou OpenAI, nebo vlastním modelem rozpoznávání řeči Hovoru. Úprava textu probíhá přes OpenAI (gpt-4o-mini). S vlastním klíčem (BYOK) jdou požadavky přímo k poskytovateli, kterého si zvolíte. Podrobnosti jsou v zásadách ochrany soukromí.

Rozpoznávání řeči v zařízení — Whisper nebo Parakeet, vybírané automaticky podle schopností zařízení (Parakeet potřebuje zhruba 4 GB RAM zařízení s iOS; Whisper zhruba 6 GB) — funguje už v tarifu Zdarma v rámci stejného týdenního limitu 2 000 slov jako cloudové diktování; limit odstraní Local Unlock ($20.00 jednorázově, sdílitelný v rodině) nebo předplatné Pro. Když je model v zařízení načtený, přepis probíhá výhradně ve vašem zařízení a zvuk se nenahrává. Pokud se model ještě načítá — po restartu aplikace nebo během stahování — nahrávka se přepíše na serveru. Formátování v tomto režimu běží v zařízení jen na iPhonech s Apple Intelligence (iOS 26+), jinak přes Hovor Cloud nebo váš klíč BYOK; nikdy nepoužívá lokální formátovací kód EuroLLM/MLX, který ve zdrojovém kódu Hovoru existuje, ale dnes nefunguje na žádné platformě. BYOK — součást Pro, nebo samostatné jednorázové odemčení BYOK Unlock ($15.00) — umožňuje směrovat úpravu textu či formátování tónu na váš vlastní klíč API OpenAI, Anthropic nebo vlastního endpointu, uložený jen ve vašem zařízení v systémovém úložišti přihlašovacích údajů (na zařízeních Apple v Klíčence, služba app.hovor.byok) a odesílaný přímo z vašeho zařízení zvolenému poskytovateli — nikdy přes server Hovoru.

Co „uchovávání zvuku“ opravdu znamená — a proč to většina výrobců neuvádí

„Uchovávání zvuku“ odpovídá na jedinou otázku: když se vaše řeč změní na text, existuje na serveru stále kopie nahrávky? Z osmi ověřených stránek konkurence dala přímou a bezpodmínečnou odpověď jen tři: Superwhisper a MacWhisper (žádné uchovávání — zvuk se na server nikdy nedostane) a Otter.ai (uchovává „for as long as necessary“, s výslovně uvedeným použitím k trénování).

Zbývajících pět učinilo uchovávání podmíněným nastavením (Wispr Flow, Aqua Voice), popsalo ho jako vyžadující souhlas (Apple), omezilo ho na jednu funkci (Gboard, „Fix it“) nebo se mu na dohledaných stránkách nevěnovalo (Dragon). Chybějící odpověď je sama o sobě údaj: znamená, že na otázku uchovávání je nutné odpovědět testováním produktu nebo čtením delšího právního dokumentu, ne kontrolou stránky, kterou by uživatelé skutečně četli.

Časté dotazy

Co znamená u aplikace pro diktování „v zařízení“ a proč na tom pro soukromí záleží?

V zařízení znamená, že model rozpoznávání řeči běží přímo na čipu vašeho telefonu nebo počítače. Dokud je tento model načtený a aktivní, zvuk, který zpracovává, zůstává v zařízení: neexistuje žádný síťový požadavek, který by váš hlas nesl a který by šlo zachytit, zaznamenat nebo uchovat, protože se žádný neodesílá. Tato záruka platí jen tehdy, když je model v zařízení skutečně načtený — některé aplikace, včetně Hovoru, mohou přejít na přepis na serveru, pokud se místní model při zahájení nahrávky ještě načítá. Cloudové diktování naopak nahrává váš zvuk na vzdálený server při každém požadavku, kde se k němu může v zásadě dostat firma, kterou nekontrolujete, ještě než vrátí přepis. U cloudového diktování stojí mezi vaším hlasem a jejich servery jen zásady ochrany soukromí samotného výrobce — proto tento článek čte tyto zásady přímo, místo aby věřil marketingovým textům.

Které aplikace pro diktování mají zpracování v zařízení potvrzené na vlastních stránkách o soukromí nebo produktu, k 19. 7. 2026?

Podle stránky každého výrobce, ověřené 19. 7. 2026: Superwhisper i MacWhisper uvádějí, že veškeré zpracování probíhá lokálně a žádný zvuk zařízení neopouští. Hovor nabízí zpracování v zařízení pomocí Whisper nebo Parakeet na podporovaných zařízeních jako volitelný režim, dostupný v tarifu Zdarma v rámci sdíleného týdenního limitu 2 000 slov, nebo bez omezení v zařízení s Local Unlock ($20.00 jednorázově), bez týdenního limitu s Pro, vedle výchozího cloudového režimu. Stránka Apple uvádí, že vaše zařízení v nastavení klávesnice sděluje, zda se Diktování zpracovává v zařízení, nebo se posílá na servery Apple, a Gboard od Googlu ve výchozím nastavení používá pro standardní hlasové psaní zpracování v zařízení, s dokumentovanými výjimkami („Fix it“ a podrobné úpravy), které server zapojují. Stránky samotných výrobců Wispr Flow, Aqua Voice, Otter.ai a Dragon Professional zpracování v zařízení jako dokumentovaný režim neuvádějí — přesné znění a odkazy najdete v srovnávací tabulce.

Posílá Hovor můj hlas do cloudu?

V cloudovém režimu ano: váš zvuk jde k přepisu na server Hovoru (přepisuje ho OpenAI nebo vlastní model rozpoznávání řeči Hovoru) a úprava textu probíhá přes OpenAI. S vlastním klíčem jdou požadavky přímo k poskytovateli, kterého si zvolíte. Podrobnosti jsou v zásadách ochrany soukromí. Modely v zařízení (Whisper nebo Parakeet) fungují už v tarifu Zdarma v rámci stejného týdenního limitu 2 000 slov jako cloudové diktování; tento limit odstraní Local Unlock ($20.00 jednorázově) nebo předplatné Pro. Když je model v zařízení načtený, zvuk zůstává ve vašem zařízení; formátování běží v zařízení jen na iPhonech s Apple Intelligence (iOS 26+), jinak přes Hovor Cloud nebo váš klíč BYOK; pokud se místní model při zahájení nahrávky ještě načítá, nahrávka se přepíše na serveru. Hovor nemá žádnou certifikaci GDPR, HIPAA ani SOC 2 — popisuje se zde technický tok dat, ne atestace souladu s předpisy.

Které konkurenční stránky o soukromí uvádějí používání zvuku z diktování k trénování modelů AI?

Zásady ochrany soukromí Otter.ai výslovně uvádějí, že trénuje „proprietary AI technology on de-identified audio recordings and on transcriptions.“ Zásady Wispr Flow uvádějí, že při vypnutém volitelném Privacy Mode „your data may be used to improve Flow's features and AI models“ — zapnutí Privacy Mode toto použití podle znění Wispr Flow zcela odstraní. Stránky Superwhisper a MacWhisper uvádějí, že zvuk se k trénování nepoužívá, což odpovídá jejich plně lokální architektuře. Stránka Aqua Voice uvádí, že uchovaná data přepisů (při vypnutém Privacy Mode) se používají „to improve the product“, aniž by použila konkrétní slovo „trénování“. Apple uvádí, že zvuk se ke zlepšování Siri a Diktování používá jen tehdy, když se uživatel k tomu výslovně a samostatně přihlásí, a jinak se neukládá. Stránky Dragonu a Googlu, které jsme ověřili, se použitím zvuku z diktování k trénování AI konkrétně nezabývaly.

Diktujte v zařízení, když na tom záleží, a v cloudu, když chcete rychlost

Hovor nabízí obojí: tarif zdarma (2 000 slov týdně, společně pro cloudové diktování i diktování v zařízení) a volitelný režim v zařízení (Whisper nebo Parakeet) na podporovaných zařízeních, bez omezení v zařízení s Local Unlock, bez týdenního limitu s Pro — zvuk zůstává ve vašem zařízení, jakmile je místní model načtený.

Získat Hovor