Polityka prywatności ScanSpeak
1. Czym jest ScanSpeak
ScanSpeak to aplikacja na Androida do skanowania stron książek, rozpoznawania tekstu (OCR), zapisywania treści lokalnie na urządzeniu, tłumaczenia tekstu na inne języki oraz odczytywania tekstu na głos.
2. Jakie dane przetwarza aplikacja
Aplikacja może przetwarzać następujące dane zapisane lub używane przez użytkownika:
- obrazy zeskanowanych stron,
- tekst rozpoznany metodą OCR oraz tekst dodany ze schowka lub z plików,
- tłumaczenia tekstu skanów,
- tytuły skanów i metadane porządkowe,
- ustawienia języka, głosu, szybkości czytania i tłumaczenia,
- zapamiętane miejsce wznowienia odczytu,
- pliki audio utworzone funkcją „Eksportuj do audio”,
- pobrane modele językowe do tłumaczenia,
- dane techniczne potrzebne do działania systemowego odczytu na głos i powiadomień.
3. Gdzie dane są przechowywane
Dane skanów, tekst OCR, tłumaczenia, preferencje oraz stan wznowienia są przechowywane lokalnie na urządzeniu użytkownika w pamięci aplikacji. W aktualnym buildzie release backup danych użytkownika został wyłączony, aby nie kopiować treści książek i historii czytania do backupu systemowego.
Modele językowe do tłumaczenia są zapisywane na urządzeniu przez bibliotekę Google ML Kit.
Pliki utworzone funkcją „Eksportuj do audio” są zapisywane w publicznym folderze
Music/ScanSpeak, dzięki czemu można je odtworzyć w innych aplikacjach.
4. Kiedy dane opuszczają urządzenie
4.1. Poprawa tekstu (LanguageTool)
Aby poprawić błędy rozpoznawania tekstu, aplikacja wysyła rozpoznany tekst stron do zewnętrznej usługi LanguageTool (LanguageTooler GmbH), która zwraca sugestie ortograficzne i gramatyczne. Dzieje się to:
- automatycznie po zapisaniu nowego skanu z aparatu, po utworzeniu skanu z pliku oraz po dodaniu stron do skanu ze zdjęć lub plików,
- po ręcznym użyciu funkcji „Popraw tekst”.
Tekst dodany ze schowka nie jest wysyłany automatycznie. Wysyłana jest wyłącznie treść tekstowa stron wraz z kodem języka — bez obrazów, tytułów i identyfikatorów użytkownika. Gdy urządzenie nie ma połączenia z internetem, aplikacja stosuje tylko lokalne formatowanie tekstu.
Adres używany przez aplikację: https://api.languagetool.org/v2/check.
Przetwarzanie danych przez LanguageTool opisuje
polityka prywatności LanguageTool.
4.2. Tłumaczenie tekstu
Tłumaczenie odbywa się na urządzeniu za pomocą Google ML Kit — treść skanów i tłumaczeń nie jest wysyłana na żaden serwer. Przy pierwszym użyciu danego języka aplikacja pobiera z serwerów Google jego model językowy (ok. 30 MB). Użytkownik może ograniczyć pobieranie modeli do sieci Wi-Fi i usuwać pobrane modele w ustawieniach aplikacji.
4.3. Google ML Kit i Usługi Google Play
Rozpoznawanie tekstu (OCR), skaner dokumentów i tłumaczenie korzystają z biblioteki Google ML Kit oraz Usług Google Play. Przetwarzanie obrazów i tekstu odbywa się na urządzeniu. Model rozpoznawania tekstu jest dostarczany przez Usługi Google Play.
ML Kit przesyła do Google dane techniczne w celach diagnostycznych i statystyk użycia: informacje o urządzeniu (producent, model, wersja systemu), nazwę pakietu i wersję aplikacji, metryki wydajności oraz konfigurację użytych funkcji, a w przypadku tłumaczenia także wybrany język źródłowy i docelowy. Na potrzeby tłumaczenia ML Kit korzysta z usług Firebase Installations i Firebase Remote Config, które używają identyfikatora instalacji aplikacji. Dane są szyfrowane w transmisji (HTTPS). Obrazy stron ani treść tekstu nie są w ten sposób przesyłane.
Szczegóły: informacje Google o danych zbieranych przez ML Kit oraz Polityka prywatności Google.
4.4. Odczyt na głos
Odczyt na głos korzysta z silnika syntezy mowy zainstalowanego w systemie (np. Google lub Samsung). Głosy offline przetwarzają tekst na urządzeniu. Jeśli użytkownik wybierze w ustawieniach głos oznaczony jako online, silnik syntezy mowy może przesyłać czytany tekst na serwery swojego dostawcy zgodnie z jego polityką prywatności.
5. Uprawnienia i funkcje systemowe
- Skaner dokumentów (Usługi Google Play) — do skanowania stron; aparat obsługują Usługi Google Play, aplikacja nie prosi o uprawnienie do aparatu.
- Internet — do poprawy tekstu przez LanguageTool, pobierania modeli językowych i przesyłania danych diagnostycznych ML Kit.
- Stan sieci — do sprawdzenia, czy urządzenie jest połączone z Wi-Fi, gdy włączone jest pobieranie modeli tylko przez Wi-Fi.
- Powiadomienia — do sterowania czytaniem w tle i informowania o eksporcie audio.
- Foreground service (media playback) — aby odczyt na głos mógł działać po zminimalizowaniu aplikacji.
- Foreground service (data sync) — aby eksport do audio mógł dokończyć się w tle.
6. Reklamy, analityka, konta użytkowników
W przeanalizowanym buildzie produkcyjnym ScanSpeak:
- nie wymaga zakładania konta,
- nie wyświetla reklam,
- nie zawiera własnej analityki ani SDK analitycznych do śledzenia zachowania użytkownika; jedyne dane diagnostyczne to dane techniczne przesyłane przez Google ML Kit, opisane w punkcie 4.3.
7. Jak usunąć dane
- Usunięcie skanu w aplikacji usuwa powiązany tekst, tłumaczenia i zapisane pliki stron z pamięci aplikacji.
- Pobrane modele językowe można usunąć w ustawieniach aplikacji, w karcie „Tłumaczenie”.
- Pliki z eksportu audio w folderze
Music/ScanSpeakmożna usunąć menedżerem plików. - Odinstalowanie aplikacji usuwa wszystkie dane zapisane w pamięci aplikacji.
8. Udostępnianie danych osobom trzecim
Dane nie są sprzedawane. W normalnym działaniu aplikacji dane trafiają poza urządzenie wyłącznie w sposób opisany w punkcie 4:
- tekst stron — do LanguageTool w celu poprawy tekstu (punkt 4.1),
- dane techniczne i pobieranie modeli językowych — do Google przez ML Kit i Usługi Google Play (punkty 4.2 i 4.3),
- czytany tekst — do dostawcy silnika syntezy mowy, tylko gdy użytkownik wybierze głos online (punkt 4.4).
9. Kontakt
W sprawach prywatności i działania aplikacji skontaktuj się pod adresem: tomasz.paciorek81@gmail.com
10. Zmiany polityki
Ta polityka może być aktualizowana wraz ze zmianami funkcji aplikacji, sposobu przetwarzania danych lub wymagań Google Play.