Transkrypcja offline na Macu: prywatnie, z Whisperem
Niektóre rozmowy nie powinny być nigdzie przesyłane: wizyta u lekarza, rozmowa z prawnikiem, posiedzenie zarządu przed ogłoszeniem. W ich przypadku pytanie nie brzmi, jak dobry jest model w chmurze, tylko czy dźwięk w ogóle musi opuszczać komputer. Na Macu z Apple silicon nie musi.
Co działa lokalnie
Na Macu z Apple silicon aplikacja może pobrać dwa modele i uruchamiać je na komputerze: Whisper Large v3 Turbo do transkrypcji i Qwen 3 8B do odpowiedzi. Po pobraniu działają na samym Macu — w sesjach, których dźwięk nie powinien opuszczać pokoju.
Wybór między przetwarzaniem w chmurze a modelami lokalnymi robi się osobno dla każdego zastosowania. Cotygodniowy stand-up i rozmowa z prawniczką nie wymagają tego samego podejścia i nie trzeba wybierać jednego do wszystkiego.
Co gdzie trafia w każdym trybie
Słowa „prywatny” często używa się nieprecyzyjnie, więc warto być dokładnym.
- Sesja w chmurze: dźwięk z mikrofonu — a na Macu opcjonalnie dźwięk systemowy i przechwycony ekran — jest przesyłany do Realtime API OpenAI, by powstały transkrypcja i odpowiedzi. Załączniki są wysyłane jako kontekst.
- Sesja lokalna na Macu: pobrane modele przetwarzają dźwięk i tekst na komputerze.
- W obu przypadkach transkrypcje, odpowiedzi, sesje, zadania i notatki są zapisywane na urządzeniu, bez synchronizacji z chmurą.
- Backend aplikacji przechowuje konta, zakupy, saldo kredytów i rejestry użycia. Nie odbiera ani nie przechowuje dźwięku, transkrypcji, odpowiedzi ani załączników.
Kompromisy, szczerze
Model, który mieści się na laptopie, jest mniejszy niż ten, który działa w centrum danych. Odpowiedzi modelu z ośmioma miliardami parametrów wystarczą do wielu rzeczy — wyłuskania decyzji, wyjaśnienia terminu, szkicu wiadomości po spotkaniu — ale przy szerokiej wiedzy i długich rozumowaniach są wyraźnie słabsze od dużego modelu w chmurze.
Pobieranie waży kilka gigabajtów, a modele w trakcie pracy naprawdę zużywają pamięć i moc obliczeniową. Na nowym Macu z Apple silicon to nie problem; na starszym działa wolniej. Dlatego to funkcja Maca: telefon nie ma takiego zapasu.
Na iPhonie i iPadzie
Duże modele lokalne są tylko na Macu. Na iPhonie i iPadzie transkrypcję i tak może wykonywać rozpoznawanie mowy Apple na urządzeniu zamiast modeli OpenAI. Odpowiedzi nadal przychodzą wtedy z modelu w chmurze: transkrypcja twoich słów powstaje na telefonie, pomoc już nie.
Prywatność dotyczy też ludzi w pokoju
Zatrzymanie dźwięku na komputerze chroni go przed osobami trzecimi. Nie zmienia to faktu, że zapisujesz to, co mówią inni. Mają prawo o tym wiedzieć, a w wielu miejscach wymaga tego także prawo — poradnik o nagrywaniu i transkrypcji innych osób wyjaśnia, co powiedzieć.
Na jakich Macach działają modele lokalne?
Na Macach z Apple silicon. Modele pobiera się raz i działają na komputerze; nowsze Maki są szybsze.
Czy modele lokalne działają na iPhonie?
Nie. Na iPhonie i iPadzie transkrypcję może wykonywać rozpoznawanie mowy Apple na urządzeniu, ale lokalny model odpowiedzi jest tylko na Macu.
Czy serwery aplikacji widzą moje transkrypcje?
Nie. Backend obsługuje konta, zakupy i kredyty; transkrypcje i odpowiedzi są zapisywane na twoim urządzeniu.
