Poradniki

Transkrypcja offline na Macu: prywatnie, z Whisperem

Niektóre rozmowy nie powinny być nigdzie przesyłane: wizyta u lekarza, rozmowa z prawnikiem, posiedzenie zarządu przed ogłoszeniem. W ich przypadku pytanie nie brzmi, jak dobry jest model w chmurze, tylko czy dźwięk w ogóle musi opuszczać komputer. Na Macu z Apple silicon nie musi.

3 min czytania · Zaktualizowano 2026-09-23

Co działa lokalnie

Na Macu z Apple silicon aplikacja może pobrać dwa modele i uruchamiać je na komputerze: Whisper Large v3 Turbo do transkrypcji i Qwen 3 8B do odpowiedzi. Po pobraniu działają na samym Macu — w sesjach, których dźwięk nie powinien opuszczać pokoju.

Wybór między przetwarzaniem w chmurze a modelami lokalnymi robi się osobno dla każdego zastosowania. Cotygodniowy stand-up i rozmowa z prawniczką nie wymagają tego samego podejścia i nie trzeba wybierać jednego do wszystkiego.

Co gdzie trafia w każdym trybie

Słowa „prywatny” często używa się nieprecyzyjnie, więc warto być dokładnym.

  • Sesja w chmurze: dźwięk z mikrofonu — a na Macu opcjonalnie dźwięk systemowy i przechwycony ekran — jest przesyłany do Realtime API OpenAI, by powstały transkrypcja i odpowiedzi. Załączniki są wysyłane jako kontekst.
  • Sesja lokalna na Macu: pobrane modele przetwarzają dźwięk i tekst na komputerze.
  • W obu przypadkach transkrypcje, odpowiedzi, sesje, zadania i notatki są zapisywane na urządzeniu, bez synchronizacji z chmurą.
  • Backend aplikacji przechowuje konta, zakupy, saldo kredytów i rejestry użycia. Nie odbiera ani nie przechowuje dźwięku, transkrypcji, odpowiedzi ani załączników.

Kompromisy, szczerze

Model, który mieści się na laptopie, jest mniejszy niż ten, który działa w centrum danych. Odpowiedzi modelu z ośmioma miliardami parametrów wystarczą do wielu rzeczy — wyłuskania decyzji, wyjaśnienia terminu, szkicu wiadomości po spotkaniu — ale przy szerokiej wiedzy i długich rozumowaniach są wyraźnie słabsze od dużego modelu w chmurze.

Pobieranie waży kilka gigabajtów, a modele w trakcie pracy naprawdę zużywają pamięć i moc obliczeniową. Na nowym Macu z Apple silicon to nie problem; na starszym działa wolniej. Dlatego to funkcja Maca: telefon nie ma takiego zapasu.

Na iPhonie i iPadzie

Duże modele lokalne są tylko na Macu. Na iPhonie i iPadzie transkrypcję i tak może wykonywać rozpoznawanie mowy Apple na urządzeniu zamiast modeli OpenAI. Odpowiedzi nadal przychodzą wtedy z modelu w chmurze: transkrypcja twoich słów powstaje na telefonie, pomoc już nie.

Prywatność dotyczy też ludzi w pokoju

Zatrzymanie dźwięku na komputerze chroni go przed osobami trzecimi. Nie zmienia to faktu, że zapisujesz to, co mówią inni. Mają prawo o tym wiedzieć, a w wielu miejscach wymaga tego także prawo — poradnik o nagrywaniu i transkrypcji innych osób wyjaśnia, co powiedzieć.

Na jakich Macach działają modele lokalne?

Na Macach z Apple silicon. Modele pobiera się raz i działają na komputerze; nowsze Maki są szybsze.

Czy modele lokalne działają na iPhonie?

Nie. Na iPhonie i iPadzie transkrypcję może wykonywać rozpoznawanie mowy Apple na urządzeniu, ale lokalny model odpowiedzi jest tylko na Macu.

Czy serwery aplikacji widzą moje transkrypcje?

Nie. Backend obsługuje konta, zakupy i kredyty; transkrypcje i odpowiedzi są zapisywane na twoim urządzeniu.

Transkrypcja offline na Macu: prywatnie, z Whisperem