Guider

Transkribera offline på Mac: lokalt med Whisper

Vissa samtal borde inte strömmas någonstans: ett läkarbesök, ett juridiskt samtal, ett styrelsemöte före ett tillkännagivande. För dem är frågan inte hur bra molnmodellen är, utan om ljudet alls behöver lämna datorn. På en Mac med Apple silicon behöver det inte det.

3 min läsning · Uppdaterad 2026-09-23

Vad som körs lokalt

På en Mac med Apple silicon kan appen ladda ner två modeller och köra dem på datorn: Whisper Large v3 Turbo för transkribering och Qwen 3 8B för svar. När de väl är nedladdade körs de på själva Macen, för sessioner vars ljud inte ska lämna rummet.

Valet mellan molnbearbetning och lokala modeller görs per användningsfall. En veckovis stand-up och ett samtal med en advokat behöver inte samma behandling, och du behöver inte välja ett alternativ för allt.

Vad som går vart, i varje läge

”Privat” används ofta oprecist, så det lönar sig att vara exakt.

  • Molnsession: ljudet från mikrofonen — och på Mac eventuellt systemljud och den fångade skärmen — strömmas till OpenAI:s Realtime API för att skapa transkriptet och svaren. Bilagor skickas som kontext.
  • Lokal session på Mac: de nedladdade modellerna bearbetar ljud och text på datorn.
  • I båda fallen sparas transkript, svar, sessioner, uppgifter och anteckningar på enheten, utan molnsynkronisering.
  • Appens backend lagrar konton, köp, kreditsaldo och användningsloggar. Den tar inte emot och lagrar inte ljud, transkript, svar eller bilagor.

Avvägningarna, ärligt

En modell som ryms på en laptop är mindre än en som körs i ett datacenter. Svaren från en modell med åtta miljarder parametrar räcker till mycket — plocka ut beslut, förklara ett begrepp, skissa ett uppföljningsmejl — men för bred kunskap eller långa resonemang är de märkbart svagare än en stor molnmodell.

Nedladdningen är flera gigabyte, och modellerna använder verkligen minne och processorkraft när de körs. På en ny Mac med Apple silicon går det bra; på en äldre går det långsammare. Det är också därför det är en Mac-funktion: en telefon har inte det utrymmet.

På iPhone och iPad

De stora lokala modellerna finns bara på Mac. På iPhone och iPad kan transkriberingen ändå komma från Apples taligenkänning på enheten i stället för från OpenAI:s modeller. Svaren kommer då fortfarande från molnmodellen: transkriptet av dina ord skapas på telefonen, hjälpen gör det inte.

Privat handlar också om dem i rummet

Att hålla ljudet på datorn skyddar det från tredje part. Det ändrar inte att du fångar det andra säger. De har rätt att veta, och på många håll kräver lagen det också — guiden om att spela in och transkribera andra förklarar vad du ska säga.

Vilka Mac-datorer kan köra de lokala modellerna?

Mac-datorer med Apple silicon. Modellerna laddas ner en gång och körs på datorn; nyare Mac-datorer är snabbare.

Körs de lokala modellerna på iPhone?

Nej. På iPhone och iPad kan transkriberingen komma från Apples taligenkänning på enheten, men den lokala svarsmodellen finns bara på Mac.

Ser appens servrar någonsin mina transkript?

Nej. Backend hanterar konton, köp och krediter; transkript och svar sparas på din enhet.

Transkribera offline på Mac: lokalt med Whisper