Ratgeber

Offline-Transkription auf dem Mac: Whisper lokal nutzen

Manche Gespräche sollten nirgendwohin gestreamt werden: ein Arzttermin, ein Rechtsgespräch, eine Vorstandssitzung vor einer Ankündigung. Bei diesen Gesprächen ist die Frage nicht, wie gut das Cloud-Modell ist, sondern ob der Ton den Rechner überhaupt verlassen muss. Auf einem Mac mit Apple Silicon muss er das nicht.

3 Min. Lesezeit · Aktualisiert 2026-09-23

Was lokal läuft

Auf einem Mac mit Apple Silicon kann die App zwei Modelle herunterladen und auf dem Rechner ausführen: Whisper Large v3 Turbo für die Transkription und Qwen 3 8B für die Antworten. Einmal heruntergeladen, laufen sie auf dem Mac selbst, für Sitzungen, deren Ton den Raum nicht verlassen soll.

Die Wahl zwischen Cloud-Verarbeitung und lokalen Modellen treffen Sie pro Anwendungsfall. Ein wöchentliches Standup und ein Gespräch mit einer Anwältin brauchen nicht dieselbe Behandlung, und Sie müssen sich nicht für alles auf eines festlegen.

Was wohin geht, je nach Modus

„Privat“ wird oft unscharf verwendet, deshalb lohnt es sich, genau zu sein.

  • Cloud-Sitzung: Der Ton vom Mikrofon – auf dem Mac optional auch Systemton und der aufgenommene Bildschirm – wird an die Realtime API von OpenAI gestreamt, um Transkript und Antworten zu erzeugen. Anhänge werden als Kontext gesendet.
  • Lokale Sitzung auf dem Mac: Die heruntergeladenen Modelle verarbeiten Ton und Text auf dem Rechner.
  • In beiden Fällen werden Transkripte, Antworten, Sitzungen, Aufgaben und Notizen auf dem Gerät gespeichert, ohne Cloud-Synchronisation.
  • Das Backend der App speichert Konten, Käufe, das Guthaben an Credits und Nutzungsdaten. Es empfängt und speichert weder Ton noch Transkripte, Antworten oder Anhänge.

Die Kompromisse, ehrlich

Ein Modell, das auf einen Laptop passt, ist kleiner als eines, das in einem Rechenzentrum läuft. Die Antworten eines Modells mit acht Milliarden Parametern reichen für vieles – Entscheidungen herausziehen, einen Begriff erklären, eine Nachfassung entwerfen –, aber bei breitem Wissen oder langen Schlussketten sind sie spürbar schwächer als ein großes Cloud-Modell.

Der Download umfasst mehrere Gigabyte, und die Modelle nutzen beim Laufen spürbar Arbeitsspeicher und Rechenleistung. Auf einem aktuellen Mac mit Apple Silicon ist das in Ordnung; auf älteren ist es langsamer. Das ist auch der Grund, warum es eine Mac-Funktion ist: Ein Telefon hat dafür nicht die Reserven.

Auf iPhone und iPad

Die großen lokalen Modelle gibt es nur auf dem Mac. Auf iPhone und iPad kann die Transkription trotzdem von Apples Spracherkennung auf dem Gerät kommen statt von den Modellen von OpenAI. Die Antworten kommen dann weiterhin vom Cloud-Modell – das Transkript Ihrer Worte entsteht also auf dem Telefon, die Hilfe nicht.

Privat heißt auch: die Menschen im Raum

Den Ton auf dem Rechner zu halten, schützt ihn vor Dritten. Es ändert nichts daran, dass Sie festhalten, was andere sagen. Diese Menschen haben ein Recht, es zu erfahren, und vielerorts verlangt das auch das Gesetz – die Anleitung zum Aufnehmen und Transkribieren anderer Menschen erklärt, was Sie sagen sollten.

Auf welchen Macs laufen die lokalen Modelle?

Auf Macs mit Apple Silicon. Die Modelle werden einmal heruntergeladen und laufen auf dem Rechner; neuere Macs sind schneller.

Laufen die lokalen Modelle auf dem iPhone?

Nein. Auf iPhone und iPad kann die Transkription von Apples Spracherkennung auf dem Gerät kommen, aber das lokale Antwortmodell gibt es nur auf dem Mac.

Sehen die Server der App jemals meine Transkripte?

Nein. Das Backend verwaltet Konten, Käufe und Credits; Transkripte und Antworten werden auf Ihrem Gerät gespeichert.

Offline-Transkription auf dem Mac: Whisper lokal nutzen