Panduan

Transkripsi offline di Mac: Whisper dan Qwen secara lokal

Ada percakapan yang tidak seharusnya dialirkan ke mana pun: janji temu dengan dokter, konsultasi hukum, rapat direksi sebelum pengumuman. Untuk percakapan seperti itu, pertanyaannya bukan seberapa bagus model cloud, melainkan apakah suara perlu meninggalkan komputer sama sekali. Di Mac dengan Apple silicon, tidak perlu.

3 menit baca · Diperbarui 2026-09-23

Apa yang berjalan secara lokal

Di Mac dengan Apple silicon, aplikasi bisa mengunduh dua model dan menjalankannya di komputer: Whisper Large v3 Turbo untuk transkripsi dan Qwen 3 8B untuk jawaban. Setelah diunduh, keduanya berjalan di Mac itu sendiri, untuk sesi yang suaranya tidak boleh keluar dari ruangan.

Pilihan antara pemrosesan cloud dan model lokal dibuat per kebutuhan. Stand-up mingguan dan konsultasi dengan pengacara tidak memerlukan perlakuan yang sama, dan Anda tidak harus memilih satu untuk semuanya.

Apa pergi ke mana, di setiap mode

Kata “pribadi” sering dipakai secara samar, jadi ada baiknya bersikap tepat.

  • Sesi cloud: suara mikrofon — dan di Mac, secara opsional, audio sistem dan layar yang direkam — dialirkan ke Realtime API OpenAI untuk menghasilkan transkrip dan jawaban. Lampiran dikirim sebagai konteks.
  • Sesi lokal di Mac: model yang diunduh memproses suara dan teks di komputer.
  • Dalam kedua kasus, transkrip, jawaban, sesi, tugas, dan catatan disimpan di perangkat, tanpa sinkronisasi cloud.
  • Backend aplikasi menyimpan akun, pembelian, saldo kredit, dan catatan pemakaian. Backend tidak menerima atau menyimpan suara, transkrip, jawaban, atau lampiran.

Komprominya, secara jujur

Model yang muat di laptop lebih kecil daripada model yang berjalan di pusat data. Jawaban model delapan miliar parameter cukup untuk banyak hal — mengambil keputusan, menjelaskan istilah, membuat draf tindak lanjut — tetapi untuk pengetahuan luas atau penalaran panjang jelas kurang mampu dibanding model cloud besar.

Unduhannya beberapa gigabyte, dan model benar-benar memakai memori dan daya pemrosesan saat berjalan. Di Mac Apple silicon terbaru tidak masalah; di yang lebih lama akan lebih lambat. Itu juga alasan fitur ini khusus Mac: ponsel tidak punya ruang sebesar itu.

Di iPhone dan iPad

Model lokal besar hanya ada di Mac. Di iPhone dan iPad, transkripsi tetap bisa berasal dari pengenalan ucapan Apple di perangkat alih-alih model OpenAI. Jawaban tetap datang dari model cloud: transkrip ucapan Anda dibuat di ponsel, bantuannya tidak.

Pribadi juga menyangkut orang di ruangan

Menjaga suara tetap di komputer melindunginya dari pihak ketiga. Itu tidak mengubah fakta bahwa Anda mencatat apa yang dikatakan orang lain. Mereka berhak mengetahuinya, dan di banyak tempat hukum juga mewajibkannya — panduan tentang merekam dan mentranskripsi orang lain menjelaskan apa yang perlu dikatakan.

Di Mac mana model lokal bisa berjalan?

Di Mac dengan Apple silicon. Model diunduh sekali dan berjalan di komputer; Mac yang lebih baru lebih cepat.

Apakah model lokal berjalan di iPhone?

Tidak. Di iPhone dan iPad transkripsi bisa berasal dari pengenalan ucapan Apple di perangkat, tetapi model jawaban lokal hanya ada di Mac.

Apakah server aplikasi pernah melihat transkrip saya?

Tidak. Backend menangani akun, pembelian, dan kredit; transkrip dan jawaban disimpan di perangkat Anda.

Transkripsi offline di Mac: Whisper dan Qwen secara lokal