Langkau ke kandungan

Audio ke teks

Transkripsi pertuturan Melayu atau Inggeris, pada peranti anda.

Berjalan sepenuhnya dalam pelayar anda. Sahkan dalam tab rangkaian anda.

Inggeris: 41 MB atau 77 MB. Melayu dan bahasa lain: 77 MB atau 250 MB. Setiap satu dimuat turun sekali.

Apa yang dilakukan

Menjalankan OpenAI Whisper pada peranti anda melalui WebAssembly. Bahasa Inggeris menggunakan model khas Inggeris; Bahasa Melayu dan bahasa lain menggunakan model berbilang bahasa. Model dimuat turun sekali dan disimpan oleh pelayar anda untuk setiap penggunaan seterusnya. Transkrip dipaparkan sedia untuk disalin, dan disimpan sebagai .txt.

Had

  • Whisper lebih lemah dalam Bahasa Melayu berbanding Inggeris. Pada 12 ayat Bahasa Melayu yang dibaca dengan jelas daripada set FLEURS Google, Pantas tersilap kira-kira 4 daripada 10 perkataan dan Tepat kira-kira 1 daripada 4. Gunakan Tepat untuk Bahasa Melayu, dan semak hasilnya.
  • Penggunaan pertama setiap model memuat turun pemberatnya sekali, dari 41 MB hingga 250 MB. Selepas itu ia berfungsi tanpa talian.
  • Ketepatan jauh lebih rendah daripada model awan bersaiz penuh, terutamanya dengan loghat, beberapa penutur, campuran bahasa atau bunyi latar.
  • Rakaman panjang adalah perlahan: jangkakan sebahagian besar tempoh audio, dan lebih lama dengan model Tepat.

Adakah ini peribadi?

Ya, dan anda boleh menyemaknya sendiri. Buka tab rangkaian (network) pelayar anda dan jalankan alat ini: fail anda tidak pernah muncul di situ, kerana tiada pelayan untuk dihantar. Masa jalan pengecaman pertuturan disediakan dari domain yang sama. Model Whisper dimuat turun sekali dari Hugging Face: muat turun model, bukan muat naik audio anda.

Alat berkaitan