Fitur VexaScribe
VexaScribe — transkripsi AI dalam 99 bahasa. Deteksi pembicara, stempel waktu, ringkasan AI, dan terjemahan transkrip bawaan (133 bahasa). Unggah file atau kirim bot rapat ke Zoom, Meet, atau Teams. Mulai dari $2/bulan.
Apa itu VexaScribe, dalam 80 kata
VexaScribe adalah aplikasi web yang mengubah audio dan video menjadi transkrip yang dapat dicari, berstempel waktu, dan berlabel pembicara menggunakan OpenAI Whisper. Lepaskan file (hingga 5 GB), tempel tautan YouTube / TikTok / Instagram / URL langsung, atau kirim bot ke rapat Zoom, Google Meet, atau Teams Anda. Dapatkan transkrip dalam 99 bahasa dalam ~5–10 menit per jam audio, ringkasan AI opsional dengan item tindakan, dan ekspor ke TXT, DOCX, SRT, VTT, atau JSON. 30 menit gratis, lalu $2–$20/bulan. Tanpa kartu kredit untuk memulai.
Fitur Inti
99 Bahasa Didukung
Transkripsi audio dan video dalam 99 bahasa dengan deteksi bahasa otomatis. Dari bahasa Inggris hingga Jepang, Spanyol hingga Arab — kami menanganinya.
Deteksi Pembicara
Diarisasi pembicara otomatis mengidentifikasi dan memberi label suara yang berbeda. Sempurna untuk wawancara, podcast, dan rapat dengan banyak peserta.
Stempel Waktu
Setiap transkrip menyertakan stempel waktu yang presisi. Klik stempel waktu apa pun untuk melompat ke momen tersebut di audio Anda. Penting untuk navigasi dan subtitle video.
5 Format Ekspor
Ekspor sebagai TXT (teks biasa), DOCX (Word), SRT atau VTT (subtitle video), atau JSON (data terstruktur dengan stempel waktu). Pilih format yang sesuai dengan alur kerja Anda.
Pemrosesan Cepat
Transkripsi bertenaga AI selesai dalam hitungan menit, bukan jam. Rekaman 1 jam biasanya diproses dalam 5–10 menit.
Editor Bawaan
Tinjau dan edit transkrip Anda langsung di browser. Perbaiki kesalahan, ganti nama pembicara, dan sempurnakan transkrip Anda sebelum mengekspor.
Bot Rapat
Kirim bot AI ke rapat Zoom, Google Meet, atau Teams Anda. Ia merekam, mentranskripsi, dan menghasilkan ringkasan terstruktur dengan item tindakan dan keputusan. Menggunakan 3× kredit transkripsi.
Ringkasan AI
Ubah transkrip apa pun menjadi poin kunci terstruktur, item tindakan, penanda bab, dan keputusan. Bekerja pada rapat, kuliah, wawancara, dan podcast. Termasuk dalam semua paket berbayar.
Terjemahan Transkrip
Terjemahkan transkrip apa pun ke 133 bahasa melalui Google Translate — tanpa biaya tambahan, tanpa perlu akun pihak ketiga. Tersedia di semua paket.
Unggah Massal — 50 File Sekaligus
Unggah hingga 50 file audio atau video sekaligus. Semua diproses secara paralel — bukan satu per satu. Campurkan format dengan bebas dan unduh semuanya sebagai ZIP.
Chat AI dengan transkrip Anda
Ajukan pertanyaan bahasa alami tentang transkripsi apa pun yang Anda miliki dan dapatkan jawaban yang didukung oleh kutipan langsung dari audio. "Item tindakan apa yang ditugaskan?", "Apa yang diputuskan Sarah?", "Temukan kutipan terkuat tentang X" — pertanyaan yang biasanya Anda harus menonton ulang rekaman untuk menjawab menjadi satu kueri. Setiap jawaban datang dengan kutipan stempel waktu yang dapat diklik yang mengarahkan pemutar audio ke momen persis kutipan itu diucapkan. Kutipan divalidasi di sisi server terhadap transkrip aktual — AI dibatasi pada rekaman Anda dan tidak dapat mengarang stempel waktu atau kutipan. Percakapan bertahan selama 90 hari, dengan konteks multi-giliran dan dukungan 99 bahasa (bertanya dalam satu bahasa tentang rekaman dalam bahasa lain). Tersedia di paket berbayar.
Format yang Didukung
Format Audio
Format Video
Format Ekspor (5)
Teks biasa
Dokumen Word
Subtitle
Subtitle web
Data terstruktur
Kasus Penggunaan
Transkripsi Rapat
Bot AI bergabung ke rapat Zoom, Meet, atau Teams
Transkripsi Podcast
Ubah episode menjadi show notes dan posting blog
Transkripsi Wawancara
Transkripsi dengan deteksi pembicara
Transkripsi Kuliah
Ubah rekaman kelas menjadi catatan belajar
Video ke Teks
Ekstrak transkrip dan buat subtitle
MP3 ke Teks
Konversi file audio menjadi dokumen teks
Transkripsi Audio
Konversi audio ke teks secara umum
Didukung oleh AI Canggih
VexaScribe menggunakan model pengenalan suara mutakhir yang dilatih pada jutaan jam audio. Teknologi yang sama di balik asisten suara, diadaptasi untuk transkripsi yang akurat.
Akurasi untuk audio jernih
Bahasa didukung
Waktu pemrosesan per jam
Ketersediaan Fitur per Paket
Semua paket termasuk uji coba gratis. Tidak perlu kartu kredit untuk memulai.
| Fitur | Uji Coba Gratis | Starter ($2/bulan) | Pro ($10/bulan) |
|---|---|---|---|
| Transkripsi audio & video | ✓ | ✓ | ✓ |
| 99 bahasa didukung | ✓ | ✓ | ✓ |
| Deteksi pembicara | ✓ | ✓ | ✓ |
| Stempel waktu | ✓ | ✓ | ✓ |
| Ekspor: TXT, DOCX, SRT, VTT, JSON | ✓ | ✓ | ✓ |
| Terjemahan transkrip (133 bahasa) | ✓ | ✓ | ✓ |
| Editor bawaan | ✓ | ✓ | ✓ |
| Ringkasan AI | — | ✓ | ✓ |
| Bot Rapat (Zoom, Meet, Teams) | — | ✓ | ✓ |
| Transkripsi massal | ✓ | ✓ | ✓ |
Transkripsi dari URL — tanpa perlu unduh
Tempel tautan dan dapatkan transkrip. Kami menangani unduhan di latar belakang. Akurasi sama, hasil sama, biaya per menit sama dengan unggahan file — Anda melewati langkah "unduh video dulu, lalu unggah".
| Sumber | Status | Yang diterima |
|---|---|---|
| YouTube | ✓ Aktif | URL video publik apa pun. Audio ditarik dan ditranskripsi dengan diarisasi pembicara. Beralih ke keterangan jika unduhan audio gagal. |
| TikTok | ✓ Aktif | URL video TikTok publik apa pun — klip pendek gaya Reels dan video yang lebih panjang keduanya berfungsi. |
| ✓ Aktif | Reels publik, kiriman video, dan Stories video. Kiriman foto mengembalikan kesalahan "tidak ada konten video" yang jelas. | |
| URL Langsung | ✓ Aktif | Tautan HTTPS apa pun ke file audio atau video — podcast MP3, tautan S3, berbagi Google Drive, unduhan bot Telegram, Dropbox, dll. |
| Spotify | ⏳ Segera hadir | Dikenali tetapi belum dibuat. Tempel tautan dan prompt "Voting untuk lebih cepat" akan muncul agar kami dapat memprioritaskan berdasarkan permintaan. |
Model biaya: Unggahan URL diambil dari pool menit bulanan yang sama dengan unggahan file — 1 menit audio = 1 menit dari paket Anda. Tidak ada tingkat URL terpisah.
Apa yang tidak dilakukan VexaScribe
Lima hal yang benar-benar tidak dibangun untuk VexaScribe, dengan alat yang sebenarnya kami rekomendasikan dalam setiap kasus. Jika kasus penggunaan Anda ada dalam daftar ini, hemat waktu dengan tidak mendaftar uji coba.
Tidak ada keterangan langsung real-time
Transkrip dihasilkan setelah unggah, bukan saat Anda berbicara. File 1 jam membutuhkan 5–10 menit untuk diproses — cocok untuk rapat yang Anda tonton kembali, salah untuk acara langsung.
Gunakan sebagai gantinya: Otter Live, keterangan bawaan Google Meet, atau Web Captioner untuk keterangan langsung berbasis browser gratis.
Tidak ada REST API publik
VexaScribe adalah aplikasi web untuk manusia, bukan layanan backend. Tidak ada API pengembang, tidak ada SDK, tidak ada webhook untuk unggahan terprogram.
Gunakan sebagai gantinya: OpenAI Whisper API ($0.006/menit), Deepgram Nova-3 (~$0.0043/menit), atau AssemblyAI (~$0.012/menit).
Tidak ada pengeditan video
Anda dapat mengekspor subtitle SRT/VTT untuk dimasukkan ke editor Anda, tetapi VexaScribe tidak akan memotong klip, menghapus kata pengisi, atau membakar keterangan ke video.
Gunakan sebagai gantinya: Descript atau Vrew untuk pengeditan video berbasis transkrip; Premiere/Final Cut/DaVinci untuk alur kerja NLE tradisional.
Tidak ada penyesuaian kosakata khusus
Anda tidak dapat mengunggah kamus nama merek, nama obat, atau jargon teknis untuk mengarahkan model. Whisper digunakan apa adanya, tanpa penyempurnaan per akun.
Gunakan sebagai gantinya: "word boost" AssemblyAI atau parameter "keywords" Deepgram untuk domain yang berat dengan kata benda khusus.
Tidak ada on-premise / self-hosting enterprise
Audio diproses di cloud kami — tidak ada deployment air-gapped atau bertanda tangan HIPAA-BAA yang tersedia. Untuk konten pengacara-klien, terapi klinis, atau konten rahasia di mana kebocoran menciptakan tanggung jawab hukum langsung, tidak ada alat cloud (termasuk kami) yang merupakan pilihan tepat.
Gunakan sebagai gantinya: instal OpenAI Whisper secara lokal (gratis, berjalan di mesin Anda, audio tidak pernah keluar), atau untuk akurasi 100% tingkat hukum gunakan transkripsi manusia (Rev, GoTranscript) seharga $1.25–$1.99/menit.
Akurasi jujur — apa arti angka-angka sebenarnya
VexaScribe menggunakan OpenAI Whisper (khususnya model kelas large-v3). Halaman pemasaran suka mengatakan "akurasi 99%" — itu tidak jujur. Akurasi Whisper di dunia nyata sangat bergantung pada kualitas audio, aksen, dan jumlah pembicara. Berikut yang bisa Anda harapkan.
Akurasi transkripsi (Whisper)
- Bahasa Inggris studio bersih, satu pembicara~92–97%
- Bahasa Inggris beraksen (non-penutur asli, regional)~85–92%
- Lingkungan bising (kafe, telepon, luar ruangan)~80–90%
- Bahasa Spanyol, Prancis, Jerman, Italia, Portugis, Belanda yang bersih~88–94%
- Bahasa Korea, Jepang, Indonesia, Turki, Arab, Polandia~85–92%
Sumber: Open ASR Leaderboard + benchmark makalah Whisper (LibriSpeech, FLEURS, Common Voice).
Akurasi diarisasi pembicara
- 2 pembicara, tanpa tumpang tindih95%+
- 3–4 pembicara, sesekali tumpang tindih~88–94%
- 5–6 pembicara, dinamika rapat~80–90%
- 7–15 pembicara, panel atau focus group~70–82%
- Hingga 50 pembicara (maks yang didukung)bervariasi
Akurasi terbaik dengan 2–6 pembicara yang berbeda. Anda dapat mengganti nama Pembicara 1/2/3 di editor setelahnya.
Apa yang benar-benar berpengaruh
Tiga hal yang lebih penting daripada memilih alat transkripsi "terbaik":
- Mikrofon yang layak (headset USB atau lapel mengalahkan bawaan laptop dengan 5–15 poin akurasi).
- Satu pembicara pada satu waktu — tumpang tindih menghancurkan transkripsi dan diarisasi.
- Kebisingan latar belakang rendah. Rekam di ruangan tertutup, bukan di sebelah kipas atau ventilasi HVAC.
Jika Anda memerlukan akurasi 100% tingkat hukum (dokumen pengadilan, penelitian yang diatur), gunakan layanan transkripsi manusia seperti Rev atau GoTranscript seharga $1.25–$1.99/menit. AI membawa Anda ke ~95% dengan biaya 1–2%-nya — cocok untuk sebagian besar kasus penggunaan, salah untuk beberapa.
FAQ Fitur
Bahasa apa yang didukung VexaScribe dan seberapa akurat?
99 bahasa, semuanya didukung oleh OpenAI Whisper. Akurasi tergantung pada bahasa dan kualitas audio: ~92-97% pada audio bahasa Inggris yang bersih (menurut Open ASR Leaderboard), ~88-94% pada bahasa Spanyol, Prancis, Jerman, Italia, Portugis, dan Belanda yang bersih, dan ~85-92% pada bahasa Korea, Jepang, Indonesia, Turki, Polandia, dan Arab. Ucapan beraksen berat, pembicara yang tumpang tindih, atau lingkungan bising menurunkan angka tersebut 5-10 poin. Bahasa terdeteksi secara otomatis atau Anda dapat memaksanya secara manual.
Apakah VexaScribe memiliki REST API publik?
Belum — VexaScribe adalah aplikasi web, bukan produk API. Jika Anda perlu mengintegrasikan transkripsi ke dalam perangkat lunak Anda sendiri, gunakan OpenAI Whisper API ($0.006/menit), Deepgram (~$0.0043/menit pada Nova-3), atau AssemblyAI (~$0.012/menit). Ketiganya memiliki SDK dan dokumentasi yang tepat. Jika Anda menginginkan alur kerja tanpa kode yang mengunggah file dan mengunduh transkrip, VexaScribe adalah pilihan tepat — hanya saja bukan melalui API.
Format file apa yang dapat ditranskripsi VexaScribe?
Audio: MP3, WAV, M4A, FLAC, OGG, AAC, WMA, OPUS. Video: MP4, MOV, AVI, MKV, WebM, WMV, FLV. Track audio diekstrak dari file video secara otomatis — tidak ada langkah konversi terpisah. Ekspor: TXT, DOCX, SRT, VTT, JSON.
Seberapa besar file yang dapat saya unggah?
Hingga 5 GB per file, yang kira-kira 90 jam MP3 pada 128 kbps atau sekitar 8 jam video 1080p. Itu jauh melewati batas 25 MB pada sebagian besar situs konverter gratis dan batas ~200 MB pada tingkat gratis Otter. Untuk file lebih besar dari 5 GB, bagi file di Audacity atau ffmpeg dan unggah potongannya secara terpisah.
Apakah VexaScribe melatih model AI pada audio saya?
Tidak. Audio dan transkrip Anda tidak digunakan untuk melatih model apa pun — baik kami maupun OpenAI (kami menggunakan Whisper melalui API, yang tidak melatih pada input). Anda dapat menghapus file apa pun dari dasbor Anda kapan saja, dan baik audio maupun transkrip akan dihapus. Audio dienkripsi saat transit (TLS) dan saat diam. Untuk konten pengacara-klien, klinis, atau rahasia di mana kebocoran akan menciptakan tanggung jawab hukum langsung, instal OpenAI Whisper secara lokal — tidak ada alat cloud, termasuk milik kami, yang sepadan dengan risiko itu.
Apa yang termasuk dalam uji coba gratis?
30 menit kredit transkripsi, semua 99 bahasa, deteksi pembicara, stempel waktu, setiap format ekspor (TXT/DOCX/SRT/VTT/JSON), editor bawaan, unggah massal (hingga 50 file), dan terjemahan transkrip ke 133 bahasa. Tidak perlu kartu kredit. Ringkasan AI dan bot rapat (Zoom/Meet/Teams) hanya berbayar — mulai dari $2/bulan pada paket Starter.
Siap Mulai Mentranskripsi?
Coba VexaScribe gratis dengan 30 menit transkripsi. Tidak perlu kartu kredit.