Funzionalità di VexaScribe

VexaScribe — trascrizione AI in 99 lingue. Rilevamento parlanti, timestamp, riepiloghi AI e traduzione integrata delle trascrizioni (133 lingue). Carica file o invia un bot riunione a Zoom, Meet o Teams. Da $2/mese.

Cos'è VexaScribe, in 80 parole

VexaScribe è una web app che trasforma audio e video in trascrizioni ricercabili, con timestamp ed etichette dei parlanti, usando OpenAI Whisper. Trascina un file (fino a 5 GB), incolla un URL YouTube / TikTok / Instagram / diretto, oppure invia un bot alla tua riunione Zoom, Google Meet o Teams. Ottieni una trascrizione in 99 lingue in ~5–10 minuti per ora di audio, un riepilogo AI opzionale con azioni da svolgere, ed esportazioni in TXT, DOCX, SRT, VTT o JSON. 30 minuti gratis, poi $2–$20/mese. Nessuna carta di credito per iniziare.

Funzionalità principali

99 lingue supportate

Trascrivi audio e video in 99 lingue con rilevamento automatico della lingua. Dall'inglese al giapponese, dallo spagnolo all'arabo — siamo coperti.

Rilevamento parlanti

Il rilevamento automatico parlanti identifica ed etichetta voci diverse. Perfetto per interviste, podcast e riunioni con più partecipanti.

Timestamp

Ogni trascrizione include timestamp precisi. Clicca su un timestamp per saltare a quel momento dell'audio. Essenziale per la navigazione e i sottotitoli video.

5 formati di esportazione

Esporta come TXT (testo semplice), DOCX (Word), SRT o VTT (sottotitoli video), o JSON (dati strutturati con timestamp). Scegli il formato più adatto al tuo flusso di lavoro.

Elaborazione veloce

La trascrizione basata su AI si completa in minuti, non ore. Una registrazione di 1 ora viene elaborata tipicamente in 5–10 minuti.

Editor integrato

Rivedi e modifica le tue trascrizioni direttamente nel browser. Correggi errori, rinomina i parlanti e perfeziona la trascrizione prima dell'esportazione.

Bot riunione

Invia un bot AI alle tue riunioni Zoom, Google Meet o Teams. Registra, trascrive e genera riepiloghi strutturati con azioni da svolgere e decisioni. Usa 3× crediti di trascrizione.

Riepiloghi AI

Trasforma qualsiasi trascrizione in punti chiave strutturati, azioni da svolgere, marcatori di capitoli e decisioni. Funziona su riunioni, lezioni, interviste e podcast. Incluso in tutti i piani a pagamento.

Traduzione delle trascrizioni

Traduci qualsiasi trascrizione in 133 lingue tramite Google Translate — nessun costo aggiuntivo, nessun account di terze parti necessario. Disponibile in tutti i piani.

Caricamento in blocco — 50 file in una volta

Carica fino a 50 file audio o video in una sola volta. Tutti elaborati in parallelo — non uno alla volta. Mescola i formati liberamente e scarica tutto come ZIP.

Chat AI con la tua trascrizione

Poni domande in linguaggio naturale su qualsiasi trascrizione di tua proprietà e ottieni risposte supportate da citazioni dirette dell'audio. “Quali azioni sono state assegnate?”, “Cosa ha deciso Sara?”, “Trova la citazione più forte su X” — domande per rispondere alle quali normalmente riascolteresti la registrazione diventano una singola query. Ogni risposta arriva con citazioni con timestamp cliccabili che portano il lettore audio esattamente al momento in cui la citazione è stata detta. Le citazioni vengono validate lato server rispetto alla trascrizione effettiva — l'AI è vincolata alla tua registrazione e non può inventare un timestamp o una citazione. Le conversazioni persistono per 90 giorni, con contesto multi-turno e supporto per 99 lingue (chiedi in una lingua su una registrazione in un'altra). Disponibile nei piani a pagamento.

Formati supportati

Formati audio

MP3WAVM4AFLACOGGAACWMAOPUS

Formati video

MP4MOVAVIMKVWebMWMVFLV

Formati di esportazione (5)

TXT

Testo semplice

DOCX

Documento Word

SRT

Sottotitoli

VTT

Sottotitoli web

JSON

Dati strutturati

Basato su AI avanzata

VexaScribe utilizza modelli di riconoscimento vocale all'avanguardia addestrati su milioni di ore di audio. La stessa tecnologia dietro gli assistenti vocali, adattata per una trascrizione accurata.

95%

Precisione per audio chiaro

99

Lingue supportate

5–10 min

Tempo di elaborazione per ora

Disponibilità delle funzionalità per piano

Tutti i piani includono una prova gratuita. Nessuna carta di credito richiesta per iniziare.

FunzionalitàProva gratuitaStarter ($2/mese)Pro ($10/mese)
Trascrizione audio e video
99 lingue supportate
Rilevamento parlanti
Timestamp
Esportazione: TXT, DOCX, SRT, VTT, JSON
Traduzione delle trascrizioni (133 lingue)
Editor integrato
Riepiloghi AI
Bot riunione (Zoom, Meet, Teams)
Trascrizione in blocco

Trascrivi da un URL — nessun download necessario

Incolla un link e ottieni una trascrizione. Gestiamo il download in background. Stessa precisione, stesso risultato, stesso costo al minuto di un caricamento file — salti il passaggio “scarica prima il video, poi caricalo”.

FonteStatoCosa accetta
YouTube✓ LiveQualsiasi URL di video pubblico. L'audio viene estratto e trascritto con rilevamento parlanti. Torna ai sottotitoli se il download dell'audio fallisce.
TikTok✓ LiveQualsiasi URL di video TikTok pubblico — funzionano sia i brevi clip in stile Reels sia i video più lunghi.
Instagram✓ LiveReels pubblici, post video e Storie video. I post fotografici restituiscono un chiaro errore “nessun contenuto video”.
URL diretto✓ LiveQualsiasi link HTTPS a un file audio o video — MP3 di podcast, link S3, condivisione Google Drive, download da bot Telegram, Dropbox, ecc.
Spotify⏳ ProssimamenteRiconosciuto ma non ancora implementato. Incolla un link e apparirà una richiesta “Vota per anticiparlo” così possiamo dare priorità in base alla domanda.

Modello di costo: I caricamenti da URL attingono allo stesso monte minuti mensile dei caricamenti di file — 1 minuto di audio = 1 minuto dal tuo piano. Nessuna tariffa URL separata.

Cosa VexaScribe non fa

Cinque cose per cui VexaScribe davvero non è stato progettato, con lo strumento che consiglieremmo effettivamente in ciascun caso. Se il tuo caso d'uso è in questa lista, risparmiati la registrazione alla prova.

Nessuna sottotitolazione live in tempo reale

Le trascrizioni vengono generate dopo il caricamento, non mentre parli. Un file di 1 ora richiede 5–10 minuti per essere elaborato — perfetto per riunioni che riguardi in seguito, sbagliato per eventi live.

Usa invece: Otter Live, i sottotitoli integrati di Google Meet, oppure Web Captioner per sottotitoli live gratuiti basati su browser.

Nessuna API REST pubblica

VexaScribe è una web app per esseri umani, non un servizio backend. Non c'è un'API per sviluppatori, nessun SDK, nessun webhook per caricamenti programmatici.

Usa invece: OpenAI Whisper API ($0.006/min), Deepgram Nova-3 (~$0.0043/min) o AssemblyAI (~$0.012/min).

Nessun montaggio video

Puoi esportare sottotitoli SRT/VTT da inserire nel tuo editor, ma VexaScribe non taglia clip, non rimuove parole di riempimento e non incorpora i sottotitoli sul video.

Usa invece: Descript o Vrew per il montaggio video basato su trascrizione; Premiere/Final Cut/DaVinci per flussi di lavoro NLE tradizionali.

Nessuna personalizzazione del vocabolario

Non puoi caricare un dizionario di marchi, nomi di farmaci o gergo tecnico per orientare il modello. Whisper viene usato così com'è, senza fine-tuning per account.

Usa invece: il “word boost” di AssemblyAI o il parametro “keywords” di Deepgram per domini ricchi di nomi propri.

Nessun on-premise / self-hosting enterprise

L'audio viene elaborato nel nostro cloud — non è disponibile alcun deployment air-gapped o firmato HIPAA-BAA. Per contenuti avvocato-cliente, terapia clinica o classificati dove una violazione crea diretta responsabilità legale, nessuno strumento cloud (compreso il nostro) è la scelta giusta.

Usa invece: installa OpenAI Whisper localmente (gratis, gira sulla tua macchina, l'audio non esce mai), oppure per precisione al 100% di livello legale usa la trascrizione umana (Rev, GoTranscript) a $1.25–$1.99/min.

Precisione onesta — cosa significano davvero i numeri

VexaScribe usa OpenAI Whisper (in particolare modelli di classe large-v3). Le pagine di marketing amano dire “99% di precisione” — non è onesto. La precisione reale di Whisper dipende molto dalla qualità dell'audio, dall'accento e dal numero di parlanti. Ecco cosa aspettarsi.

Precisione della trascrizione (Whisper)

  • Inglese studio pulito, un solo parlante~92–97%
  • Inglese con accento (non madrelingua, regionale)~85–92%
  • Ambienti rumorosi (bar, telefono, esterno)~80–90%
  • Spagnolo, francese, tedesco, italiano, portoghese, olandese puliti~88–94%
  • Coreano, giapponese, indonesiano, turco, arabo, polacco~85–92%

Fonte: Open ASR Leaderboard + benchmark del paper Whisper (LibriSpeech, FLEURS, Common Voice).

Precisione del rilevamento parlanti

  • 2 parlanti, nessuna sovrapposizione95%+
  • 3–4 parlanti, sovrapposizione occasionale~88–94%
  • 5–6 parlanti, dinamiche di riunione~80–90%
  • 7–15 parlanti, panel o focus group~70–82%
  • Fino a 50 parlanti (massimo supportato)variabile

Massima precisione con 2–6 parlanti distinti. Puoi rinominare Parlante 1/2/3 nell'editor in seguito.

Cosa fa davvero la differenza

Tre cose che contano più di scegliere lo strumento di trascrizione “migliore”:

  1. Un microfono decente (auricolare USB o lavalier batte il microfono integrato del laptop di 5–15 punti di precisione).
  2. Un parlante alla volta — la sovrapposizione distrugge sia la trascrizione sia il rilevamento parlanti.
  3. Basso rumore di fondo. Registra in una stanza chiusa, non accanto a un ventilatore o a una bocchetta HVAC.

Se hai bisogno di precisione al 100% di livello legale (atti giudiziari, ricerca regolamentata), usa servizi di trascrizione umana come Rev o GoTranscript a $1.25–$1.99/min. L'AI ti porta al ~95% all'1–2% del costo — perfetto per la maggior parte dei casi, sbagliato per alcuni.

FAQ sulle funzionalità

Quali lingue supporta VexaScribe e quanto sono accurate?

99 lingue, tutte basate su OpenAI Whisper. La precisione dipende dalla lingua e dalla qualità dell'audio: ~92–97% su audio inglese pulito (secondo l'Open ASR Leaderboard), ~88–94% su spagnolo, francese, tedesco, italiano, portoghese e olandese puliti, e ~85–92% su coreano, giapponese, indonesiano, turco, polacco e arabo. Parlato con forte accento, parlanti sovrapposti o ambienti rumorosi abbassano questi numeri di 5–10 punti. La lingua viene rilevata automaticamente oppure puoi forzarla manualmente.

VexaScribe ha un'API REST pubblica?

Non ancora — VexaScribe è una web app, non un prodotto API. Se hai bisogno di integrare la trascrizione nel tuo software, usa OpenAI Whisper API ($0.006/min), Deepgram (~$0.0043/min su Nova-3) o AssemblyAI (~$0.012/min). Tutti e tre hanno SDK e documentazione adeguati. Se vuoi un flusso di lavoro no-code che carica file e scarica trascrizioni, VexaScribe è la scelta giusta — ma non tramite API.

Quali formati di file può trascrivere VexaScribe?

Audio: MP3, WAV, M4A, FLAC, OGG, AAC, WMA, OPUS. Video: MP4, MOV, AVI, MKV, WebM, WMV, FLV. La traccia audio viene estratta automaticamente dai file video — nessun passaggio di conversione separato. Esportazioni: TXT, DOCX, SRT, VTT, JSON.

Quanto grande può essere un file che carico?

Fino a 5 GB per file, ovvero circa 90 ore di MP3 a 128 kbps o circa 8 ore di video 1080p. È ben oltre il limite di 25 MB della maggior parte dei siti di conversione gratuiti e il limite di ~200 MB del piano gratuito di Otter. Per file più grandi di 5 GB, dividi il file in Audacity o ffmpeg e carica le parti separatamente.

VexaScribe addestra modelli AI sul mio audio?

No. Il tuo audio e le tue trascrizioni non vengono usati per addestrare alcun modello — né il nostro né quello di OpenAI (usiamo Whisper tramite API, che non si addestra sugli input). Puoi eliminare qualsiasi file dalla tua dashboard in qualsiasi momento, e sia l'audio sia la trascrizione vengono rimossi. L'audio è cifrato in transito (TLS) e a riposo. Per contenuti avvocato-cliente, clinici o classificati dove una violazione creerebbe diretta responsabilità legale, installa OpenAI Whisper localmente — nessuno strumento cloud, incluso il nostro, vale quel rischio.

Cosa è incluso nella prova gratuita?

30 minuti di credito di trascrizione, tutte le 99 lingue, rilevamento parlanti, timestamp, ogni formato di esportazione (TXT/DOCX/SRT/VTT/JSON), l'editor integrato, il caricamento in blocco (fino a 50 file) e la traduzione delle trascrizioni in 133 lingue. Nessuna carta di credito richiesta. I riepiloghi AI e il bot riunione (Zoom/Meet/Teams) sono solo a pagamento — partono da $2/mese sul piano Starter.

Pronto per iniziare a trascrivere?

Prova VexaScribe gratis con 30 minuti di trascrizione. Nessuna carta di credito richiesta.