🖥️ Aplicación de escritorio
Doble clic en Windows 10 u 11. Sin instalar Python, sin tocar el PATH.
VideoTranscriptStudio.exe
Pega un enlace de YouTube y obtén el texto. Da igual que sea un video suelto, una lista de reproducción o un canal entero: la aplicación expande el enlace, arma una cola y transcribe uno por uno.
No depende de que el video tenga subtítulos. El audio se reconoce con Whisper en tu equipo: no hay API detrás, ni clave que configurar, ni texto que salga de tu máquina.
Lo que encolas en el escritorio lo ves en el panel del navegador, y al revés: comparten la misma cola de trabajos.
Doble clic en Windows 10 u 11. Sin instalar Python, sin tocar el PATH.
VideoTranscriptStudio.exe
La misma aplicación en el navegador, escuchando solo en tu propia máquina.
http://127.0.0.1:8760
Para lotes, scripts y servidores sin pantalla. Con códigos de salida útiles.
vts run <URL> --limit 20
La etapa 0 explica qué hace el programa —y qué no hace— antes de pedirte nada. Las tres siguientes son una decisión cada una.
Pega la URL de un canal y pulsa Analizar: te dice cuántos videos hay y cuáles, sin descargar ni transcribir nada.
Todo tiene un valor por defecto que funciona. Cada campo lleva su ayuda debajo, y los formatos están agrupados en texto y audio.
Una tarjeta por video, con su estado y lo que produjo. Si el video 12 de 80 es privado, se marca y el 13 sigue adelante.
Nada de una barra que promete. La fase tiene nombre, la barra se mueve mientras descarga, y el texto reconocido va apareciendo.
Markdown con marcas de tiempo, para repositorios y cursos
Documento portable para leer o imprimir
Texto continuo, sin marcas
Subtítulos SubRip, para cualquier editor de video
WebVTT, para reproductores HTML5
Segmentos y metadatos: la fuente de verdad
El audio extraído
El audio en formato abierto
Ningún módulo del dominio importa la interfaz. Añadir un formato de salida toca exactamente un archivo.
.zip de la última publicación.VideoTranscriptStudio.exe.Lleva FFmpeg dentro: no depende del PATH.
git clone https://github.com/vladimiracunadev-create/video-transcript-studio.git
cd video-transcript-studio
pip install -e .
video-transcript-studio web
Python 3.11 o superior. Windows, macOS o Linux.
Whisper corre en tu procesador con faster-whisper. La transcripción no se envía a ningún LLM ni a ninguna API.
127.0.0.1El panel escucha en la dirección de bucle local. No es accesible desde la red salvo que lo pidas explícitamente, y avisa cuando lo haces.
Sin analítica, sin cuenta, sin clave. Lo único que sale es lo que yt-dlp necesita para obtener el medio.
No es un descargador de videos. Extrae el audio para transcribirlo.
No evade DRM ni controles de acceso. Un video privado, de miembros o con restricción de edad falla, y el mensaje lo dice con esas palabras.
No hace diarización. Dice qué se dijo y cuándo, no quién lo dijo.
No resume ni genera capítulos. Está en el roadmap, no en el producto.
No garantiza precisión. Con música fuerte, voces superpuestas o audio malo, la transcripción se degrada. Revísala antes de publicar.