Sobre JustTranscribe
JustTranscribe (justtranscribe.ai) convierte audio y video en texto preciso con marcas de tiempo, en minutos — notas de voz de WhatsApp, clases y reuniones grabadas, podcasts y videos públicos de YouTube, TikTok o Instagram — con quién habla, traducción a 111 idiomas y exportación a DOCX, PDF, SRT y más. Está hecho en español y para Latinoamérica primero, y funciona también en inglés.
Qué es — y qué no es
Un solo motor detrás de un conjunto de herramientas gratis: subes un archivo o pegas un enlace público, el audio se transcribe palabra por palabra con marcas de tiempo con un modelo de voz tipo Whisper, y después una capa de IA escribe un resumen y encuentra los momentos clave. En videos de redes, esa capa además mapea el hook, las escenas, el ritmo y la estructura, y responde preguntas con base en la transcripción.
Es transcripción automática. No ofrece revisión humana, no puede obtener videos privados o que piden iniciar sesión (sube el archivo), y no transcribe en vivo. Toda transcripción automática es un borrador de trabajo: con audio limpio sale casi lista; con ruido y voces encimadas conviene una lectura de revisión, para eso están las marcas de tiempo clicables.
La primera transcripción es gratis y sin cuenta (hasta 40 minutos); después, con una cuenta gratuita, el límite sube a 150 minutos y 500 MB por archivo — transcripciones ilimitadas durante la beta y sin tarjeta.
Quién está detrás
JustTranscribe se opera desde San Sebastián, en el País Vasco (España), y está representado legalmente por Unai Goikoetxea, que además escribe y firma las guías del blog. No hay otro "JustTranscribe" detrás de este sitio: no tenemos relación con justtranscribe.com ni con aplicaciones móviles de nombre parecido.
Unai Goikoetxea · Fundador y autor
Unai dirige JustTranscribe desde San Sebastián, en el País Vasco, y escribe estas guías a partir de lo que la gente realmente sube — audios de WhatsApp, clases y reuniones grabadas, videos de YouTube — y de los límites reales de la herramienta, no los del marketing. ¿Ves un error? El correo del pie de página le llega.
Cómo funciona la transcripción
El reconocimiento de voz corre sobre el modelo tipo Whisper de OpenAI; el resumen, el análisis del video y la traducción sobre Claude de Anthropic; la detección de hablantes, solo cuando la activas, sobre Deepgram. Los archivos y las transcripciones se guardan en nuestra propia infraestructura (AWS) y quedan en tu biblioteca hasta que los borres — cualquier transcripción, o toda la cuenta, cuando quieras.
Las grabaciones largas van hasta 150 minutos y 500 MB por archivo con una cuenta gratuita, 40 minutos en la primera transcripción sin cuenta. El transcriptor escucha a 16 kHz mono, así que el formato y la tasa de bits con que llega tu grabación importan mucho menos que la grabación en sí.
Cómo escribimos las guías y las comparativas
El blog y las páginas de herramientas los escribe una persona y se mantienen honestos con pocas reglas: ninguna estadística que no hayamos medido, ningún precio que no hayamos leído en la página del competidor en una fecha declarada y — donde mostramos lo que produce la herramienta — un resultado real y sin editar de una grabación de dominio público o Creative Commons, con el archivo de entrada enlazado para que lo pruebes. Donde el modelo se equivoca en esas muestras, la leyenda lo dice.
Las comparativas tienen fecha, dicen qué hace mejor la otra herramienta y llevan un correo al que escribir cuando algo quedó desactualizado.
Privacidad, en corto
Tus grabaciones se usan para producir tu transcripción — nada más. La analítica no usa cookies, y la lista completa de encargados (OpenAI, Anthropic, Deepgram, AWS, Cloudflare, PostHog, los proveedores de descarga de video) con lo que recibe cada uno está en la política de privacidad.
Contacto
Preguntas, correcciones, una transcripción que salió mal, un precio de una comparativa que cambió — escribe a bramontiventures@gmail.com.