Proyecto

TranscribeMind

Plataforma que transcribe videos con IA, genera un resumen ejecutivo con capítulos navegables, y permite chatear directamente con el contenido del video.

Desarrollo full stack de un monorepo con 4 servicios (web, gateway-api, video-worker y ai-summary-service) comunicados por colas 2026
  • React
  • TypeScript
  • Socket.io
  • Redis
  • Docker
Vista previa de TranscribeMind

TranscribeMind resuelve un problema simple pero tedioso: convertir un video largo en algo que se pueda leer y explorar en segundos. Subes un archivo, un enlace directo o un video de YouTube, el sistema extrae el audio y lo transcribe con Whisper, y GPT-4o genera un resumen ejecutivo, puntos clave, capítulos y keywords en el idioma que elijas, aunque el video esté en otro. Sobre esa base, un chat con IA responde preguntas puntuales sobre el contenido del video, manteniendo el historial de la conversación.

Es un monorepo con tres servicios backend independientes (gateway, worker de video y servicio de IA) que se comunican por colas con Redis/BullMQ, así cada etapa pesada escala por separado y un fallo en el resumen de IA no bloquea la transcripción. El estado del procesamiento se refleja en tiempo real en el frontend vía WebSockets, con notificaciones del navegador para no tener que quedarse vigilando la pestaña.

  • Transcripción con Whisper y resumen con GPT-4o, con capítulos navegables y traducción automática de idioma
  • Chat con IA para preguntar directamente sobre el contenido del video, sincronizado con el reproductor
  • Arquitectura por colas (Redis/BullMQ): cada servicio escala y falla de forma independiente
  • Estado del procesamiento en tiempo real vía WebSockets, con notificaciones del navegador al completarse
  • Login con email/contraseña o Google, instalable como PWA, con almacenamiento de videos en AWS S3