Transforma audio, video y documentos en conocimiento accionable con IA.
🚀 Ver demo · Acceso beta por invitación
⚠️ El código fuente es privado. Este repositorio documenta la arquitectura, las decisiones técnicas y el alcance del producto.
Audix AI es una plataforma de estudio con IA: subes cualquier contenido (audio, video, enlaces de YouTube, PDFs y más) y lo convierte en material de aprendizaje — transcripciones, traducciones a +50 idiomas, resúmenes, flashcards, quizzes y un chat contextual que responde sobre tu propio contenido.
- Transcripción de alta precisión (Whisper), robusta ante ruido y acentos.
- Procesamiento de video: archivos locales y YouTube, con subtítulos y marcas de tiempo.
- Chat con RAG (Retrieval-Augmented Generation): preguntas y respuestas contextuales sobre el material propio de cada usuario.
- Clases inteligentes: rutas de aprendizaje personalizadas, flashcards y quizzes generados automáticamente.
- Traducción de documentos manteniendo formato, tablas e imágenes.
- Exportación a PDF, TXT, SRT y DOCX.
Usuario → Frontend (React + TypeScript)
→ Supabase (auth · Postgres · storage)
→ Pipeline multimedia (FFmpeg → Whisper)
→ Capa de IA (GPT-4 · embeddings · RAG)
→ Google Cloud (procesamiento y servicios)
Decisiones técnicas clave:
- Pipeline asíncrono para archivos pesados: FFmpeg normaliza el audio antes de Whisper, reduciendo errores de transcripción.
- RAG con embeddings por usuario: cada quien chatea solo con su contenido, con personalización del contexto.
- Supabase como backend integral (auth, Postgres, storage) para minimizar la carga operativa.