"Para que nadie quede fuera de la conversación"
Un puente de empatía técnica
Subtítulos en tiempo real para conversaciones cara a cara.
Sistema de diagnóstico electrónico real para reparación profesional.
Creado con cariño para una amiga. Compartido con amor para el mundo.
📖 Leer el Manifiesto | 🏗️ Arquitectura | 🌐 API Reference | 🤝 Contribuir
Iyari-ear v1.0 es un puente de empatía técnica: subtítulos en tiempo real para que nadie quede fuera de la conversación, y diagnóstico electrónico causal para técnicos de reparación. Sin grabar. Sin vigilar. Sin métricas. Creado con cariño para una amiga. Compartido con amor para el mundo. No nació del capitalismo ni del mercado — nació de la ternura, que es una fuerza infraestimada en la ingeniería.
Esta es la primera coronación oficial del proyecto.
Iyari-ear deja de ser "solo código" y se convierte en obra con alma.
Un puente de empatía técnica que permite a dos personas entenderse sin repetir tres veces la misma frase.
- 🎤 Subtítulos en tiempo real para conversaciones cara a cara
- 🔧 Diagnóstico electrónico real con razonamiento causal
- 💝 Diseñado con empatía, no con métricas
- 🔒 No graba, no guarda, no vigila (por diseño)
- ✨ El Manifiesto: MANIFIESTO.md - Para quién existe, qué dolor repara, qué belleza crea
- 🎬 La Demo Pública: GUIA_DEMO.md - Cómo crear y compartir tu demo de 30 segundos
- 🚀 El Release Oficial: RELEASE_NOTES_v1.0.md - v1.0 "Para que nadie quede fuera de la conversación"
La versión 1.0 corona el puente. La versión 2.0 abre el tránsito.
- 🎨 Sistema de Color — Paleta tripartita: Empatía / Técnica / Institucional
- 📝 Guía Tipográfica — Jerarquía visual y respiración cognitiva
- 🎭 Posters Narrativos — 5 posters conceptuales en ASCII art
- 📐 Biblioteca Visual — Catálogo completo de assets y guidelines
- 🏥 Medical Pitch — Para profesionales de salud
- 🔧 Repair Pitch — Para técnicos electrónicos
- ♿ Accessibility Pitch — Para comunidad de accesibilidad
- 🎓 Education Pitch — Para instituciones educativas
- 💻 Open Source Pitch — Para desarrolladores
- 🌿 Ethical Tech Pitch — Para inversionistas éticos
- 🚀 Visión 2026-2027 — Roadmap completo del ecosistema
- ⚙️ Mejoras de Desempeño — Streaming, modelos locales, robustez ética
- 🌐 Landing Page — Estructura narrativa para web pública
💡 Nota: Esta documentación representa la visión 2.0 del proyecto. Algunas características están en desarrollo o planeadas para implementación futura.
- Transcripción en vivo para apoyo auditivo
- Soporte para español e inglés
- Modo PWA instalable
- Interfaz accesible y colorida
- 3 Capas de Diagnóstico: Localización → Causa → Consecuencia
- Estilos de diagnóstico: Técnico, Ingeniero, Forense
- Multi-shot: Soporte para múltiples fotos por sesión
- Modo asíncrono: "Foto → Procesa → Diagnóstico"
- Reportes completos: Evidencia + diagnóstico + próximos pasos
- Sistema Rail-first: Análisis de voltajes y topología
# 1. Inicia el servidor
pip install -r requirements.txt
python main.py
# 2. Abre Chrome/Edge en: http://localhost:8000
# 3. Click en "Instalar" (ícono ➕ en la barra de direcciones)
# 4. ¡Listo! Ahora tienes Iyari-ear como app# Instalar
pip install -e .
# Comandos disponibles
iyari-ear doctor # Verifica sistema
iyari-ear test-mic # Prueba micrófono
iyari-ear start # Inicia servidorpython square_3000_app.pyFlujo:
- Abres una imagen
- Eliges salida
- Clic en
Generar 3000x3000
La app recorta al centro y exporta una imagen cuadrada exacta de 3000x3000.
- Windows: Ejecutable .exe
- Linux: Script de instalación
- Android (Termux): Guía de instalación
- macOS: Homebrew setup
📖 Guía completa de instalación | Matriz de compatibilidad | 🗺️ Roadmap del Proyecto
Subtítulos en tiempo real en tu celular. Sin fricción. Solo conexión.
📱 Un celular sobre la mesa
🗣️ Alguien habla
✨ Las palabras aparecen
Sin ruido. Sin fricción. Solo conexión.
# Método 1: CLI (si ya lo instalaste)
iyari-ear start
# Método 2: Python directo
pip install -r requirements.txt
python main.py
# Acceder a las aplicaciones:
# - Subtítulos: http://localhost:8000
# - Diagnóstico Electrónico: http://localhost:8000/diagnostic
# - Optimizador de Subtítulos: http://localhost:8000/subtitle-optimizer💡 Nuevo: Instala como PWA para acceso rápido desde tu menú de apps
Un sistema profesional de diagnóstico de placas electrónicas que piensa como un técnico de verdad.
No es solo reconocimiento visual — es razonamiento causal.
Dashboard profesional con modo oscuro, drag & drop, y análisis en tiempo real
📸 Foto → Sueltas la placa → 🧠 App procesa → 📋 Diagnóstico completo
Este flujo te permite:
- ✔ Usar ambas manos para trabajar
- ✔ Usar soldador / aire caliente
- ✔ Tomar mediciones
- ✔ Comparar con otras placas
- ✔ Generar reportes profesionales
|
¿Dónde está la falla?
|
¿Por qué existe la falla?
|
¿Qué rompe funcionalmente?
|
| Estilo | Perfil | Ejemplo |
|---|---|---|
| 🔧 Técnico | Directo y práctico | "3V3 ausente → Regulador falló. Medir salida, revisar entrada 5V." |
| ⚙️ Ingeniero | Causal y metodológico | "El rail 3V3 es generado por un LDO (AMS1117). Causas posibles: (1) Regulador dañado, (2) Entrada 5V insuficiente, (3) Caps en corto..." |
| 🔬 Forense | Exhaustivo y detallado | "Análisis completo: VBUS → Fusible → 5V → U1 → 3V3. Escenarios ordenados por probabilidad: (1) Falla térmica 60%, (2) Corto downstream 25%..." |
📖 Ver ejemplos completos de cada estilo
Prueba el sistema sin hardware:
- Abre http://localhost:8000/diagnostic
- Click en "
▶️ Run Demo (ESP32 3V3 failure)" - Observa el análisis en tiempo real
- Revisa el diagnóstico completo
⏱️ Tiempo: 60 segundos
📸 Foto de placa → App procesa
✔ Identificando rails...
✔ 3V3 encontrado
✔ USB 5V encontrado
✔ Región RF detectada
✔ Posible regulador AMS1117
✔ Hipótesis: 3V3 ausente
📋 RESULTADO:
🎯 Capa 1: Rail 3V3, Regulador U1
🔍 Capa 2: Sin voltaje - Regulador falló
⚡ Capa 3: CRÍTICO - Radio no enciende, placa no arranca
🔧 Próximos pasos:
• Medir voltaje en TP3
• Verificar continuidad desde fuente
• Revisar AMS1117
📊 Puntos de prueba: TP3, TP_3V3, Salida U1
# Accede a la interfaz
http://localhost:8000/diagnostic
# 1. Crear sesión → Ingresa modelo de placa
# 2. Seleccionar estilo (Técnico/Ingeniero/Forense)
# 3. Subir fotos (frontal, backside, microscope, etc.)
# 4. Presionar "Analizar"
# 5. Recibir diagnóstico en tiempo real
# 6. Exportar reporte (JSON/TXT)- Multi-shot: Sube 3-5 fotos de diferentes ángulos
- Sesiones persistentes: Historial de diagnósticos
- Comparación A/B: Compara con "Golden Board"
- Análisis Rail-first: VCC → Regulación → MCU → IO
- Modo Ticket: Saca fotos → App procesa → Devuelve diagnóstico
- Taller de reparación: Diagnóstico rápido antes de cotizar
- Soporte remoto: Cliente envía fotos → Tú das diagnóstico
- Documentación: Genera reportes con evidencia
- Capacitación: Aprende patrones de fallas comunes
- Auditoría: Historial de reparaciones y decisiones
Una aplicación multiplataforma para generar subtítulos en tiempo real. Captura audio desde el micrófono del navegador, lo envía a un servidor backend que lo transcribe a texto, y muestra los subtítulos en la pantalla.
Es una herramienta pensada para ayudar a personas con dificultades auditivas en conversaciones cara a cara, usando un celular, tablet o computadora como pantalla de apoyo.
- 📱 PWA: Instálala como app en cualquier dispositivo
- 🎨 Dashboard Colorido: Diseño profesional con modo oscuro y tema rainbow
- 🔊 Animación Pulse: Indicador visual cuando detecta voz
- ♿ Accesibilidad: Modo alto contraste, texto ultra legible
- 🖥️ CLI Completo: Comandos
doctor,test-mic,start - 🪟 Ejecutable Windows: Doble-click y listo
- 🤖 Soporte Android: Via Termux o PWA
- 🐧 Servicio Linux: systemd para auto-inicio
- 🎬 Optimizador de Subtítulos: Valida y optimiza archivos de subtítulos (SRT, VTT, ASS)
- 🎮 Plugin VLC: Integración con VLC Media Player para optimización automática
- 🌐 API REST: Endpoints para procesamiento de subtítulos vía HTTP
La aplicación tiene dos partes principales:
- Frontend: Una página web (HTML, CSS, JavaScript) que se ejecuta en el navegador. Se encarga de pedir permiso para el micrófono, grabar el audio y enviarlo al backend. También recibe el texto transcrito y lo muestra.
- Backend: Un servidor en Python (FastAPI, WebSockets) que recibe los fragmentos de audio, utiliza la API de reconocimiento de voz de Google para transcribirlos a texto y los devuelve al frontend.
María tiene pérdida auditiva parcial. Está sentada con una amiga en una cafetería ruidosa. Coloca su celular frente a la mesa y abre Iyari-ear.
La app muestra en tiempo real:
— ¿Quieres café o té?
— Café, por favor.
— ¿Azúcar?
— No, gracias.
María no necesita pedir que repitan. Lee y participa.
Un paciente con dificultad auditiva asiste al doctor.
El doctor habla normalmente. El celular del paciente muestra:
Doctor: Vamos a ajustar la dosis.
Doctor: ¿Has tenido mareos últimamente?
Paciente: No, solo un poco de cansancio.
No hay grabaciones. No hay almacenamiento. Solo texto en tiempo real.
Una abuela con problemas auditivos usa una tablet durante la comida familiar.
La conversación aparece como subtítulos grandes y claros:
— El pastel es de chocolate.
— Cumples 8 años mañana.
— ¿Te gustó la escuela?
La tecnología desaparece. Solo queda la conversación.
No métricas. No KPIs. Historias pequeñas de humanos.
Una tablet en la mesa. Palabras que aparecen. Una abuela que vuelve a participar en la conversación familiar. No necesitó preguntar "¿qué dijiste?" ni una sola vez.
Un técnico saca foto del ESP32 sin voltaje. La app identifica: "Rail 3V3 ausente → Regulador AMS1117". Mide. Confirma. Repara. Todo en 60 segundos.
Un paciente con dificultad auditiva. Un doctor que habla normalmente. Un celular que traduce voz a texto en tiempo real. La conversación fluye. Sin repeticiones. Sin malentendidos.
Un cliente en otro país envía foto de una placa. El técnico la analiza con Iyari-ear. Devuelve diagnóstico completo: ubicación de falla, causa raíz, próximos pasos. Todo sin estar físicamente presente.
Estos casos legitiman el propósito más que cualquier paper.
"Creado con cariño para una amiga."
Iyari-ear no es un producto. Es una herramienta de empatía.
- Ayudar a escuchar sin invadir.
- Apoyar sin vigilar.
- Mostrar palabras, no juzgar voces.
La tecnología al servicio de la conexión humana.
Para los ingenieros — desde la belleza:
- Privacidad por diseño: El audio se transcribe y desaparece. Sin logs. Sin bases de datos. Sin historiales.
- Diagnóstico causal, no visual: El sistema razona sobre topología y flujo de energía, no solo reconoce componentes.
- Subtítulos para conexión humana, no registro: Las palabras aparecen para ser leídas, no para ser guardadas.
- Cero métricas. Cero vigilancia. Cero gamificación: No medimos engagement, retención ni conversiones. Medimos si ayuda.
Este es oro para cualquier tecnólogo ético.
Este proyecto nació de ver a alguien que amas esforzarse para entender una conversación.
No de un análisis de mercado.
No de una oportunidad de negocio.
No de métricas o KPIs.
Nació del deseo de que alguien especial no se quedara fuera de la conversación.
En purépecha, Iyari significa "corazón" o "alma".
Este proyecto tiene alma porque nació del corazón.
Cada línea de código fue escrita con una pregunta en mente:
"¿Esto ayuda a conectar o complica la vida?"
Y esa pregunta sigue guiando cada decisión técnica.
Lee la historia completa en el Manifiesto.
Micrófono del navegador
↓
Fragmentos de audio
↓
Servidor Python (WebSockets)
↓
API de reconocimiento de voz
↓
Texto transcrito
↓
Subtítulos en pantalla
Todo ocurre en segundos.
Iyari-ear ahora incluye un potente sistema de optimización de subtítulos que mejora la legibilidad y compatibilidad de archivos de subtítulos.
- ✅ Validación automática: Detecta problemas de timing, superposiciones y formato
- 🔧 Optimización inteligente: Corrige duraciones, divide líneas largas, ajusta espaciado
- 📁 Múltiples formatos: Soporta SRT, VTT, ASS/SSA
- 🎮 Plugin VLC: Integración directa con VLC Media Player
- 🌐 Interfaz web: Interfaz drag-and-drop en el navegador
- 💻 CLI potente: Procesamiento por lotes desde línea de comandos
- 🔌 API REST: Integración con otros sistemas
# Optimizar subtítulos desde CLI
iyari-ear process-subtitle pelicula.srt pelicula.optimized.srt
# Instalar plugin para VLC
iyari-ear install-vlc-plugin
# Acceder a interfaz web
# Visita: http://localhost:8000/subtitle-optimizer- No es una grabadora de audio
- No es un sistema de vigilancia
- No guarda conversaciones
- No reemplaza intérpretes de lengua de señas
- No es perfecto en ambientes extremadamente ruidosos
Es una herramienta de apoyo, no de control.
- Requiere conexión a internet
- La precisión depende del ruido ambiental
- Acentos muy marcados pueden afectar la transcripción
- No está pensada para transcripción legal o forense
Estas limitaciones son parte del diseño ético del proyecto.
- Python 3.7 o superior.
- Un micrófono conectado al dispositivo donde se abrirá la página web.
- Conexión a internet (ya que se usa la API de Google para la transcripción).
Sigue estos pasos para poner en marcha la aplicación.
Primero, necesitamos instalar las dependencias de Python y ejecutar el servidor.
# 1. (Opcional pero recomendado) Crea un entorno virtual
python -m venv venv
source venv/bin/activate # En Windows usa: venv\\Scripts\\activate
# 2. Instala las librerías necesarias desde requirements.txt
pip install -r requirements.txt
# 3. Inicia el servidor
python main.pySi todo va bien, verás un mensaje como este en tu terminal, lo que significa que el servidor está escuchando:
Servidor de WebSockets iniciado en ws://0.0.0.0:8000
Deja esta terminal abierta mientras usas la aplicación.
Ahora que el servidor está corriendo, puedes abrir la interfaz.
Opción A: En la misma computadora
- Abre el archivo
index.htmldirectamente en tu navegador web (Firefox, Chrome, etc.). - La página se cargará. Presiona el botón "Iniciar".
- El navegador te pedirá permiso para usar el micrófono. Debes aceptarlo.
- ¡Habla y los subtítulos aparecerán en la pantalla!
Opción B: En tu celular (o cualquier otro dispositivo)
Esta es la forma más práctica de usarlo.
-
Asegúrate de que tu celular y la computadora donde corre el servidor estén conectados a la misma red Wi-Fi.
-
Busca la dirección IP local de tu computadora.
- En Windows: Abre
cmdy escribeipconfig. Busca la dirección "IPv4 Address". - En macOS o Linux: Abre una terminal y escribe
hostname -Ioifconfig. - Será un número como
192.168.1.10o10.0.0.5.
- En Windows: Abre
-
En el navegador de tu celular, introduce la siguiente dirección:
http://<LA_IP_DE_TU_COMPUTADORA>:8000(Reemplaza<LA_IP_DE_TU_COMPUTADORA>con el número que encontraste). -
La página cargará. Presiona "Iniciar", acepta el permiso del micrófono y ¡listo! El servidor de Python se encarga de todo.
Si durante la instalación (pip install -r requirements.txt) ves un error relacionado con PyAudio y portaudio.h, significa que te falta una librería del sistema.
Puedes solucionarlo instalando el paquete de desarrollo de PortAudio. En sistemas basados en Debian/Ubuntu, el comando es:
sudo apt-get update && sudo apt-get install -y portaudio19-devDespués de instalarlo, vuelve a ejecutar pip install -r requirements.txt.
"El universo ama las demostraciones."
Si Iyari-ear te ayuda (o a alguien que conoces), nos encantaría verlo en acción.
- 📱 Graba la app funcionando (con celular o cámara)
- 🗣️ Muestra subtítulos apareciendo en tiempo real
- ✂️ Edita a 30 segundos
- 📤 Comparte en redes o GitHub
Guía completa: GUIA_DEMO.md
- GitHub: Abre un Issue con tu demo/historia
- Twitter/X: Usa #IyariEar #Accesibilidad
- LinkedIn: Comparte tu caso de uso
- YouTube: Video completo con descripción
Usa la plantilla: ISSUE_TEMPLATE_HISTORIAS_REALES.md
No necesitamos métricas. Necesitamos historias humanas.
Este proyecto vive de la comunidad.
- 💻 Código: Mejoras, features, fixes
- 📖 Documentación: Traducciones, guías, ejemplos
- 🐛 Reporte de bugs: Con contexto y pasos para reproducir
- 💡 Ideas: Sugerencias que ayuden a conectar personas
- 🎬 Demos: Muestra la app en acción
- ❤️ Historias: Comparte cómo te ayudó → TESTIMONIOS.md
Lee la Guía de Contribución para:
- Estilo técnico (Python, JavaScript, HTML/CSS)
- Decisiones prohibidas (grabación, analytics, gamificación)
- Estilo de comunicación (PRs, issues)
- Configuración del entorno de desarrollo
- Proceso de code review
# Fork el repositorio
git clone https://github.com/TU_USUARIO/Iyari-ear.git
# Crea una rama
git checkout -b feature/mi-mejora
# Instala dependencias
pip install -r requirements.txt
# Haz tus cambios, commit y push
git push origin feature/mi-mejora
# Abre un Pull RequestRecuerda: Cada decisión debe responder:
"¿Esto ayuda a conectar o complica la vida?"
- Arquitectura Técnica - Diagramas y estructura del sistema
- API Reference - Documentación completa de REST y WebSocket APIs
Este proyecto está diseñado para ser usado, modificado y compartido libremente.
Única condición: Mantén el espíritu de empatía y privacidad.
- 🏗️ Arquitectura Técnica - Cómo funciona el sistema
- 🌐 API Reference - REST y WebSocket APIs documentadas
- 🤝 Guía de Contribución - Estilo técnico y humano
- 📊 Impacto Técnico - Métricas y valor cuantificado
- 💝 Manifiesto - El alma del proyecto
- 💬 Testimonios - Historias reales de impacto humano
- 🎬 Guía de Demo - Crea tu demo de 30 segundos
- 📖 Identidad del Repo - Convenciones y estilo
- 🚀 Release v1.0 - Notas de la primera coronación
- ⚡ Inicio Rápido - Empieza en 60 segundos
En 2026, Iyari-ear demuestra que el puente existe.
En 2027 queremos que más personas lo crucen.
No hay roadmap con fechas.
No hay promesas grandilocuentes.
Solo una dirección:
- Más idiomas, más contextos, más personas conectadas.
- Diagnóstico que aprende de cada técnico que lo usa.
- Comunidad de personas que construyen empatía técnica.
El futuro le da respiración al presente.
La ciencia y el arte siempre piden horizonte 🌅
Iyari-ear v1.0 — "Para que nadie quede fuera de la conversación"
Un puente de empatía técnica
Creado con cariño para una amiga.
Compartido con amor para el mundo.
✨ Enero 2025 ✨
"Este proyecto no necesita empujones. Necesita testigos."
"La mejor coronación es humana + mínima + real."
⭐ Si este proyecto te ayuda, dale una estrella en GitHub
🎬 Comparte tu demo
❤️ Cuéntanos tu historia
