A cloud-based pronunciation analysis API using OpenAI's Whisper and TTS services.
- Audio transcription using OpenAI Whisper API
- Pronunciation scoring and analysis
- IPA (International Phonetic Alphabet) transcription
- Text-to-speech using OpenAI TTS
- Firebase integration for data storage
- Statistics and analytics
- Fast and scalable
- Install dependencies:
python -m venv venv
source venv/bin/activate # Windows: venv\Scripts\activate
pip install -r requirements.txt-
Configure environment variables in
.env -
Add Firebase credentials file
-
Run the server:
uvicorn app.main:app --reloadPOST /api/transcribe- Transcribe audio filePOST /api/analyze- Full pronunciation analysisPOST /api/grade- Get pronunciation gradePOST /api/ipa- Get IPA transcription
POST /api/tts- Generate pronunciation audioPOST /api/tts/slow- Generate slow pronunciation
GET /api/recordings- List all recordingsGET /api/recordings/{id}- Get specific recordingDELETE /api/recordings/{id}- Delete recordingGET /api/statistics- Get usage statistics
GET /api/health- Health checkGET /api/phrases- Get practice phrases