
О проекте
Mimora — десктопный тренажёр произношения: локальная LLM генерирует фразу из текста пользователя, TTS озвучивает её, пользователь повторяет, а движок распознавания сравнивает произношение с эталоном и выдаёт оценку 0–100 с указанием слов и звуков для доработки. Все шаги — синтез речи, распознавание, генерация фраз — считаются на устройстве без облака, аккаунтов и подписки, единственная плата — место на диске под модели (около 10 ГБ). Полноценно откалиброван только английский (американский и британский варианты); испанский заявлен как эксперимент — своей калибровки нет, оценка падает на английскую, часть движков недоступна. Есть режим без LLM для слабых машин, где фразы берутся дословно из введённого текста построчно. Проект с открытым кодом (MIT), ориентирован в первую очередь на Windows, но поддерживает macOS и Linux.
Что умеет
- Генерация фраз локальной LLM из собственного текста пользователя (или дословно, в режиме без LLM)
- Запись одной кнопкой с автоматической остановкой по тишине
- Оценка произношения от 0 до 100 с указанием конкретных слов и звуков для доработки
- Два движка сравнения: по фонемам (espeak + wav2vec2) и акустический (DTW по эмбеддингам Wav2Vec2), оба калибруемые под голос пользователя
- Повтор эталонной фразы и своей записи подряд для сравнения
- Панель перевода практикуемой фразы более чем на 200 языков