2026-08-05
В июле ИИ плотно вошёл в мою жизнь, так как я начал создание прототипа приложения Android для распознавания голоса. На текущий момент я сделал как распознавание текста (Speech-to-text), так и произношение текста (Text-to-speech).
Распознавание голоса сделал с помощью Vosk. Произношение текста — с помощью Sherpa-Onnx. Обе библиотеки работают прямо на устройстве без обращения к серверу.
В августе между STT и TTS добавлю LLM, чтобы приложение Android могло консультировать человека голосом по предоставленному набору данных.
PS: Еженедельные отчёты по этой разработке публикую в канале ТГ.