Задачи
Теоретически исследовать, какие свойства PCM и речевого сигнала мы можем гарантированно измерять во времени и частоте, прежде чем проектировать новый генератор.
Интерактивный многодорожечный редактор для ручного экспериментирования с параметрами синтезатора во времени, циклического прослушивания и поиска интересных звучаний.
Построить экспериментальную карту того, как изменения управляющих параметров во времени проявляются в PCM и акустических признаках с учётом лагов и памяти DSP.
Проверить, можно ли автоматически восстанавливать сценарий генератора из записанного звука, сначала на собственных синтетических примерах с известным ground truth, затем на человеческой речи.
Ускорить ручной поиск качественных звуков: редактировать сценарии визуально, проигрывать сразу и уметь отправлять эталонный и синтетический логи ИИ-агенту для возврата изменённого JSON.
Найти и изучить браузерные проекты и DSP-подходы, которые программно воспроизводят хотя бы несколько человеческих слогов или голосовых звуков с высоким качеством, без генеративного TTS и без привязки ядра к буквам/слогам.