Стартап AlephNeuro (по данным другого источника — Aleph) показал прототип системы, которая распознаёт речь без единого звука: датчик УЗИ прикладывается под подбородок, а нейросеть транскрибирует в текст движения языка и гортани во время артикуляции.
Идея решает проблему «шептунов» — инженеров, которые бормочут команды в микрофон, диктуя код голосовым помощникам типа Клода, глядя в терминал. Технология позволяет отдавать голосовые команды ИИ полностью молча, что может изменить практику «голосового вайбкодингiа».
- Компания заметила, что ультразвуковое сканирование гортани позволяет фиксировать движения языка при артикуляции без произнесения звука
- Нейросеть транскрибирует эти движения языка непосредственно в текст
- Разработка представлена как первый прототип технологии
- Подробности опубликованы в блоге компании: alephneuro.com/blog/silent-speech
- Название компании в источниках указано по-разному: AlephNeuro (АИ для Всех) и Aleph (Что вы мне рекламируете?)
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖