Голосовой поиск: спросить вместо набрать

25 сентября 2026 · для пользователей · 5 минут чтения

Набрать запрос — это пять секунд печати, опечатка, автозамена и правка. Спросить — две секунды голосом. Но голосовой поиск почему-то часто «не понимает». Дело почти никогда не в микрофоне — дело в формулировке. Разбираем, почему устный запрос не равен текстовому и как спрашивать, чтобы получать ответ, а не страницу ссылок.

Почему голосовой запрос ≠ текстовый

Текстовый запрос мы пишем телеграфно: «погода тверь завтра». Голосом говорим естественно: «А какая завтра погода в Твери будет?». Поисковики обо работают с первым форматом, а говорим мы вторым. Мост между ними — LLM: она переформулирует естественную речь в поисковый интент. Ассистенты с LLM внутри (как Амалия) находят ответ прямо, без страницы результатов.

Формулировки, которые работают

Что происходит между вопросом и результатом

Полный путь: микрофон ловит фразу → VAD отрезает тишину → Whisper распознаёт текст (~200 мс) → LLM решает, что делать: ответить из знаний или искать. Если искать — формулируется запрос, сёрфится, результат синтезируется в ответ голосом. На LPU весь конвейер укладывается в секунду с небольшим — разбор по этапам с цифрами.

Когда поиск лучше набрать

Голосом спрашивайте факты: погода, курс, время работы, «как пишется». Набирайте, когда нужно: точное сравнение моделей телефона, сложный многословный запрос, приватная тема (не всегда хочется озвучивать). Смешанный режим — честный ответ ассистента с голосом и ссылками на источнике — лучше всего покрывает оба сценария.

Скорость решает

Главное отличие живого голосового поиска — не точность, а темп. Ответ за секунду меняет привычку: незачем открывать браузер. Ответ за десять секунд — и человек возвращается к набору. Именно поэтому в Амалии упор сделан на латентность пайплайна, а не только на полноту ответов.

Попробуйте спросить вживую: APK Амалии — и засеките, через сколько секунд придёт ответ.