Голосовой ввод или набор: когда говорить быстрее печати
23 сентября 2026 · сравнение · 4 минуты чтения
Средняя скорость набора на телефоне — 30–40 знаков в минуту у тренированного человека. Средняя речь — 600–800 знаков в минуту. Разрыв в 15–20 раз — и весь вопрос в том, почему мы всё ещё печатаем. Разбираем честно: когда голос реально быстрее, а когда он только добавит работы.
Когда голос побеждает
- Длинные сообщения без точных правок. «Слушай, я доеду через полчаса, купи хлеб и не забудь позвонить маме» — проговорить в 5 раз быстрее, чем набрать;
- Заметки на ходу. Идея не переживает путь «придумал → достал телефон → разблокировал → нашёл заметки → набрал»;
- Руки заняты. Кухня, машина, сумки, ребёнок — голос единственный свободный интерфейс;
- Команды телефону. «Будильник на семь» голосом — 2 секунды против двадцати тапов.
Когда клавиатура остаётся королём
- Точность символов: адреса, коды, e-mail, ссылки — модель распознавания будет угадывать, а тут угадывать нельзя;
- Тихие места: офис, транспорт, ночной чат — проговаривать вслух неудобно всем;
- Сложное форматирование: таблицы, разметка, смешанный язык — диктовка захлебнётся.
Что изменилось в голосовом вводе за пару лет
Раньше диктовка была гаданием: модель путалась в русской морфологии, съедала окончания, вставляла «точка» как текст. Сейчас облачные модели (Whisper и родня) разбирают разговорный русский лучше, чем многие люди печатают без ошибок — при условии быстрого инференса: если ответ идёт за 0,2 секунды, как на Groq, диалог сохраняет темп.
Но есть нюанс: ввод ≠ действия
Клавиатурная диктовка вставляет текст — и всё. Голосовой ассистент идёт дальше: фраза «будильник на семь» — это не текст в поле, а действие в системе. Граница между «наговорить сообщение» и «сказать телефону, что делать» — вот где проходит настоящая революция. Как это устроено — в разборе пайплайна, список действий — в справочнике команд.
Проверь скорость на своей руке: скачай Амалию и проговори ей десять команд — потом попробуй то же самое пальцами.