Голосовой ввод в word. Голосовой набор на Андроид: как пользоваться

Распознавание речи - технология, позволяющая значительно повысить продуктивность как на работе, так и дома. Надиктовать документ можно в три раза быстрее, чем напечатать его.

Распознавание речи онлайн

Чтобы преобразовать речь в текст, можно воспользоваться соответствующим онлайн-сервисом в браузере. Сайты по распознаванию речи, как правило, не требуют регистрации и оплаты, они очень удобны в использовании. В первую очередь, потребуется установить браузер Google Chrome. Это связано с тем, что все сервисы работают на одном и том же движке распознавания речи от Гугл. Качество распознавания зависит от микрофона, а также ритма и четкости речи.

Читайте также: Включение микрофона на Windows 8

Способ 1: Speechnotes

Спичноутс - самый популярный сервис по распознаванию речи онлайн, предоставляющий большой выбор языков, расширенные возможности постановки знаков препинания и отправки надиктованного текста в сторонние приложения.

Онлайн-сервис Speechnotes

Порядок действий:

    1. Нажмите на иконку микрофона справа.
    2. Выберите «Разрешить» во всплывающем окне браузера. Слева над иконкой микрофона появится мигающий красный кружок - это означает, что запись включена.


    1. Выберите русский язык из выпадающего меню.


    1. Начните диктовать.
    2. Чтобы остановить запись, снова нажмите на иконку микрофона.
    3. Скопируйте текст в буфер обмена (А) или отправьте в сторонние сервисы, используя панель инструментов слева (B).


Для расстановки знаков препинания есть три способа:

    1. Диктовка: справа есть перечень знаков с соответствующим произношением;


    1. Набор на клавиатуре - самый быстрый способ, так как добавляет знак еще до того, как заканчивается речь. Здесь главное дождаться, пока надиктованная речь появится в буфере (см. скриншот) и только после этого нажимать кнопку, иначе знак препинания появится перед надиктованной речью, а не после;


  1. Кнопка на сайте - достаточно нажать соответствующий знак препинания в панели справа (см. пункт 1).

Результаты распознавания во многом будут зависеть от качества микрофона и диктовки. Для наилучшего результата говорить нужно медленно и четко. Это относится ко всем сервисам по распознаванию речи.

Способ 2: Speechlogger

Спичлоггер - многофункциональный сервис по распознаванию речи, с помощью которого можно не только диктовать тексты, но и переводить их на другие языки в режиме реального времени с Google Translate, а также транскрибировать аудиофайлы.

Онлайн-сервис Speechlogger

Чтобы начать запись на сайте Speechlogger, выполните следующие действия:

    1. Зайдите на сайт, прокрутите немного вниз до блока с голубым фоном и нажмите на иконку микрофона.
    2. Выберите «Разрешить» .
    3. Найдите в списке русский язык, если это необходимо.
    4. Нажмите на кнопку справа вверху, чтобы блок распознавания речи занимал весь экран (это не обязательно, но так удобнее работать).


    1. Начинайте диктовать.
    2. Текст, в котором может быть ошибка, выделяется красным цветом. Это позволяет быстрее находить неточности и исправлять их.


    1. После того, как работа закончена, снова нажмите на иконку микрофона.
    2. Выделите весь текст с помощью кнопки All (A) и скопируйте, нажав правой кнопкой мыши и выбрав «Копировать» (сочетание клавиш Ctrl+C не работает), либо воспользуйтесь панелью инструментов (B), чтобы отправить текст по электронной почте, сохранить в формате.txt, .doc, загрузить на Google Drive или распечатать.


Способы постановки знаков препинания:

    1. Диктовка: чтобы узнать, как произносить тот или иной знак препинания, наведите на него курсор - во всплывающем окне появится подсказка.
    2. Просто нажмите на знак препинания в панели, расположенной над областью для текста.


    1. Автопунктуация: на сайте можно задать настройки для автоматической постановки знаков препинания. Не очень удобный вариант, так как при каждой паузе система ставит точку, при этом русский язык слишком гибкий и многообразный - задать четкие условия для постановки определенных знаков препинания невозможно. Поэтому рекомендуется отключить эту функцию, убрав соответствующую галочку.


Дополнительные настройки расположены в верхнем левом углу.


С их помощью можно включить или отключить следующие функции:

    • Автосохранение текста: если функция включена, доступ ко всем сессиям можно получить, нажав на иконку папки в панели инструментов;


  • Выделение слов красным шрифтом;
  • Отметки времени в тексте (включены по умолчанию).

Кроме того, можно задать настройки для автопунктуации и изменить цвет фона.

Способ 3: Online Dictation

Online Dictation - удобный сервис с лаконичным интерфейсом. Основное преимущество - простота в использовании.

Онлайн-сервис Dictation

    1. Сервис автоматически определяет язык по умолчанию, настроенный в браузере. Если язык не установлен либо используется гостевая учетная запись Chrome, необходимо установить русский: выпадающий список языков расположен внизу под областью для текста.


    1. Нажмите кнопку «Start Dictation» .


    1. Разрешите использование микрофона на сайте.


    1. Начинайте диктовать. Для постановки знаков препинания используйте голосовые команды: «точка», «запятая», «вопросительный знак», «восклицательный знак», остальные знаки ставятся при помощи клавиатуры. Для начала нового абзаца действует голосовая команда «новый параграф», для перехода на новую строку - «новая строка».
    2. Закончив диктовать, нажмите «Stop Listening» .


  1. После того как текст готов, его можно:
    • Скопировать, нажав кнопку «Copy» (1);
    • Сохранить в формате.txt, нажав кнопку «Save» (2);
    • Стереть, нажав кнопку «Clear» (3).


Способ 4: SpeechTexter

Сервис по распознаванию речи СпичТекстер отличается красивым компактным дизайном и позволяет редактировать текст прямо на сайте. Форматирование сохраняется при переносе текста в сторонний редактор.

Онлайн-сервис SpeechTexter

    1. Для прекращения записи нажмите «Stop» .


    1. После того, как текст записан, его можно отформатировать, используя инструменты на панели, расположенной над текстом.


    1. Готовый текст можно скопировать (1), сохранить в формате.txt (2) или распечатать (3).


Код для вставки на сайт.

Совет: можно изменить свойство recognition.lang и подставить ‘ru-RU’ вместо ‘en-US’, тогда по умолчанию устанавливается русский язык.

У каждого из сервисов есть свои преимущества и недостатки. Рекомендуется попробовать поработать на каждом из них и выбрать наиболее подходящий, исходя из своих целей и предпочтений.

Если Вы слишком медленно печатаете на клавиатуре, а учиться десятипальцевому методу набора лень, можете попробовать воспользоваться современными программами и сервисами голосового ввода текста.

Клавиатура, бесспорно, достаточно удобный инструмент управления компьютером. Однако, когда дело доходит до наборки длинного текста, мы понимаем всё её (а, если быть честными, то наше:)) несовершенство... На ней ещё нужно уметь быстро печатать!

Пару лет назад я, желая упростить себе работу по написанию статей, решил найти такую программу, которая бы позволяла преобразовать голос в текст. Я думал, как было бы хорошо, если бы я просто говорил всё что нужно в микрофон, а компьютер печатал вместо меня:)

Каково же было моё разочарование, когда я понял, что на тот момент никаких реально работающих (а тем более бесплатных) решений для этого дела не существовало. Были, правда, отечественные разработки, вроде "Горыныча" и "Диктографа". Они понимали русский язык, но, увы, качество распознавания речи имели довольно низкое, требовали долгой настройки с созданием словаря под свой голос, да ещё и стоили довольно недёшево...

Потом на свет появился Android и ситуация немного сдвинулась с мёртвой точки. В этой системе голосовой ввод появился в качестве встроенной (и довольно удобной) альтернативы ввода с виртуальной экранной клавиатуры. И вот недавно в одном из комментариев меня спросили, есть ли возможность голосового ввода для Windows? Я ответил, что пока нет, но решил поискать и оказалось, что, может и не совсем полноценная, но такая возможность существует! О результатах моих изысканий и будет сегодняшняя статья.

Проблема распознавания речи

Перед тем как начать разбор существующих на сегодняшний день решений для голосового ввода в Windows, хотелось бы немного осветить суть проблемы распознавания речи компьютером. Для более точного понимания процесса предлагаю взглянуть на следующую схему:

Как видим, преобразование речи в текст происходит в несколько этапов:

  1. Оцифровка голоса . На этом этапе качество зависит от чёткости дикции, качества микрофона и звуковой карты.
  2. Сравнение записи с записями в словаре . Здесь работает принцип "чем больше - тем лучше": чем больше записанных слов содержит словарь, тем выше шансы того, что Ваши слова будут распознаны правильно.
  3. Вывод текста . Система автоматически, ориентируясь по паузам, пытается выделить из потока речи отдельные лексемы, соответствующие шаблонным лексемам из словаря, а затем выводит найденные соответствия в виде текста.

Главная проблема, как нетрудно догадаться, кроется в двух основных нюансах: качестве оцифрованного отрезка речи и объёме словаря с шаблонами. Первую проблему реально минимизировать даже при наличии дешёвого микрофона и стандартной звуковой карты. Достаточно просто говорить не спеша и внятно.

Со второй проблемой, увы, не всё так просто... Компьютер, в отличие от человека, не может корректно распознать одну и ту же фразу, сказанную, например, женщиной и мужчиной. Для этого в его базе должны существовать оба варианта озвучки разными голосами!

В этом и кроется основной подвох. Создать словарь для одного человека, в принципе, не так сложно, однако, учитывая, что каждое слово должно быть записано в нескольких вариантах, это получается очень долго и трудозатратно. Поэтому, большинство из существующих на сегодняшний день программ для распознавания речи либо стоят слишком дорого, либо не имеют собственных словарей, предоставляя пользователю возможность создать их самостоятельно.

Я не зря упомянул про Андроид чуть выше. Дело в том, что Гугл, который его разрабатывает, создал и единственный на сегодня общедоступный глобальный онлайн-словарь для распознавания речи (причём многоязычный!) под названием Google Voice API . Подобный словарь для русского языка также создаёт Яндекс, но пока он, увы, ещё непригоден для использования в реальных условиях. Поэтому практически все бесплатные решения, которые мы рассмотрим ниже, работают именно со словарями Google. Соответственно, все они имеют одинаковое качество распознавания и нюансы заключаются лишь в дополнительных возможностях...

Программы голосового ввода

Полноценных программ для голосового ввода под Windows не так уж много. Да и те, которые есть и понимают русский язык, в основном являются платными... Например, стоимость популярной пользовательской системы преобразования голоса в текст RealSpeaker стартует с отметки 2 587 руб, а профессионального комплекса Цезарь-Р аж с 35 900 руб!

Но среди всего этого дорогого софта имеется одна программка, которая не стоит и копейки, но при этом предоставляет функционал, более чем достаточний для большинства пользователей. Называется она MSpeech :

Основное окно программы имеет максимально простой интерфейс - индикатор уровня звука и всего три кнопки: включить запись, остановить запись и открыть окно настроек. Работает MSpeech также весьма просто. Вам нужно нажать кнопку записи, установить курсор в окно, в которое должен выводиться текст и начать диктовать. Для большего удобства запись и её остановку лучше производить горячими клавишами, которые можно задать в Настройках:

Кроме горячих клавиш Вам может потребоваться изменить тип передачи текста в окна нужных программ. По умолчанию установлен вывод в активное окно, однако, можно задать передачу в неактивные поля или в поля конкретной программы. Из дополнительных возможностей стоит отметить группу настроек "Команды", которая позволяет реализовать голосовое управление компьютером при помощи заданных Вами фраз.

Вообще же MSpeech - довольно удобная программа, которая позволяет набирать текст голосом в любом окне Windows. Единственный нюанс в её использовании - компьютер должен быть подключён к Интернету для доступа к словарям Гугла.

Голосовой ввод онлайн

Если Вам не хочется устанавливать на свой компьютер никаких программ, но есть желание попробовать вводить текст голосом, можете воспользоваться одним из многочисленных онлайн-сервисов, которые работают на базе всё тех же словарей Гугла.

Ну и, естественно, первым делом стоит упомянуть о "родном" сервисе Google под названием Web Speech API :

Этот сервис позволяет переводить в текст неограниченные отрезки речи на более чем 50 языках! Вам достаточно просто выбрать язык, на котором Вы говорите, нажать на иконку микрофона в правом верхнем углу формы, при необходимости подтвердить разрешение на доступ сайта к микрофону и начать говорить.

Если Вы не используете какую-либо узкоспециализированную терминологию и говорите внятно, то сможете получить весьма неплохой результат. Кроме слов сервис "понимает" ещё и знаки препинания: если Вы скажете "точка" или "запятая", необходимый знак появится в форме вывода.

По окончании записи распознанный текст будет автоматически выделен и Вы сможете скопировать его в буфер обмена или отправить по почте.

Из недостатков стоит отметить лишь возможность работы сервиса только в браузере Google Chrome старше 25-й версии, а также отсутствие возможности мультиязычного распознавания.

Кстати, на нашем сайте вверху Вы найдёте полностью русифицированную версию этой же формы распознавания речи. Пользуйтесь на здоровье;)

На базе сервиса Гугла существует достаточно аналогичных онлайн-ресурсов распознавания речи. Одним из представляющих для нас интерес можно назвать сайт Dictation.io :

В отличие от Web Speech API, Dictation.io имеет более стильное оформление в виде блокнота. Основным его преимуществом перед сервисом Гугла является то, что он позволяет остановить запись, а затем снова запустить и при этом введённый ранее текст сохранится пока Вы сами не нажмёте кнопку "Clear".

Как и сервис Google Dictation.io "умеет" ставить точки, запятые, а также восклицательный знак и знак вопроса, но не всегда начинает новое предложение с большой буквы.

Если же Вы ищете сервис с максимальным функционалом, то, наверное, одним из лучших в этом плане будет :

Главные преимущества сервиса:

  • наличие русскоязычного интерфейса;
  • возможность просмотра и выбора вариантов распознавания;
  • наличие голосовых подсказок;
  • автоотключение записи после длительной паузы;
  • встроенный текстовый редактор с функциями копирования текста в буфер обмена, распечатки его на принтере, отправки по почте или в Твиттер и перевода на другие языки.

Единственным недостатком сервиса (кроме уже описанных общих недостатков Web Speech API) является не совсем привычный для подобных сервисов алгоритм работы. После нажатия кнопки записи и надиктовки текста, его нужно проверить, выбрать вариант, наиболее соответствующий тому, что Вы хотели сказать, а затем перенести в текстовый редактор внизу. После чего процедуру можно повторить.

Плагины для Хрома

Кроме полноценных программ и онлайн-сервисов, существует ещё один способ распознать речь в текст. Этот способ реализовывается за счёт плагинов для браузера Google Chrome.

Главным преимуществом использования плагинов является то, что с их помощью Вы можете вводить текст голосом не только в специальной форме на сайте сервиса, но и в любом поле ввода на любом веб-ресурсе! Фактически плагины занимают промежуточную нишу между сервисами и полноценными программами для голосового ввода.

Одним из лучших расширений для перевода речи в текст является SpeechPad :

Не совру, если скажу, что SpeechPad - один из лучших русскоязычных сервисов перевода речи в текст. На официальном сайте Вы найдёте довольно мощный (хоть и немного староватый дизайном) онлайн-блокнот со множеством продвинутых функций, среди которых есть:

  • поддержка голосовых команд управления компьютером;
  • улучшенная поддержка расстановки знаков препинания;
  • функция отключения звуков на ПК;
  • интеграция с Windows (правда, на платной основе);
  • возможность распознавания текста с видео или аудиозаписи (функция "Транскрибация");
  • перевод распознанного текста на любой язык;
  • сохранение текста в текстовый файл, доступный для скачивания.

Что же касается плагина, то он предоставляет нам максимально упрощённый функционал сервиса. Установите курсор в нужное Вам поле ввода, вызовите контекстное меню и нажмите на пункт "SpeechPad". Теперь подтвердите доступ к микрофону и, когда поле ввода станет розовым, надиктуйте нужный текст.

После того, как Вы прекратите говорить (пауза более чем в 2 секунды), плагин сам остановит запись и выведет в поле всё, что Вы сказали. При желании Вы можете зайти в настройки плагина (правый клик на иконке плагина вверху) и изменить параметры по умолчанию:

Как ни странно, но во всём Интернет-магазине расширений Гугла мне больше не попалось ни одного стоящего плагина, который бы позволял реализовать голосовой ввод в любом текстовом поле. Единственным похожим расширением было англоязычное . Оно добавляет иконку микрофона ко всем полям ввода на веб-странице, но не всегда правильно располагает её, поэтому она может оказаться вне экрана...

Голосовой набор текста подразумевает под собой ввод, который осуществляется не руками, а голосом. Для многих пользователей это покажется отличной альтернативой традиционному способу. При этом необходимо учитывать некоторые тонкости: на качество работы влияют такие показатели как четкость речи, характеристики микрофона ну и, собственно, сами программы. Для комфортной работы потребуется установить качественную аппаратуру, выбрать наиболее удобную для себя программу.

Онлайн-сервисы

В браузере Google Chrome есть возможность осуществлять голосовой ввод с использованием только голоса и микрофона, используя Speechpad (Голосовой блокнот). По отзывам интернет-пользователей – это один из наиболее качественных ресурсов , который позволяет записывать речь в текст практически без ошибок. Спичпад рекомендуется использовать только в браузере Google Chrome, так как его работа в остальных браузерах будет некорректной.

С сервисом можно работать в обозревателе, либо использовать расширение. Если необходимо расширение, то его следует установить в браузер. При нажатии на значок появится возможность перейти сразу на сайт сервиса. Кроме этого, расширение позволяет выставлять ряд определенных настроек для PRO-пользователей. Позволяет осуществлять интеграцию с операционной системой, благодаря чему текст можно печатать в любом открытом приложении, где есть возможность ввода, например, Microsoft Word или адресная строка браузера.

Как только расширение установится, рядом с адресной строкой браузера появится соответствующий значок. Если нажать на него, можно открыть меню, которое позволит перейти сразу на сайт. Какие-либо дополнительные параметры в меню выставлять не требуется. Также можно воспользоваться прямой ссылкой на загрузку Speechpad .

Чтобы использовать в браузере Google Chrome, следует запустить страницу для голосового ввода, а затем в нижней части окна выбрать нужный язык . Затем следует разрешить использование микрофона, нажав соответствующий значок. Этот сервис позволяет преобразовывать в текст короткие фразы, которые можно при помощи сочетания клавиш Ctrl+C скопировать и перенести в нужный редактор.

VoiceNote 2

Сервис, который создан в компании Google. Соответственно, работает только в браузере Google Chrome, при этом обозреватель должен быть обновлен до последней версии.

Чтобы установить расширение Войснот можно или сделать следующее:



После установки рядом с адресной строкой браузера появится иконка приложения. Для дальнейшей работы необходимо кликнуть на значок. Когда откроется окно программы, нажать сбоку на значок микрофона.

Для расстановки знаков препинания читаем громко и четко.

Считается одним из лучших сервисов для преобразования голоса в текст. Может автоматически расставлять знаки препинания. Присутствует возможность редактирования , автосохранения отметок времени и тому подобное. при использовании не требует никакой платы. Позволяет напечатать текст в онлайн режиме и отправить его на печать.

Этот сервис может самостоятельно определять язык для диктовки, который настроен в браузере. Если его нужно изменить, внизу под областью текста следует выбрать в выпадающем списке меню другой параметр настройки. Для работы с требуется нажать кнопку Start Dictation и разрешить сайту использовать микрофон. После этого можно начинать диктовать.

В процессе диктовки можно использовать следующие голосовые команды : «Запятая», «Точка», «Вопросительный знак» и «Восклицательный знак», «Новый параграф» и «Новая строка».

После окончания диктовки следует нажать на кнопку Stop Listening . Для копирования текста используется «Copy», для его скачивания «Save», для удаления кнопка «Clear».

Для работы с сервисом просто заходим на сайт, выбираем нужный язык, нажимаем на кнопку Start Dictation и разрешаем использование микрофона. После этого можно начинать диктовку. При желании знаки пунктуации можно либо вставлять при помощи голоса, либо вручную, отключив сперва действующую функцию. Чтобы прекратить запись используется кнопка «Stop ». Для форматирования применяются инструменты, которые расположены на верхней панели.

Важно! Владельцам сайтов доступна возможность внедрить этот инструмент в функционал своего ресурса. Посетители смогут пользоваться голосовым поиском и таким же образом осуществлять ряд других действий, например, писать комментарии.

Код для вставки:

Https://ctrlq.org/code/19680-html5-web-speech-api?_ga=2.96371484.1866279676.1507092835-986784149.1507092834

Чтоб язык программы стал русским , в свойстве recognition.lang вместо ‘en-US’ нужно поставить ‘ru-RU’.

Сервис для преобразования речи в текст, обладающий удобным и простым функционалом. Для работы с сначала выбираем язык, нажав на значок флага. После этого кликаем на значок микрофона и начинаем диктовать.

Этот сервис от многих остальных отличается возможностью просмотра различных вариантов распознавания , а также наличием голосовых подсказок. Присутствует функция редактирования текста, которая позволяет копировать полученный результат, делать его распечатку, переводить на другие языки или пересылать на электронную почту. Чтобы начать работу с следует нажать на значок микрофона, который расположен с правой стороны. Это сервис хорош тем, что может одинаково работать в любых браузерах . Хорошо понимает многие языки, в том числе русский. Может ставить знаки пунктуации, исправлять некоторые ошибки. Обладает функцией перевода текста и его озвучиванием.

Важно! Когда нужный текст набран, обязательно следует нажать на кнопку со стрелкой, что позволит перенести готовый результат во второе поле. Именно оттуда материал либо копируют, либо отправляют на email.

После выбора всех нужных языковых настроек следует нажать на иконку микрофона и произнести фразу. Как только сервис распознает слова, в одном поле появится результат в текстовой форме, а в другом поле появится переведенный текст.

Основным отличием этого сервиса от Google переводчика является возможность голосового ввода не только в браузере Google Chrome, но и в любом другом.

Чтобы начать работу с этим сервисом требуется перейти по адресу translate.yandex.ru , выставить все необходимые языковые настройки, кликнуть на значок микрофона, и разрешить его использование.

Программы для набора текста голосом

— это программа голосового ввода текста на компьютере, которая для распознавания речи применяют Google Voice API. Она может выполнять определенные голосовые команды, а также передавать введенный текст в другие редакторы. Программа не требует за свое использование никакой оплаты.

Интерфейс программы обладает всего тремя кнопками : включить или остановить запись, а также открыть окно настроек. При работе с этой программой нужно просто нажать на кнопку записи, затем поставить курсор в окно текстового редактора и произнести фразу.

Voco

Для работы с Voco требуется сначала открыть текстовый редактор или любую другую подобную программу. В поле ввода требуется щелкнуть правой кнопкой мыши.

Затем необходимо два раза нажать на Ctrl, что позволит отобразить в нижней части экрана значок микрофона. Остается только начать диктовать текст.

Для расстановки знаков препинания или начала новой строки потребуется произнести стандартные в таких случаях команды. При распознавании аудиофайла будет происходить автоматическая расстановка знаков препинания.

В Windows 10 присутствует возможность набора текста голосом, однако эта функция доступна только для английского языка . По заверению компании-разработчика в будущем должна появиться возможность работы с другими языками.

Чтобы начать работу необходимо вызвать контекстное меню на панели задач Windows и отметить «Показывать кнопки сенсорной клавиатуры ». Эта клавиатура появится в системном трее, что позволит запустить ее в любой момент. Если переключить раскладку на английский язык, на клавиатуре отобразится значок микрофона. Нужно помнить, что аудиоввод возможен только при включенных речевых службах («Параметры» — «Конфиденциальность» — «Речь, рукописный ввод и ввод текста»). Если отображается кнопка отключения, значит службы включены. Чтобы начать диктовку, открываем любой текстовый редактор (или любое другое поле ввода) и начинаем произносить фразу в микрофон.

Расширение является продуктом компании Microsoft, созданное, чтобы облегчить ввод фраз в редакторе Word, Outlook и других. После его установки просто проговорите предложение, и оно тут же отобразится в окне редактора. Для работы потребуется качественный микрофон.

Важно! После того, как дополнение установлено, Microsoft Office потребует перезагрузки и дальнейшей активации расширения в настройках программы. Dictate станет отображаться в меню редактора в качестве отдельной вкладки.

Транскрибация в голосовом блокноте

Транскрибация – это процесс, при котором происходит обработка аудио или видео с дальнейшим преобразованием речи. Часто используется для расшифровки лекций, семинаров, курсов и так далее. Можно делать как вручную (прослушивать предложение и печатать каждое слово самостоятельно), так и с помощью специальных программ.

Первый способ

Первый способ набора текста с аудиозаписи подразумевает использование колонок и качественного микрофона. Суть заключается в том, что звук подается из колонок в микрофон, а программа, обрабатывая речь, сама записывает фразы.

Если работа будет осуществляться с видео файлом расположенном на сервисе Youtube, нужно скопировать URL адрес этого видео и вставить его в соответствующее поле. Затем необходимо нажать на кнопку «Обновить «.

Если файл располагается на компьютере, сначала выбираем тип файла. Затем нажать на кнопку «Выберите файл» и «Открыть», после чего «Включить запись».

Второй способ

При этом способе расшифровки видео потребуется наличие дополнительной программы. Она называется « ». Установка этой программы простая, достаточно лишь следовать подсказкам мастера установки. Затем виртуальный аудио кабель устанавливают в качестве устройства воспроизведения . Это позволит транслировать аудио или видео непосредственно в сам голосовой блокнот, благодаря чему нужда в использовании колонок и микрофона полностью отпадает.

Чтобы качество работы было лучше, можно воспользоваться несколькими советами:

  • во время записи нужно обеспечить в помещении максимальную тишину , иначе из-за посторонних шумов программа будет допускать ошибки при написании. Как вариант, можно выставить подходящие параметры в настройках микрофона (подавление шума);
  • длинные фразы лучше заменить короткими, а между словами требуется делать небольшие паузы ;
  • желательно потренироваться в произношении слов, чтобы речь была как можно более четкой и понятной. Также хорошо приобрести качественный микрофон.

Сейчас без компьютера просто нереально обойтись в современном мире. От вас не требуется быть мастером фотошопа или профессионально монтировать видео (если это не связано с работой, конечно). Но суметь набрать какой-нибудь текст – это необходимый минимум.

№2. Web Speech API


Онлайн-программа Web Speech API по функционалу абсолютно идентична предыдущим.

Этот сервис, как и перечисленные выше, также был создан компанией Google.

Главная страница выглядит так:


В простом интерфейсе сразу очевидно, что для начала записи необходимо выбрать язык, а после нажать на микрофон.

После того как вы нажмете на значок справа, система обязательно сделает запрос на доступ.


После того как вы «дадите добро», можно сразу приступать к работе. Набирайте текст голосом, а его печатная версия будет появляться в окошке.

После окончания работы текст можно скопировать туда, куда вам необходимо (опять же таки – ctrl+C, ctrl+V).

№3. Talktyper

Не менее простая программа – это Talktyper.

Для начала работы перейдите на сайт: https://talktyper.com/ru/index.html.


Для начала работы достаточно нажать на значок микрофона справа.

В отличие от описанных выше, данный наборщик текста можно открывать с помощью любого браузера. Хотя сайт создан в США, приложение легко распознает самые популярные языки мира, в том числе и русский.

Talktyper многофункциональный: он не только набирает текст, но и ставит знаки препинания, исправляет самостоятельно ошибки. Если какое-то начитанное вами слово система не может распознать, как правильное, то оно обязательно высветится.

Кроме того, Talktyper имеет функцию перевода, а также его озвучивания.

Обратите внимание! После того как вы закончите голосовой набор текста, обязательно нажмите на стрелочку, чтобы набранный документ был перенесен в другое поле. После этого его можно будет отправить по электронной почте или скопировать в нужный файл.

Возможные проблемы при работе с программами голосового набора

Когда вы начнете использовать эти программы, то обязательно задумаетесь, как же компьютер распознает наш голос, а после еще переводит в живой текст.

Схема распознавания речи устройством выглядит так:

Весь процесс можно разделить на 3 главных этапа:

    Акустический распознаватель.

    Важно говорить четко, громко, микрофон должен передавать голос без перебоев.

    Лингвистическая обработка.

    Чем больше в словаре программы есть слов, тем качественнее будет набранный текст. То есть, все вами сказанное будет опознаваться и передаваться в текстовом виде без искажения.

    Распознанный орфографический текст.

    Программа в автоматическом режиме выводит на экран орфографическую версию надиктованной речи, опираясь на паузы, четкость слов, найденные лексемы в словаре и т.д.

При работе с компьютерными наборщиками текста чаще всего возникает 2 проблемы:

  1. Акустический распознаватель «улавливает» вашу речь с перебоями.
  2. В словаре системы недостаточно слов, чтобы распознать всё, сказанное вами.

Чтобы решить первую проблему, необходимо четко и громко говорить. А вот для второй проблемы решения практически не существует, по крайней мере, бесплатного.

Версии программ распознавания речи, которые распространяются свободно, имеют очень скупой словарный запас.

Чтобы обеспечить программе обширный запас слов разработчикам требуется вложить немало денег, поэтому многие распознаватели демонстрируют низкий уровень перевода речи в текст.

Дальше всех в этом деле продвинулась компания Google, т.к. имеет достаточно средств для инвестиций. Эта компания, кроме прочего, создала самый большой онлайн-словарь, который помогает распознавать голос и переводить его в графическую версию.

Смотрите подробное руководство в этом ролике:

  1. Когда вы произносите речь, в комнате должно быть тихо. Звуки природы, музыка, плач ребенка воспринимаются системой, как шум. Из-за этого текст будет набран с большими ошибками.
  2. Не говорите, если что-то едите. Это не только скажется на качестве набора, но и опасно для жизни к тому же.
  3. Перед началом работы нужно подобрать правильную громкость вашего голоса, а также понять какая чувствительность у вашего микрофона.

    Для этого попробуйте записать несколько предложений привычным тоном. Если в записи будут перебои, обратитесь к настройкам микрофона.

  4. Делайте небольшие паузы между словами.
  5. Избегайте длинных фраз.

Кто-то скажет, что программа для голосового набора – это прекрасный помощник, который освободил им руки и облегчил жизнь в целом. Другие решат, что «овчинка выделки не стоит». Потому выбрать, стоить ли их использовать, вам предстоит самостоятельно.

А уж из каких сервисов выбирать, вы уже знаете…

Современные технологии не стоят на месте, и сегодня для набора текста уже не обязательно пользоваться стандартной клавиатурой. Голосовой ввод есть на большинстве устройств. Тем не менее далеко не все пользователи знают, как его правильно применять, и какую функцию он выполняет.

Для чего нужен ввод голосом

  • пользоваться поисковиками намного быстрее;
  • набирать сообщения в социальных сетях и популярных мессенджерах;
  • отвечать на СМС-сообщение, находясь за рулем;
  • быстро находить контакт в записной книжке телефона;
  • набирать текст в "Гугл-документах".

В браузере Google Chrome

Чтобы быстро набрать текст в режиме онлайн, достаточно выполнить несколько простых шагов:

  1. Включить микрофон.
  2. Открыть документ в браузере «Хром».
  3. Нажать «Инструменты» и выбрать «Голосовой ввод». Должна появиться иконка микрофона.
  4. Нажать на этот значок (он должен загореться красным цветом) и начать диктовку.
  5. Чтобы закончить ввод текста, достаточно еще раз кликнуть на иконку микрофона. Он должен стать серым.

Слова нужно произносить максимально четко, медленно и громко. Если использовать встроенный микрофон ноутбука, то система не поймет половину слов - и на выходе получится нечитаемый текст.

В некоторых ситуация может понадобиться надиктовать заметку докладчика для презентации. В этом случае необходимо:

  1. Убедиться, что микрофон хорошо работает.
  2. Открыть презентацию.
  3. Нажать «Инструменты» и выбрать «Продиктовать заметки…». После этого должен появиться значок микрофона.
  4. Нажать на его иконку и начать диктовку.
  5. Чтобы прекратить голосовой ввод, необходимо повторно нажать на значок микрофона.

При этом требуется хорошее подключение к интернету, иначе функция не активируется.

На телефоне

  1. Установить курсор таким образом, чтобы появилась стандартная клавиатура.
  2. Нажать на значок с микрофоном. Обычно он находится слева от клавиши пробела. Если иконки нет, то нужно зажать значок с изображением Земли (смена языка) и выбрать «Голосовой ввод Google».
  3. После этого на экране появится изображение микрофона и автоматически начнется запись текста.
  4. Когда диктовка будет завершена, достаточно подтвердить запись.

Подобным образом можно набирать СМС-сообщения, искать людей в записной книжке, пользоваться поисковиками, писать заметки и многое другое.

На Mac

Чтобы активировать интерактивный ввод текста, необходимо:

  1. Перейти в меню Apple (клавиша с изображением яблока).
  2. Нажать на «Системные настройки» и кликнуть на «Клавиатура». После этого необходимо активировать функцию «Диктовка».

В этом меню можно произвести следующие настройки:

  • активировать функцию улучшенной диктовки (работает в оффлайне);
  • выбрать язык и диалект;
  • указать используемый микрофон (встроенный или внешний);
  • задать наиболее удобную комбинацию клавиш, которая будет использоваться для быстрого начала и окончания записи.

Если в OS Mac установлена программа Siri, то активировать диктовку можно и через нее.

  1. Открыть документ или любое другое текстовое поле.
  2. Установить точку в том месте, откуда должен начать набираться текст.
  3. Нажать заданную ранее комбинацию клавиш (по умолчанию запись активируется при двойном клике на Fn). Также можно перейти во вкладку «Правка» и выбрать там «Начать диктовку».
  4. Произнести текст и сохранить его.
  5. Завершить диктовку нажатием на «Готово» или Fn.

Частые ошибки

Иногда функция не работает или выдает ошибки. Чаще всего пользователи сталкиваются со следующими проблемами:

  • «Вас плохо слышно». Если на экране появилась такая ошибка, то необходимо перейти в более тихое место, подключить другой микрофон или отрегулировать громкость устройства.
  • «Голосовые команды не работают». В этой ситуации необходимо говорить медленнее и громче. Между голосовыми командами рекомендуется делать паузы.
  • «Микрофон не работает». Если на экране всплывает такая ошибка, то нужно проверить, работает ли он на другом устройстве. Если микрофон исправен, необходимо проверить его настройки или перезагрузить компьютер или телефон.

Зная, как включить голосовой ввод, можно значительно упростить себе жизнь. Подобным образом пользователи могут набирать не только короткие текстовые сообщения, но и целые рассказы или инструкции. На планшетах эта функция активируется одним из описанных выше способов.



 

Пожалуйста, поделитесь этим материалом в социальных сетях, если он оказался полезен!