[{"data":1,"prerenderedAt":814},["ShallowReactive",2],{"blog-index-ru":3},[4,178,432,571],{"id":5,"title":6,"body":7,"category":147,"date":148,"description":149,"draft":150,"extension":151,"faq":152,"image":165,"meta":166,"navigation":167,"path":168,"seo":169,"stem":170,"tags":171,"translationKey":176,"updated":165,"__hash__":177},"blogRu\u002Fblog\u002Fkupit-golosovoy-vvod.md","Купить голосовой ввод: как выбрать тариф Speech Dock",{"type":8,"value":9,"toc":137},"minimark",[10,14,19,86,89,93,96,100,103,106,110,113,117,126,130],[11,12,13],"p",{},"Если вы уже пользуетесь бесплатным тарифом и упёрлись в лимит, или сравниваете варианты перед покупкой — вот честное сравнение без маркетингового тумана: что входит в каждый тариф и сколько это стоит.",[15,16,18],"h2",{"id":17},"тарифы-speech-dock","Тарифы Speech Dock",[20,21,22,38],"table",{},[23,24,25],"thead",{},[26,27,28,32,35],"tr",{},[29,30,31],"th",{},"Тариф",[29,33,34],{},"Цена",[29,36,37],{},"Что входит",[39,40,41,53,64,75],"tbody",{},[26,42,43,47,50],{},[44,45,46],"td",{},"Free",[44,48,49],{},"0 ₽, бессрочно",[44,51,52],{},"30 минут речи в месяц, до 5 минут за запись, флагманский STT-движок, 1 устройство",[26,54,55,58,61],{},[44,56,57],{},"Pro Monthly",[44,59,60],{},"400 ₽\u002Fмес",[44,62,63],{},"Безлимитная диктовка, транскрипция файлов, свой словарь терминов, шифрование истории, до 3 устройств",[26,65,66,69,72],{},[44,67,68],{},"Pro Yearly",[44,70,71],{},"3840 ₽\u002Fгод (−20% к Monthly)",[44,73,74],{},"Всё из Pro Monthly + приоритетная поддержка",[26,76,77,80,83],{},[44,78,79],{},"Lifetime",[44,81,82],{},"12 000 ₽, один раз",[44,84,85],{},"Всё из Pro Yearly + подключение своих моделей, до 5 устройств, все будущие обновления без доплат",[11,87,88],{},"Цены указаны для оплаты в России через ЮKassa с автоматическим чеком по 54-ФЗ.",[15,90,92],{"id":91},"когда-достаточно-free","Когда достаточно Free",[11,94,95],{},"Если диктуете время от времени — короткие заметки, комментарии к коду, ответы на письма — 30 минут в месяц может хватить надолго. Это не урезанная демоверсия: движок распознавания и LLM-обработка текста те же, что в платных тарифах, просто с лимитом по времени.",[15,97,99],{"id":98},"когда-переходить-на-pro","Когда переходить на Pro",[11,101,102],{},"Лимит Free становится тесным, если диктуете каждый день: рабочие созвоны, документацию, длинные письма. Pro снимает лимит по времени и добавляет то, что нужно для регулярной работы — транскрипцию готовых аудио- и видеофайлов, свой словарь терминов и имён (чтобы не поправлять одно и то же каждый раз), экспорт в PDF и Markdown.",[11,104,105],{},"Между Monthly и Yearly разницы в функциях нет — только в цене. Годовая оплата на 20% дешевле помесячной, поэтому если планируете пользоваться дольше пары месяцев, Yearly обычно выгоднее.",[15,107,109],{"id":108},"когда-есть-смысл-в-lifetime","Когда есть смысл в Lifetime",[11,111,112],{},"Разовый платёж 12 000 ₽ окупается примерно за 3 года по сравнению с Pro Yearly (12 000 ₽ ÷ 3840 ₽\u002Fгод ≈ 3,1 года при текущих ценах) — дальше вы платите ноль, включая все будущие обновления. Если голосовой ввод стал постоянным рабочим инструментом, а не разовым экспериментом, Lifetime — самый дешёвый вариант в пересчёте на годы.",[15,114,116],{"id":115},"если-тариф-не-подошёл","Если тариф не подошёл",[11,118,119,120,125],{},"Возврат работает в течение 14 календарных дней с момента оплаты, без объяснения причин и без ограничений по числу расшифровок — приложение локальное и не передаёт данные об использовании на сервер, поэтому считать «сколько вы уже наработали» технически нечем. Подробности — в ",[121,122,124],"a",{"href":123},"\u002Flegal\u002Foffer","договоре-оферте",".",[15,127,129],{"id":128},"итог","Итог",[11,131,132,133,125],{},"Free — чтобы попробовать и для нечастой диктовки. Pro Monthly — чтобы снять лимит без обязательств. Pro Yearly — та же диктовка дешевле, если пользуетесь регулярно. Lifetime — если голосовой ввод уже часть рабочего процесса надолго. ",[121,134,136],{"href":135},"\u002F#pricing","Сравните тарифы и выберите свой",{"title":138,"searchDepth":139,"depth":139,"links":140},"",2,[141,142,143,144,145,146],{"id":17,"depth":139,"text":18},{"id":91,"depth":139,"text":92},{"id":98,"depth":139,"text":99},{"id":108,"depth":139,"text":109},{"id":115,"depth":139,"text":116},{"id":128,"depth":139,"text":129},"Тарифы","2026-07-15","Сравниваем Free, Pro Monthly, Pro Yearly и Lifetime — сколько стоит голосовой ввод Speech Dock, чем отличаются тарифы и как выбрать подходящий под свои задачи.",false,"md",[153,156,159,162],{"question":154,"answer":155},"Можно ли пользоваться Speech Dock бесплатно?","Да, тариф Free даёт 30 минут речи в месяц (до 5 минут за одну запись) без ограничения по времени использования — это не пробный период, а постоянный бесплатный тариф.",{"question":157,"answer":158},"В чём разница между Pro Monthly и Pro Yearly?","Функции одинаковые. Годовая оплата даёт скидку 20% к месячной цене и добавляет приоритетную поддержку — разница только в стоимости и периоде оплаты.",{"question":160,"answer":161},"Что если тариф не подошёл?","Возврат в течение 14 календарных дней с момента оплаты без объяснения причин и без ограничений по числу выполненных расшифровок — приложение локальное и не передаёт данные об использовании, поэтому лимитов на возврат по факту использования нет.",{"question":163,"answer":164},"Стоит ли сразу брать Lifetime?","Если планируете пользоваться дольше 2-3 лет — да, разовый платёж окупается. Если не уверены, что задача постоянная, начните с Pro Monthly и переходите на Lifetime позже.",null,{},true,"\u002Fblog\u002Fkupit-golosovoy-vvod",{"title":6,"description":149},"blog\u002Fkupit-golosovoy-vvod",[172,173,174,175],"тарифы","голосовой ввод","диктовка","цена","buying-voice-input-software","YgEauRrlkFJ5i7XrSc_I0FUjOr6HpDU-BTx2Q5Z01iA",{"id":179,"title":180,"body":181,"category":405,"date":406,"description":407,"draft":150,"extension":151,"faq":408,"image":421,"meta":422,"navigation":167,"path":423,"seo":424,"stem":425,"tags":426,"translationKey":430,"updated":165,"__hash__":431},"blogRu\u002Fblog\u002Fspeech-dock-vs-whisper-cpp.md","Speech Dock или Whisper.cpp: готовое приложение против движка",{"type":8,"value":182,"toc":397},[183,186,189,193,202,205,209,216,219,303,306,310,313,337,340,344,366,369,373,376,380,383,386,389],[11,184,185],{},"Если вы искали локальное распознавание речи, то наверняка встречали Whisper.cpp. И, наверное, ловили себя на мысли: «зачем платить за приложение, если есть бесплатный движок?». Вопрос правильный, но в нём прячется подмена. Whisper.cpp и готовое приложение для диктовки живут в разных категориях. Спорить, что из них «лучше», это примерно как спорить, что лучше: двигатель или автомобиль.",[11,187,188],{},"Дальше без выдуманных цифр производительности. Разберём, что есть что, что придётся делать руками и как выбрать под свою задачу.",[15,190,192],{"id":191},"что-такое-whispercpp-и-для-чего-он","Что такое Whisper.cpp и для чего он",[11,194,195,201],{},[121,196,200],{"href":197,"rel":198},"https:\u002F\u002Fgithub.com\u002Fggml-org\u002Fwhisper.cpp",[199],"nofollow","Whisper.cpp"," это уважаемый open-source проект, эффективная реализация распознавания речи на C\u002FC++. Работает локально, без облака, и хорошо оптимизирована под обычное «железо». Отличная инженерная работа, и популярна она заслуженно.",[11,203,204],{},"Но это движок. Библиотека плюс инструмент командной строки, которые берут аудио и выдают текст. Одно дело Whisper.cpp делает прекрасно, распознаёт речь. Всё остальное, что превращает распознавание в удобную диктовку, лежит вне его зоны ответственности. И для движка это нормально, так и задумано.",[15,206,208],{"id":207},"движок-это-ещё-не-инструмент-диктовки","Движок это ещё не инструмент диктовки",[11,210,211],{},[212,213],"img",{"alt":214,"src":215},"Движок распознавания против готового приложения для диктовки: что входит в каждый вариант","\u002Fblog\u002Finfographics\u002Fengine-vs-app.ru.png",[11,217,218],{},"Когда вы диктуете в повседневной работе, распознавание это лишь один шаг из многих. Чтобы голос превратился в текст в нужном поле, должно сработать сразу несколько вещей:",[20,220,221,234],{},[23,222,223],{},[26,224,225,228,231],{},[29,226,227],{},"Что нужно для диктовки",[29,229,230],{},"Whisper.cpp (движок)",[29,232,233],{},"Speech Dock (приложение)",[39,235,236,247,256,267,276,285,294],{},[26,237,238,241,244],{},[44,239,240],{},"Захват звука с микрофона в реальном времени",[44,242,243],{},"Нужно реализовать самому",[44,245,246],{},"Готово из коробки",[26,248,249,252,254],{},[44,250,251],{},"Запуск\u002Fостановка записи горячей клавишей из любого приложения",[44,253,243],{},[44,255,246],{},[26,257,258,261,264],{},[44,259,260],{},"Распознавание речи",[44,262,263],{},"Делает движок",[44,265,266],{},"Локальное распознавание",[26,268,269,272,274],{},[44,270,271],{},"Оформление текста: пунктуация, читаемый вид",[44,273,243],{},[44,275,246],{},[26,277,278,281,283],{},[44,279,280],{},"Вставка результата в активное окно (редактор, мессенджер, браузер)",[44,282,243],{},[44,284,246],{},[26,286,287,290,292],{},[44,288,289],{},"История записей",[44,291,243],{},[44,293,246],{},[26,295,296,299,301],{},[44,297,298],{},"Управление языковыми данными и обновлениями",[44,300,243],{},[44,302,246],{},[11,304,305],{},"Движок закрывает один пункт из этой таблицы. Готовое приложение закрывает их все и связывает в единый процесс, о котором не нужно думать.",[15,307,309],{"id":308},"что-придётся-собирать-самому-на-движке","Что придётся собирать самому на движке",[11,311,312],{},"Собрать диктовку поверх Whisper.cpp реально, и как учебный проект это даже полезно. Но прикиньте объём.",[314,315,316,320,323,331,334],"ol",{},[317,318,319],"li",{},"Захват и потоковая подача аудио. Сам по себе движок микрофон в реальном времени не слушает, это нужно организовать.",[317,321,322],{},"Горячие клавиши и фоновый режим. Чтобы диктовать из любого приложения, нужен глобальный хоткей и сервис, висящий в фоне.",[317,324,325,326,330],{},"Вставка текста. Тут вылезают ",[121,327,329],{"href":328},"\u002Fblog\u002Fgolosovoy-vvod-linux","различия X11 и Wayland в Linux",": автовставка, буфер обмена, определение активного окна. Всё это придётся учесть самому.",[317,332,333],{},"Интерфейс и индикация. Окно настроек, индикатор записи, обратная связь пользователю.",[317,335,336],{},"Управление моделями и сборка под платформу. Скачивание языковых данных, сборка из исходников, поддержка обновлений.",[11,338,339],{},"Ничего невозможного. Но это уже разработка и сопровождение собственного инструмента, а не «поставил и пользуюсь».",[15,341,343],{"id":342},"что-даёт-готовое-приложение","Что даёт готовое приложение",[11,345,346,347,351,352,356,357,361,362,125],{},"Speech Dock берёт всю эту обвязку на себя. Вы ставите приложение для ",[121,348,350],{"href":349},"\u002Finstall\u002Flinux","Linux"," или ",[121,353,355],{"href":354},"\u002Finstall\u002Fmacos","macOS",", назначаете горячую клавишу и диктуете в любое окно. Распознавание идёт ",[121,358,360],{"href":359},"\u002Fblog\u002Foffline-raspoznavanie-rechi","локально, без облака",", так что голос не покидает устройство. Про приватность подробно рассказано на отдельной ",[121,363,365],{"href":364},"\u002Fprivacy","странице",[11,367,368],{},"В итоге у вас на руках не движок, который надо «довести», а готовый рабочий процесс: запись, оформление, вставка, история. Из коробки и с поправкой на особенности конкретной системы.",[15,370,372],{"id":371},"чего-мы-здесь-намеренно-не-сравниваем","Чего мы здесь намеренно не сравниваем",[11,374,375],{},"Скажу прямо: статья не утверждает, что один вариант «быстрее» или «точнее» другого. Любое такое сравнение зависит от конкретного железа, языка, настроек и сценария. Без воспроизводимых замеров на вашей машине оно превращается в маркетинговый шум. Я сравниваю не цифры, а категории инструментов и объём работы, который ляжет на вас.",[15,377,379],{"id":378},"когда-что-выбрать","Когда что выбрать",[11,381,382],{},"Движок (Whisper.cpp) стоит брать, если вы разработчик, строите собственный продукт или у вас нестандартный сценарий, где нужен полный контроль над каждым шагом. И вы готовы собрать и поддерживать обвязку своими руками.",[11,384,385],{},"Готовое приложение (Speech Dock) подойдёт, если удобная приватная диктовка нужна прямо сейчас, без сборки из исходников и ручной возни с оконными нюансами. И если хочется заниматься работой, а не инструментом.",[11,387,388],{},"Оба варианта уважают вашу приватность за счёт локальной обработки. Вся разница в том, сколько инженерной работы вы готовы взять на себя.",[11,390,391,392,396],{},"Так что вопрос не в том, кто кого «точнее». Вопрос в том, что вам ближе: конструктор, который ещё надо собрать и потом тянуть, или готовый инструмент, который просто работает. Whisper.cpp прекрасен ровно в своей роли движка, и под него имеет смысл садиться, когда хочется полного контроля и не жалко времени. Если же контроль не самоцель, а нужна диктовка здесь и сейчас, ",[121,393,395],{"href":394},"\u002Fdownload","скачайте Speech Dock"," и продиктуйте первую заметку прямо сегодня.",{"title":138,"searchDepth":139,"depth":139,"links":398},[399,400,401,402,403,404],{"id":191,"depth":139,"text":192},{"id":207,"depth":139,"text":208},{"id":308,"depth":139,"text":309},{"id":342,"depth":139,"text":343},{"id":371,"depth":139,"text":372},{"id":378,"depth":139,"text":379},"Сравнение","2026-06-15","Чем готовое приложение для диктовки отличается от низкоуровневого движка вроде Whisper.cpp, что придётся собирать самому и как выбрать подходящий вариант под свою задачу.",[409,412,415,418],{"question":410,"answer":411},"Speech Dock — это надстройка над Whisper.cpp?","Нет, это разные категории инструментов. Whisper.cpp — низкоуровневый движок распознавания, который разработчик встраивает в своё решение. Speech Dock — готовое настольное приложение для диктовки с собственным интерфейсом, горячими клавишами, вставкой текста и историей.",{"question":413,"answer":414},"Можно ли на Whisper.cpp собрать диктовку самому?","Да, и многие так делают. Но движок распознаёт аудио — а для повседневной диктовки вокруг него нужно самому собрать захват микрофона, горячие клавиши, вставку текста в активное окно, управление языковыми данными и интерфейс. Это посильно, но это проект, а не установка приложения.",{"question":416,"answer":417},"Что выбрать, если я не программист?","Если нужна диктовка «здесь и сейчас» без сборки и настройки из исходников — берите готовое приложение. Движок имеет смысл, когда вы строите собственный продукт или у вас нестандартный сценарий, требующий полного контроля.",{"question":419,"answer":420},"Оба варианта работают офлайн?","Да, локальное распознавание речи возможно в обоих случаях. Разница не в том, «облако или устройство», а в том, сколько работы по превращению движка в удобный инструмент ложится на вас.","\u002Fog\u002Fblog\u002Fspeech-dock-vs-whisper-cpp.png",{},"\u002Fblog\u002Fspeech-dock-vs-whisper-cpp",{"title":180,"description":407},"blog\u002Fspeech-dock-vs-whisper-cpp",[200,427,428,429,174],"распознавание речи","сравнение","офлайн","speech-dock-vs-whisper-cpp","6igjJdvpYqhHsW6NggZZvrvqvkzCECUudKw1fjTqaJY",{"id":433,"title":434,"body":435,"category":548,"date":406,"description":549,"draft":150,"extension":151,"faq":550,"image":563,"meta":564,"navigation":167,"path":359,"seo":565,"stem":566,"tags":567,"translationKey":569,"updated":165,"__hash__":570},"blogRu\u002Fblog\u002Foffline-raspoznavanie-rechi.md","Офлайн-распознавание речи: что работает локально и где границы",{"type":8,"value":436,"toc":541},[437,440,443,447,450,453,464,468,474,477,480,483,486,490,493,496,500,503,524,534,538],[11,438,439],{},"Когда вы диктуете заметку телефону или нажимаете «голосовой ввод» в браузере, происходит то, о чём редко задумываются. Ваш голос уезжает на чужой сервер, там превращается в текст и возвращается обратно. Удобно. Ровно до того момента, пока вы не оказались без сети, в контуре со строгими требованиями к данным или просто не задумались, где теперь лежит запись вашего голоса и кто к ней имеет доступ.",[11,441,442],{},"Офлайн-распознавание речи устроено иначе. Весь путь от микрофона до готового текста проходит прямо на вашем компьютере. Дальше разберём, что это значит на практике и где проходит настоящая граница «локального», потому что эта граница часто не там, где её рисует маркетинг.",[15,444,446],{"id":445},"что-значит-офлайн-на-самом-деле","Что значит «офлайн» на самом деле",[11,448,449],{},"«Офлайн» это не про то, что приложение разучилось обновляться. Это про то, где обрабатывается ваш голос.",[11,451,452],{},"Сравните два пути. В облачном варианте звук с микрофона уходит на сервер сервиса, распознаётся там и возвращается к вам текстом. Без сети ничего не работает, и вы не контролируете, что происходит с записью на той стороне. В локальном варианте распознавание идёт прямо на устройстве, текст готов сразу, а сеть для самой диктовки не нужна вообще.",[11,454,455,456,459,460,125],{},"Отсюда вытекает главное: приватность получается по умолчанию. Не потому что кто-то пообещал «не хранить ваши данные», а потому что отправлять их попросту некуда. Как это устроено в Speech Dock, мы подробнее пишем на страницах ",[121,457,458],{"href":364},"приватности"," и ",[121,461,463],{"href":462},"\u002Fsecurity","безопасности",[15,465,467],{"id":466},"где-проходит-граница-локальной-обработки","Где проходит граница локальной обработки",[11,469,470],{},[212,471],{"alt":472,"src":473},"Что остаётся на устройстве, а что требует сети: локальная обработка против облака","\u002Fblog\u002Finfographics\u002Fcloud-vs-local.ru.png",[11,475,476],{},"Честный ответ: не всё в приложении обязано работать офлайн, и это нормально. Вопрос только в том, что именно остаётся на устройстве, а что иногда требует сети.",[11,478,479],{},"Всегда локально остаётся всё, что касается вашего голоса и текста. Это захват звука с микрофона, само преобразование речи в текст, дальнейшая обработка готового текста (расстановка знаков препинания, оформление) и история ваших записей. Ничего из этого не уходит наружу.",[11,481,482],{},"Сети может потребовать то, что с содержимым ваших записей никак не связано: первая установка приложения и загрузка языковых данных, проверка обновлений, активация платной лицензии.",[11,484,485],{},"Граница, как видите, проходит ровно по содержимому. Скачать приложение через интернет: разовая история, один раз поставили и забыли. А ваш голос и расшифровки после установки никуда не уезжают: диктовать можно полностью без сети.",[15,487,489],{"id":488},"что-обычные-сервисы-делают-с-записью","Что обычные сервисы делают с записью",[11,491,492],{},"Для облачного сервиса ваш голос это входные данные для чужой инфраструктуры. И даже когда сервис добросовестный, остаётся несколько вопросов, на которые у вас нет гарантированного ответа. Сколько времени хранится запись и её расшифровка? Используют ли ваш голос, чтобы обучать чужие системы? Кто имеет доступ к данным и в какой юрисдикции стоят серверы?",[11,494,495],{},"Локальная обработка снимает эти вопросы разом. Данные не покидают устройство, поэтому и отвечать не на что. Для личных заметок это просто приятно. А для рабочих документов, переписки с клиентами или любой чувствительной информации это нередко жёсткое требование, без которого инструмент вообще нельзя пускать в работу.",[15,497,499],{"id":498},"как-выбрать-офлайн-решение-на-что-смотреть","Как выбрать офлайн-решение: на что смотреть",[11,501,502],{},"Не всякое приложение, которое называет себя «локальным», и правда держит ваш голос у вас. Слово в описании ничего не стоит, поэтому проще проверить руками. Вот на что я бы смотрел.",[314,504,505,508,511,518,521],{},[317,506,507],{},"Работает ли диктовка без сети. Самая честная проверка: отключите интернет и попробуйте надиктовать текст. Распознавание продолжает работать, значит, обработка действительно идёт на устройстве.",[317,509,510],{},"Куда вставляется текст. Хорошее настольное решение отправляет распознанный текст прямо в активное окно (редактор, мессенджер, браузер), а не заставляет копировать его вручную из своего окошка.",[317,512,513,514,459,516,125],{},"Поддержка вашей платформы. Проверьте, что приложение работает в вашей системе нативно, а не через прослойку. Speech Dock, например, сделан под ",[121,515,350],{"href":349},[121,517,355],{"href":354},[317,519,520],{},"Что происходит с историей. Стоит уточнить, хранится ли история записей на устройстве и можете ли вы её удалить, когда захотите.",[317,522,523],{},"Прозрачность по сети. Ходить в сеть за обновлениями и активацией приложению нормально. А вот отправлять туда ваш звук нет. Эти две вещи важно различать, их часто специально смешивают.",[11,525,526,527,530,531,125],{},"Если вам важен именно настольный сценарий на Linux с его зоопарком оконных систем, есть отдельный разбор: ",[121,528,529],{"href":328},"голосовой ввод в Linux: X11, Wayland и рабочий процесс",". А если вы выбираете между готовым приложением и сборкой собственного решения на низкоуровневом движке, об этом есть статья ",[121,532,533],{"href":423},"Speech Dock или Whisper.cpp",[15,535,537],{"id":536},"коротко","Коротко",[11,539,540],{},"Так что «офлайн» здесь не красивое слово на лендинге, а вполне проверяемая вещь: отключите сеть, надиктуйте абзац, и либо работает, либо нет. Если приватность для вас не приятный бонус, а условие, при котором инструментом вообще можно пользоваться, локальная обработка и есть самый прямой способ её получить. Остальное (обновления, лицензия) пусть себе ходит в сеть, к вашему голосу это отношения не имеет.",{"title":138,"searchDepth":139,"depth":139,"links":542},[543,544,545,546,547],{"id":445,"depth":139,"text":446},{"id":466,"depth":139,"text":467},{"id":488,"depth":139,"text":489},{"id":498,"depth":139,"text":499},{"id":536,"depth":139,"text":537},"Основы","Что такое офлайн speech-to-text, какие задачи распознавание речи решает прямо на устройстве без интернета и где проходит реальная граница локальной обработки.",[551,554,557,560],{"question":552,"answer":553},"Офлайн-распознавание речи работает без интернета полностью?","Да. Само преобразование голоса в текст происходит на вашем устройстве, поэтому диктовать можно в самолёте, в дороге или в защищённом контуре без сети. Интернет нужен один раз — чтобы скачать приложение и языковые данные.",{"question":555,"answer":556},"Чем офлайн-распознавание отличается от голосового ввода в браузере или телефоне?","Встроенный голосовой ввод обычно отправляет звук на серверы сервиса и там превращает его в текст. При локальной обработке запись не покидает устройство — это другой подход к приватности, а не просто другая кнопка.",{"question":558,"answer":559},"Локальное распознавание заметно хуже по качеству?","Современные локальные решения справляются с диктовкой, заметками и сообщениями на повседневном языке. Разница чаще не в «облако против устройства», а в том, насколько приложение настроено под вашу речь, язык и сценарий.",{"question":561,"answer":562},"Что именно остаётся на устройстве?","Звук с микрофона, промежуточный и итоговый текст, история ваших записей. Ничего из этого не нужно отправлять на внешний сервер, чтобы получить результат.","\u002Fog\u002Fblog\u002Foffline-raspoznavanie-rechi.png",{},{"title":434,"description":549},"blog\u002Foffline-raspoznavanie-rechi",[429,427,568,173],"приватность","offline-speech-recognition","0CfvsfYp6Ti_8680ccmkl6USj5A1lR286-dqnoDl3jM",{"id":572,"title":573,"body":574,"category":350,"date":406,"description":791,"draft":150,"extension":151,"faq":792,"image":805,"meta":806,"navigation":167,"path":328,"seo":807,"stem":808,"tags":809,"translationKey":812,"updated":165,"__hash__":813},"blogRu\u002Fblog\u002Fgolosovoy-vvod-linux.md","Голосовой ввод в Linux: X11, Wayland и рабочий процесс",{"type":8,"value":575,"toc":782},[576,579,582,586,589,592,595,601,605,611,614,617,620,624,627,630,650,687,696,699,702,706,709,712,715,719,722,736,739,743,767,769,775,778],[11,577,578],{},"С распознаванием речи в Linux выходит забавный парадокс. Сам движок распознавания давно не проблема, локальные решения работают отлично. А вот «просто продиктовать текст в любое окно» оказывается неожиданно муторной задачей. И дело не в качестве распознавания, а в том, как вообще устроен рабочий стол Linux.",[11,580,581],{},"Разберёмся, почему так, чем для диктовки отличаются X11 и Wayland и как выстроить процесс, который реально экономит время.",[15,583,585],{"id":584},"почему-голосовой-ввод-в-linux-это-отдельная-история","Почему голосовой ввод в Linux это отдельная история",[11,587,588],{},"В Windows и macOS вставить текст в активное приложение можно через единый системный API, вопрос давно закрыт. В Linux рабочий стол фрагментирован. Тут две оконные системы (старый X11 и новый Wayland), несколько окружений (GNOME, KDE, Sway, Hyprland и другие), и каждое решает «эмуляцию ввода» по-своему.",[11,590,591],{},"Для голосового ввода это значит, что задача распадается на две независимые части.",[11,593,594],{},"Первая часть, распознать речь, превратить голос в текст. Она локальна и от оконной системы не зависит. Вторая, доставить готовый текст в нужное окно, вставить его туда, где стоит курсор. Вот тут и начинаются различия между X11 и Wayland.",[11,596,597,598,600],{},"Первая часть в Speech Dock полностью ",[121,599,429],{"href":359},", голос не покидает устройство. А вот вторая зависит от вашего окружения, и её стоит понимать.",[15,602,604],{"id":603},"x11-и-wayland-в-чём-разница-для-диктовки","X11 и Wayland: в чём разница для диктовки",[11,606,607],{},[212,608],{"alt":609,"src":610},"Сравнение X11 и Wayland для голосового ввода в Linux: захват активного окна, автовставка текста, горячая клавиша","\u002Fblog\u002Finfographics\u002Fx11-vs-wayland.ru.png",[11,612,613],{},"X11 это старая, но всё ещё распространённая оконная система. Устроена она либерально: одно приложение спокойно «нажимает клавиши» за пользователя и видит, какое окно сейчас активно. Для голосового ввода это подарок. Автовставка текста и определение активного окна работают без всяких дополнительных настроек.",[11,615,616],{},"Wayland это современная замена X11, спроектированная с упором на безопасность и изоляцию приложений. Ровно эти принципы и усложняют автовставку. По умолчанию приложение не может просто так эмулировать клавиатуру в чужом окне или подсмотреть, какое окно активно. Это не баг, а сознательное архитектурное решение: окно не должно знать, что творится у соседа.",[11,618,619],{},"Поэтому на Wayland часть удобных мелочей придётся настроить руками, об этом ниже. Зато взамен вы получаете куда более строгую модель безопасности всего рабочего стола.",[15,621,623],{"id":622},"автовставка-текста-как-это-работает","Автовставка текста: как это работает",[11,625,626],{},"Автовставка это когда распознанный текст сразу появляется там, где стоит курсор, без ручного Ctrl+V. Как именно это сделано, зависит от оконной системы.",[11,628,629],{},"На X11 всё работает сразу после установки. Надиктовали, текст возник в активном поле, конец истории.",[11,631,632,633,641,642,645,646,649],{},"На Wayland понадобится системный сервис ",[121,634,637],{"href":635,"rel":636},"https:\u002F\u002Fgithub.com\u002FReimuNotMoe\u002Fydotool",[199],[638,639,640],"code",{},"ydotool"," с запущенным демоном ",[638,643,644],{},"ydotoold",". Он даёт приложению канал для эмуляции ввода через ",[638,647,648],{},"\u002Fdev\u002Fuinput",". Настройка разовая, один раз и забыли:",[651,652,656],"pre",{"className":653,"code":654,"language":655,"meta":138,"style":138},"language-bash shiki shiki-themes github-light github-dark","# включить и запустить демон автовставки\nsystemctl --user enable --now ydotoold\n","bash",[638,657,658,667],{"__ignoreMap":138},[659,660,663],"span",{"class":661,"line":662},"line",1,[659,664,666],{"class":665},"sJ8bj","# включить и запустить демон автовставки\n",[659,668,669,673,677,681,684],{"class":661,"line":139},[659,670,672],{"class":671},"sScJk","systemctl",[659,674,676],{"class":675},"sj4cs"," --user",[659,678,680],{"class":679},"sZZnC"," enable",[659,682,683],{"class":675}," --now",[659,685,686],{"class":679}," ydotoold\n",[11,688,689,690,692,693,125],{},"Вдобавок у пользователя должен быть доступ к ",[638,691,648],{},". Обычно его дают добавлением в группу ",[638,694,695],{},"input",[11,697,698],{},"А если демон не настроен? Ничего страшного не происходит. Распознанный текст автоматически уходит в буфер обмена, и вы вставляете его вручную привычным сочетанием клавиш. Диктовка работает в любом случае, автоматизируется только самый последний шаг.",[11,700,701],{},"Есть и ещё один нюанс Wayland: в нём нет открытого способа узнать, какое окно сейчас активно. Так что перед диктовкой достаточно один раз убедиться, что нужное приложение в фокусе, и дальше текст пойдёт именно туда.",[15,703,705],{"id":704},"экранная-индикация-записи","Экранная индикация записи",[11,707,708],{},"Когда диктуешь, полезно видеть, что запись правда идёт. Speech Dock показывает компактную плашку-индикатор. Её поведение, как вы уже догадались, тоже зависит от окружения.",[11,710,711],{},"В Sway, Hyprland и свежих версиях KDE Plasma это полноценная плавающая индикация поверх окон. А вот GNOME не реализует нужный оконный протокол, поэтому там плашка упрощается. На саму диктовку и вставку текста это никак не влияет, страдает только красота.",[11,713,714],{},"Хороший пример того, как одна и та же функция ведёт себя на разных рабочих столах Linux совершенно по-разному. И заодно объяснение, почему готовое приложение, которое все эти различия уже разрулило, экономит вам кучу времени.",[15,716,718],{"id":717},"практический-рабочий-процесс","Практический рабочий процесс",[11,720,721],{},"Вот как выглядит удобная диктовка в повседневной работе:",[314,723,724,727,730,733],{},[317,725,726],{},"Назначаете глобальную горячую клавишу, которая запускает и останавливает запись из любого приложения. Переключаться в отдельное окно не нужно.",[317,728,729],{},"Ставите курсор туда, куда хотите вставить текст. На Wayland заодно убеждаетесь, что нужное окно в фокусе.",[317,731,732],{},"Диктуете. Говорите естественно, приложение распознаёт речь локально и само оформляет текст.",[317,734,735],{},"Текст оказывается на месте. На X11 и на настроенном Wayland он вставляется сам, иначе уже ждёт вас в буфере обмена.",[11,737,738],{},"Этот процесс одинаково хорош и для быстрого сообщения в мессенджере, и для длинной заметки или черновика письма. Разница только в том, сколько вы наговорили.",[15,740,742],{"id":741},"что-проверить-перед-стартом","Что проверить перед стартом",[744,745,746,753,756,764],"ul",{},[317,747,748,749,752],{},"Стоит ли актуальная сборка для вашей системы. Пошаговая ",[121,750,751],{"href":349},"инструкция по установке на Linux"," покрывает .deb, AppImage и популярные дистрибутивы.",[317,754,755],{},"Какая у вас оконная система, X11 или Wayland. Это влияет только на автовставку, не на распознавание.",[317,757,758,759,761,762,125],{},"Если хотите автоматическую вставку на Wayland: настроен ли ",[638,760,644],{}," и есть ли доступ к ",[638,763,648],{},[317,765,766],{},"Назначена ли удобная горячая клавиша для старта и остановки записи.",[15,768,537],{"id":536},[11,770,771,772,774],{},"Вся хитрость голосового ввода в Linux в том, что речь распознаётся одинаково везде, а вот текст до нужного окна доходит по-разному. На X11 он вставляется сам, без единой настройки. На Wayland разок придётся подружить систему с ",[638,773,640],{},", а если поленитесь, текст всё равно не пропадёт, он будет ждать в буфере обмена.",[11,776,777],{},"Так что страшилки про «голосовой ввод на Linux не работает» можно смело пропускать. Работает. Просто стоит один раз понять, на какой оконной системе вы сидите, и подкрутить под неё пару мелочей. Дальше уже диктуете и не думаете.",[779,780,781],"style",{},"html pre.shiki code .sJ8bj, html code.shiki .sJ8bj{--shiki-default:#6A737D;--shiki-dark:#6A737D}html pre.shiki code .sScJk, html code.shiki .sScJk{--shiki-default:#6F42C1;--shiki-dark:#B392F0}html pre.shiki code .sj4cs, html code.shiki .sj4cs{--shiki-default:#005CC5;--shiki-dark:#79B8FF}html pre.shiki code .sZZnC, html code.shiki .sZZnC{--shiki-default:#032F62;--shiki-dark:#9ECBFF}html .default .shiki span {color: var(--shiki-default);background: var(--shiki-default-bg);font-style: var(--shiki-default-font-style);font-weight: var(--shiki-default-font-weight);text-decoration: var(--shiki-default-text-decoration);}html .shiki span {color: var(--shiki-default);background: var(--shiki-default-bg);font-style: var(--shiki-default-font-style);font-weight: var(--shiki-default-font-weight);text-decoration: var(--shiki-default-text-decoration);}html .dark .shiki span {color: var(--shiki-dark);background: var(--shiki-dark-bg);font-style: var(--shiki-dark-font-style);font-weight: var(--shiki-dark-font-weight);text-decoration: var(--shiki-dark-text-decoration);}html.dark .shiki span {color: var(--shiki-dark);background: var(--shiki-dark-bg);font-style: var(--shiki-dark-font-style);font-weight: var(--shiki-dark-font-weight);text-decoration: var(--shiki-dark-text-decoration);}",{"title":138,"searchDepth":139,"depth":139,"links":783},[784,785,786,787,788,789,790],{"id":584,"depth":139,"text":585},{"id":603,"depth":139,"text":604},{"id":622,"depth":139,"text":623},{"id":704,"depth":139,"text":705},{"id":717,"depth":139,"text":718},{"id":741,"depth":139,"text":742},{"id":536,"depth":139,"text":537},"Почему голосовой ввод в Linux устроен сложнее, чем кажется: чем отличаются X11 и Wayland для диктовки, как работает автовставка текста и как выстроить удобный desktop-процесс.",[793,796,799,802],{"question":794,"answer":795},"Голосовой ввод в Linux работает и на X11, и на Wayland?","Да. Само распознавание речи не зависит от оконной системы. Различия начинаются на этапе вставки готового текста в активное окно: на X11 это работает «из коробки», на Wayland иногда нужен дополнительный системный компонент.",{"question":797,"answer":798},"Почему на Wayland текст не вставляется автоматически?","Wayland из соображений безопасности ограничивает программную эмуляцию ввода. Чтобы приложение могло само вставлять текст в другое окно, нужен сервис ydotool с запущенным демоном ydotoold и доступом к \u002Fdev\u002Fuinput. Без него текст всё равно попадает в буфер обмена — его можно вставить вручную.",{"question":800,"answer":801},"Нужно ли быть в группе input?","Для автовставки на Wayland через ydotool пользователь должен иметь доступ к \u002Fdev\u002Fuinput — обычно это решается добавлением в группу input. Это разовая настройка.",{"question":803,"answer":804},"Какие окружения рабочего стола поддерживают всё полностью?","Полноценная экранная индикация записи работает в Sway, Hyprland и KDE Plasma свежих версий. В GNOME часть оконных возможностей ограничена самим окружением, поэтому индикация упрощается, но диктовка и вставка текста работают.","\u002Fog\u002Fblog\u002Fgolosovoy-vvod-linux.png",{},{"title":573,"description":791},"blog\u002Fgolosovoy-vvod-linux",[350,810,811,173,174],"Wayland","X11","linux-voice-input","Z2b_R3lvT5Og1Iz74c2aHSUy4kWJ4iKTthadVjMhOTA",1786958666374]