Новый инструмент диктовки Myna с ИИ в Ubuntu официально ещё не готов, но его можно протестировать досрочно.
Canonical недавно добавила в Snap Store snap-пакет оркестратора Myna и пару ИИ-моделей распознавания речи, а новый настольный инструмент Myna Settings стал доступен для тестирования из PPA.
Ubuntu 26.10 также поставляется с ещё одним компонентом: пакет gnome-shell-ubuntu-extensions содержит расширение GNOME Shell, которое включает экранный HUD, когда локальная технология распознавания речи Myna слушает или расшифровывает.
Формального приглашения к тестированию не было, но все компоненты для проверки Myna доступны, если есть желание их собрать.
Если это кому-то интересно, далее инструкция. Но не стоит ждать, что всё будет работать идеально.
Как попробовать Myna в Ubuntu

Myna можно установить на Ubuntu 26.04 LTS или 26.10, но Myna Shell (запускающая экранный HUD) собрана только для GNOME 51 и 26.10 (вместо этого для передачи активности используются уведомления).
Экранный HUD появляется только тогда, когда клавиша активации запускает Myna и она слушает или расшифровывает. Компонент значительно переработали по сравнению с версией, которую мы показывали в августе. Теперь он запускает процесс myna.hud, а не рисует HUD на экране сам.
Для HUD доступны 4 визуальных стиля: default (простая полоса с акцентным цветом системы); vumeter (что-то вроде индикатора громкости), ribbon (но, увы, такой же анимированный, как оригинал) и bar (то же, что default, но, по результатам теста, без желоба).
Чтобы протестировать, нужны следующие вещи
-
myna-configнастольное приложение из PPA -
mynasnap из Snap Store -
myna-*ИИ-модель из Snap Store
Если установлена Ubuntu 26.10:
- расширение Myna Shell (оно предустановлено)
Вот как установить каждый компонент по очереди.

Чтобы установить приложение Myna Settings, нужно добавить следующий PPA (его поддерживает инженер Canonical, работающий над Myna), который предоставляет пакеты для Ubuntu 26.04 LTS и 26.10:
sudo add-apt-repository ppa:charles05/myna-config
sudo apt install myna-config
Нужно включить экспериментальную функцию snap, которая требуется Myna перед установкой:
sudo snap set system experimental.user-daemons=true
Нужно установить клиент распознавания речи Myna из Snap Store:
sudo snap install myna --edge
Наконец, нужно установить “мозги” всей схемы: ИИ-модель для преобразования аудио в текст.
Если открыть мастер настройки Myna Settings (myna-confg) сейчас, он предложит модель, подходящую для оборудования. Но если нажать кнопку “install”, появится ошибка (она указывает на стабильные версии), поэтому модель придётся устанавливать вручную.
Whisper и Parakeet, две локальные ИИ-модели, уже есть в Snap Store, а Funasr должна присоединиться к ним в ближайшее время. Модели работают полностью локально, на устройстве, но они не маленькие. Понадобится 1-2 ГБ свободного места на диске, в зависимости от выбранной модели.
Нужно установить Parakeet, быструю ASR-модель NVIDIA с открытыми весами, поддерживающую 25 языков и пунктуацию:
sudo snap install myna-parakeet --edge
Или установить Whisper, многоязычную open-source модель OpenAI:
sudo snap install myna-whisper
Теперь можно открыть Myna Settings, и она должна пропустить шаги настройки и показать настройки.
Советуем протестировать Myna перед тем, как копаться в настройках. Нужно задать горячую клавишу в приложении конфигурации, затем перевести фокус в текстовое поле (обычно используется Text Editor) и нажать её.
При активации появится HUD (26.10) или уведомление (26.04). Нужно начать говорить, и если Myna скажет “listening”, продолжать говорить, пока не закончите, затем снова нажать ту же горячую клавишу. Модель расшифрует произнесённые слова в текст, и они появятся в приложении, которое находится в фокусе.
Мы попробовали и Parakeet, и Whisper. Первая была точнее (даже правильно написала фамилию автора теста, что многие делают не всегда), а Whisper работал быстрее. Опции в приложении myna-config позволяют менять модели (меньшие или большие варианты).
Хороша ли Myna?
Myna, безусловно, повышает доступность Ubuntu, но говорить о том, станет ли она популярным основным способом ввода, пока рано. Инструменты преобразования речи в текст не новы, они просто стали точнее, чем раньше. Myna требует нажатия клавиши, поэтому “слушает” только тогда, когда это нужно.
Её нельзя активировать фразой “hey myna”, по крайней мере пока.
Диктовка по горячей клавише сделана намеренно, поэтому она лучше подходит для ввода длинных текстов, чем для команды “firefox” в App Picker. Одна раздражающая особенность: Myna легко теряет фокус (открывается другое приложение, нажимается кнопка или уводится мышь), и вся речь пропадает.
К тому же придётся тратить время на вычитку написанной речи, борьбу с ошибками “too noisy” и другими странностями. Не случайно большинство пользователей до сих пор печатает сообщения, даже на телефонах, где давно есть диктовка на основе ML.
Тем не менее это лучше того, что было раньше. Myna может быть не такой “умной”, как функции голосового ввода, которые Google предлагает на новых ноутбуках Googlebook, но она локальная, работает офлайн и полностью под контролем пользователя.






Пока нет комментариев. Будьте первым!