VSTT

Диктовка для macOS

Голос в текст, целиком на вашем Mac.

Зажмите клавишу, говорите, отпустите — готовый текст встанет туда, где стоит курсор. Распознавание идёт на самом компьютере: звук никуда не отправляется. Ни аккаунта, ни подписки, ни облака.

Требуется macOS 26 или новее.

Иконка VSTT: графитовая плитка с белой звуковой волной и текстовым курсором

Почему так

Четыре причины, а не список галочек

Офлайн

Всё считается локально

Речь распознаётся на вашем процессоре. Интернет нужен ровно один раз — скачать модель.

Приватность

Ничего не уходит наружу

Ни звука, ни расшифровок. Нет сервера, нет аккаунта, нечего утекать.

Железо

Intel тоже подходит

Metal там, где он есть; процессор там, где его нет. Apple Silicon не обязателен.

Цена

Бесплатно

Некоммерческий проект. Без подписок, тарифов и лимитов на минуты.

Как это работает

Четыре шага — и все внутри одного нажатия

Порядок один и тот же в любом приложении: почта, редактор кода, мессенджер, поле поиска.

Зажмите клавишу

По умолчанию правый ⌥. В настройках можно выбрать fn или правый ⌘.

Говорите

Текст идёт сразу

Модель потоковая: слова появляются в плавающей капсуле, пока вы ещё говорите.

Отпустите

Запись закончена

Отпустили клавишу — запись остановилась, расшифровка дописана до конца.

Текст на месте

Очищенный текст вставляется в активное поле. Копия остаётся в истории.

Движок

Nemotron 3.5 ASR Streaming, 0,6 млрд параметров

Модель запускается локально через transcribe.cpp поверх ggml. Metal, если он доступен, иначе — CPU. Именно поэтому приложение работает и на Intel-маках.

Модель
Nemotron 3.5 ASR Streaming 0.6B, ~716 МБ Скачивается из приложения по требованию и проверяется по опубликованному SHA256.
Языки
40 локалей Русский и английский — в верхнем ярусе, готовом к транскрипции.
Второй движок
Apple SpeechAnalyzer — требует Apple Silicon На Intel-маках macOS сообщает, что он недоступен для всех языков. Приложение так и пишет, а не молча ломается.
Лицензии
ggml — MIT, веса модели — OpenMDW-1.1

ИЗМЕРЕНО НА INTEL MAC 4,3 с речи → 1,3 с расшифровки ≈3,3× быстрее реального времени

В приложении

То, чем диктовка отличается от расшифровки

Свой словарь

Имена и жаргон, которые движок упорно слышит не так

Два вида правил: замены — «слышу X, пиши Y» — и термины, которые смещают само распознавание в нужную сторону.

Очистка

Без слов-паразитов и кривых пробелов

Детерминированный проход убирает мусорные слова и чинит пробелы с пунктуацией. По желанию — более умный проход локальной моделью Apple Intelligence, если Mac её поддерживает.

История

Всё сказанное остаётся под рукой

Список прошлых расшифровок с поиском; любую можно скопировать одним нажатием.

Интерфейс

Русский и английский

Язык интерфейса переключается в настройках и применяется сразу, без перезапуска.

Требования

Что нужно, чтобы запустить

Система
macOS 26 или новее
Процессор
Apple Silicon или Intel Nemotron работает на обоих. Apple SpeechAnalyzer — только на Apple Silicon.
Место на диске
~716 МБ под модель, плюс само приложение (5,4 МБ)
Сеть
Только для первой загрузки модели Дальше приложение работает без интернета.
Умная очистка
Необязательна — нужен Mac с поддержкой Apple Intelligence

Попробуйте на одной фразе

Скачайте, дайте приложению загрузить модель — и зажмите правый ⌥.

Требуется macOS 26 или новее.