Локальное распознавание на macOS

Переведите аудио и видео в текст на Mac

Импортируйте запись разговора, лекции или интервью. AnyBrief распознает речь локально и, если включено разделение говорящих, соберёт реплики в читаемый транскрипт.

Beta для macOS 14 и новее, Apple Silicon и Intel. Подпись Developer ID и нотаризация Apple.

Импорт аудио или видео для перевода в текст в AnyBrief

Из файла — в рабочий транскрипт

Без загрузки записи в браузерный сервис и без ручного копирования между инструментами.

01 · ФАЙЛ

Добавьте аудио или видео

Выберите поддерживаемый macOS медиафайл, укажите понятное название и дату. Исходный файл останется на месте.

02 · ТЕКСТ

Распознайте речь локально

Используйте FluidAudio или whisper.cpp. Настройки языка зависят от выбранного движка; разделение участников включается отдельно.

03 · РЕЗУЛЬТАТ

Читайте, проверяйте, экспортируйте

Транскрипт и обработанная копия аудио сохраняются во встрече; саммари создаётся отдельно, если оно настроено.

Что происходит с файлом

Импорт не изменяет и не перемещает оригинал.

Извлечение звука
AnyBrief читает первую доступную аудиодорожку. Если её нельзя декодировать, импорт отменяется и встреча не создаётся.
Подготовка к распознаванию
Приложение создаёт отдельную локальную монофоническую WAV-копию (PCM, 16 кГц). Для многодорожечного видео импортируется только первая читаемая аудиодорожка.
Материалы встречи
Сохраняются исходный транскрипт transcript_raw.txt, рабочий transcript.txt, необязательный summary.md и локальный архив с обработанным аудио и техническими данными.
Повторная обработка
Транскрибацию можно повторить с другой моделью. Исходный транскрипт сохраняется отдельно от версии после LLM-очистки.

Не просто стенограмма

После распознавания можно очистить текст и создать черновик нужного документа с помощью выбранной LLM.

  • Реплики с разделением по голосам — когда диаризация включена
  • Повторная транскрибация с другой моделью
  • Саммари, протокол, бриф или конспект по вашему промпту
  • Экспорт транскрипта и саммари в заранее созданную папку

Саммари требует настроенных промпта и LLM и создаётся для транскриптов от 30 распознанных слов. Результат распознавания и LLM стоит сверять с записью.

Транскрипт и саммари встречи в AnyBrief

Частые вопросы

Какие форматы аудио и видео можно расшифровать?

Частые примеры: M4A/AAC, MP3, WAV, AIFF, FLAC, OGG и CAF; а также MOV, MP4, M4V, AVI, MPEG и 3GP с аудиодорожкой. Автотестами AnyBrief проверены M4A/AAC, WAV и MOV. Возможность импорта зависит от кодека внутри файла и версии macOS — файл без читаемой аудиодорожки будет отклонён.

Распознавание действительно локальное?

Да. FluidAudio и whisper.cpp работают на вашем Mac. Для саммари можно выбрать локальную Ollama либо настроенный вами API или CLI.

Можно ли записывать разговор сразу?

Да. Помимо импорта, AnyBrief записывает системный звук и микрофон в отдельные дорожки.

Другие задачи

Получите текст из первой записи

Установите AnyBrief и импортируйте аудио или видео.

Скачать AnyBrief