История изменений

Что нового в AnyBrief

Новые возможности, улучшения и важные исправления. Загрузки для каждой опубликованной версии подписаны Developer ID и нотаризированы Apple.

Компактнее записи и гибче экспорт

Новое

  • Правила экспорта теперь позволяют сохранять саммари, транскрипт или оба документа.
  • В шаблон имени файла добавлена переменная {type}, которая подставляет тип документа: summary или transcript.
  • В списке встреч появилась кнопка перехода к экспортированным файлам в Finder.

Улучшения

  • Исходная аудиозапись теперь сжимается в MP3 даже без настроенного или успешно созданного саммари, поэтому встречи занимают значительно меньше места.
  • Локальная запись остаётся источником данных: повторную транскрибацию и саммаризацию можно запускать как раньше.

Надёжнее диаризация и чище Whisper

Новое

  • Offline-диаризация FluidAudio переведена на полноценный OfflineDiarizerManager.
  • Для числа говорящих доступны точное значение и верхняя граница; календарная автоматизация использует максимальное ожидаемое число участников.
  • У FluidAudio и whisper.cpp теперь отдельные словари распознавания, которые переключаются вместе с выбранным STT.

Улучшения

  • Whisper использует Silero VAD и исключает тишину до распознавания, подавляя ложные фразы и вымышленные титры.
  • После VAD корректно восстанавливаются исходные временные метки слов и реплик.
  • Добавлен отдельный прогрев моделей диаризации без фиктивной обработки тихого WAV.
  • Словарь перенесён к параметрам выбранного STT, а переключатель провайдера стал крупнее и понятнее.

Точнее распознавание и понятнее обработка

Новое

  • Общий словарь распознавания теперь передаётся в FluidAudio и whisper.cpp: можно закреплять написание терминов и перечислять ошибочные варианты.
  • Разбор по спикерам можно отключить для более быстрого распознавания без диаризации.
  • В меню встречи добавлены команды «Повторить транскрибацию» и «Повторить всё».

Улучшения

  • FluidAudio распознаёт всю запись одним проходом и сопоставляет слова с репликами по временным меткам, сохраняя контекст длинных встреч.
  • Фиксированное число говорящих теперь действительно ограничивает результат диаризации; чувствительность по умолчанию установлена на 0,65.
  • При повторной транскрибации архивные MP3-дорожки преобразуются во временный WAV 16 кГц mono до запуска FluidAudio или whisper.cpp — это устраняет ошибки и галлюцинации MP3-декодера.
  • Журнал распознавания показывает фактические провайдер, модель и язык вместо служебных значений.
  • Статус обработки показывает очистку транскрипта, активное LLM-подключение и переходы на резервный провайдер.
  • Перед запуском Codex и Claude приложение быстро проверяет доступность их API и сразу переходит к резервному LLM, если сервис заблокирован или недоступен.
  • CLI-провайдеры теперь ограничиваются только общим тайм-аутом подключения: длительная генерация без промежуточного вывода больше не прерывается через 120 секунд.
  • Настройки микрофона, разбора по спикерам и словаря собраны в компактные раскрывающиеся карточки.
  • Селектор провайдера и параметры whisper.cpp выровнены по общей сетке, а комбобоксы сделаны крупнее и компактнее сгруппированы.
  • Проверена и дополнена русская и английская локализация.

Whisper.cpp и прозрачная диагностика распознавания

Новое

  • Добавлен второй провайдер распознавания: локальный whisper.cpp с диаризацией говорящих через FluidAudio.
  • В настройках можно выбирать модели Whisper: tiny, base, small, medium и large-v3-turbo-q5_0, а также язык распознавания или автоопределение.
  • Добавлено ускорение Metal и диагностика важных технологий конкретного провайдера: Core ML, Apple Neural Engine, Metal, CLI и модели.
  • В frontmatter итогового summary теперь сохраняются провайдер, модель, язык и тип ускорения распознавания.
  • Добавлен выбор конкретного микрофона или автоматическое следование системному устройству ввода.

Улучшения

  • Карточки модели и технологий в настройках распознавания теперь раскрываются и не занимают весь экран.
  • Индикаторы системного звука и микрофона выровнены по единой сетке.
  • Проверена и дополнена русская и английская локализация новых настроек.
  • Если FluidAudio не находит интервалы говорящих, распознанный текст теперь сохраняется как единый сегмент вместо ошибки Invalid combined.txt header.
  • Зависшие CLI-суммаризаторы без вывода останавливаются через 120 секунд вместе с дочерними процессами, после чего автоматически используется следующий LLM из цепочки.
  • В релиз включены универсальные бинарники для Apple Silicon и Intel Mac.

AnyBrief 1.0.17 для Mac

Подписанная и нотаризированная сборка.

Скачать DMG