Как расшифровать аудио в текст в Obsidian?
Встроенной расшифровки нет — нужен сторонний плагин. Whisper и AI Audio Transcription отправляют запись в облачный сервис по вашему ключу API, Voice Scribe распознаёт речь локально на устройстве. Для длинных записей встреч удобнее отдельный сервис расшифровки, а в Obsidian вставлять готовый текст.
Обновлено
Облако или локально: в чём разница
Облачная расшифровка (OpenAI Whisper API, Groq, Deepgram) быстрая и точная, работает на любом устройстве, но запись уходит на серверы сервиса и оплачивается по минутам. Из России оплата большинства таких API российской картой невозможна.
Локальная расшифровка бесплатна и приватна: модель скачивается на устройство один раз. Но она медленнее, особенно на телефонах, и более крупные модели требуют памяти.
Как расшифровывать длинные записи встреч
Плагины рассчитаны на короткие голосовые. Для часовой встречи удобнее специализированный сервис: он делит запись на части, различает спикеров и делает саммари. В Obsidian потом вставляется готовый текст с решениями и задачами.
Как улучшить качество расшифровки
- Записывайте ближе к микрофону и без фоновой музыки.
- Указывайте язык записи в настройках плагина вместо автоопределения.
- Для имён и терминов добавьте подсказку (prompt) в Whisper — модель будет писать их правильно.
- Длинные записи режьте на части по 10–20 минут.
Плагины расшифровки для Obsidian
| Плагин | Где распознаёт | Что нужно |
|---|---|---|
| Whisper | В облаке (OpenAI, Groq и совместимые API) | Ключ API, оплата по объёму |
| Voice Scribe | На устройстве | Скачать модель один раз, дальше офлайн |
| AI Audio Transcription and Summary | В облаке (Whisper или Gemini) | Ключ API; есть саммари |
| Audio Notes | В облаке (Deepgram) | Ключ Deepgram |
Что важно знать
- Проверьте, поддерживает ли модель русский язык и как она справляется с несколькими спикерами.
Частые вопросы по теме
Сколько стоит расшифровка через Whisper API?
Оплата идёт за минуты аудио по тарифу выбранного провайдера; для редких коротких голосовых это копейки, для встреч — ощутимо.
Различают ли плагины Obsidian спикеров?
Большинство — нет. Разделение по спикерам есть в специализированных сервисах расшифровки встреч.
Можно ли расшифровать старые аудиофайлы в хранилище?
Да, плагины Whisper и AI Audio Transcription умеют расшифровывать уже сохранённые файлы.
Как это устроено в Fast Notes
Fast Notes расшифровывает голосовые и записи встреч с разделением по спикерам и сразу делает саммари, договорённости и задачи — без ключей API.
Источники
Похожие вопросы
Как добавить голосовые заметки в Obsidian?
Во встроенном плагине «Аудиорекордер» Obsidian записывает звук прямо в заметку, но не превращает его в текст. Чтобы…
02Как расшифровать запись встречи или созвона в текст?
Запишите встречу диктофоном или средствами платформы, затем загрузите файл в сервис расшифровки: он переведёт речь в…
03Как отправлять сообщения из Telegram в Obsidian?
Через сторонний плагин Telegram Sync: вы создаёте своего бота у @BotFather, вписываете его токен в плагин, и всё, что…
04Как бесплатно синхронизировать Obsidian между телефоном и компьютером?
Без платного Obsidian Sync есть четыре рабочих способа: iCloud Drive (если есть устройства Apple), Syncthing (напрямую…
05Как оплатить Obsidian Sync из России?
Obsidian принимает оплату только картами, выпущенными за рубежом, поэтому напрямую российской картой Sync не оплатить.…
06Как синхронизировать Obsidian через Яндекс Диск?
Через плагин Remotely Save и протокол WebDAV. В Яндекс ID создайте пароль приложения для Диска, в плагине выберите…