Shaduf.
Рейтинг AI для української мови/Субтитри: вибір за спікерами, таймкодами й довжиною запису

Звіт · 17 вересня 2026

Субтитри: обирайте API за виходом, а не за словом «українська»

Питання: Який AI найкраще працює українською?

Відповідь цього звіту: якщо для українського запису потрібні позначені спікери й таймкоди, не обирайте chirp_2 для автоматичного поділу спікерів: поточна документація Google каже, що діаризація не підтримується. Scribe v2 від ElevenLabs і MAI-Transcribe-2 від Azure документують спікерів і таймкоди для української, але це ще не спільний рейтинг точності. У Azure є поточна межа: документація попереджає, що діаризація в preview зривається приблизно від 15 хвилин.

Три маршрути мають різний вихід

Scribe v2 називає українську серед підтримуваних мов і описує word-level timestamps, діаризацію до 32 спікерів та keyterm prompting. Постачальник відносить українську до власної категорії «≤5% WER». Ми не перетворюємо це на бал поруч із Google або Azure: на прочитаній сторінці немає спільного для всіх сервісів українського набору, переліку помилок чи незалежної перевірки.

MAI-Transcribe-2 документує українську, діаризацію, word-level timestamps, список термінів і режими verbatim/clean. Та та сама поточна сторінка каже, що з увімкненою діаризацією записи приблизно від 15 хвилин можуть завершитися помилкою; для довших записів радить транскрибувати без неї й виконувати окремий крок поділу спікерів.

Chirp 2 має документовані таймкоди, адаптацію та українську в окремій таблиці мов, але поточна сторінка моделі прямо зазначає: діаризація не підтримується. Він може бути доречним для іншого API-процесу, але не вирішує вимогу «хто саме сказав» сам по собі.

Що обрати зараз

Потрібні спікери й короткий ризиковий уривок: перевірте Scribe v2 або Azure MAI-Transcribe-2 на власних іменах, числах, накладанні голосів і часових мітках. Для Azure не плануйте поточну діаризацію як готовий шлях для довгого запису. Уже працюєте з Chirp 2: окремо спроєктуйте крок поділу спікерів. Потрібен SRT: після виправлення тексту відкрийте саме експорт у цільовому програвачі.

Таблиця часто починається до ШІ

Один автор у DOU описує, як для великого набору Excel-файлів спершу вручну нормалізував різні назви колонок і прибрав непотрібні поля в Power Query, а вже потім застосував LLM до DAX. Це не виміряний маршрут і не рекомендація конкретного продукту. Але він додає читачеві корисне запитання перед оплатою: чи ваша перша проблема — формула, чи ще неузгоджена структура даних?

Що це не доводить

Ми не запускали моделі, не слухали аудіо, не створювали SRT і не змінювали книги. Не знайдено незалежного зіставлення готових українських сервісів за WER, спікерами, таймінгом, експортом, ціною та приватністю; немає й спільного тесту цілісності українських таблиць. Тому новий висновок — це вибір за потрібним виходом і видимою межею, а не «найкращий ШІ» без умови.

Search published pools, pages, reports, and evidence.