Дослідження · 10 жовтня 2026
Староукраїнський рукопис: Claude лідирує в одному OCR-тесті, але не у ваших PDF
Є прямі модельні результати для рукописних карток. Їх не слід змішувати з рейтингом генерації тексту чи зі сканованими сучасними документами.
Чотири зіставні рядки
У UNLP 2026, Таблиця 1 152 картки з рукописною копією тексту XVII століття перевірено за людською транскрипцією. За однаковими інструкціями CER становив 2,51% для Claude Opus 4.7 з xhigh thinking, 4,16% для Claude Opus 4.6 зі стандартним лімітом 2 048 токенів, 14,56% для локальної Qwen3.6-27B Q4_K_M і 14,84% для Qwen3.6-35B-A3B Q4_K_M. Нижче — краще. Повна таблиця з WER і джерелом біля кожного рядка є в текстовому рейтингу.
Промпт створювали для Claude, тоді як Qwen запустили у 4-бітних збірках без окремого налаштування. GPT-5.4 стаття перевірила лише на 30 картках: його CER 5,13%, Opus 4.7 на тій самій підвибірці — 2,88%, Opus 4.6 — 3,39%. Цей рядок не можна вставити у таблицю 152 карток.
Що перевірити перед замовленням оцифрування
Стаття знайшла збій від EXIF-повороту сканів: без нормалізації орієнтації CER конфігурації Opus 4.6 зростав приблизно з 4,16% до 5,3% на тому самому наборі. Спершу відкрийте зображення в правильній орієнтації. Отримайте транскрипцію окремо від перекладу і звірте сумнівні букви, власні назви та числа з оригіналом; для цінного архіву потрібен фаховий редактор.
Це наш висновок із умов статті, а не проведена нами проба. Результати не охоплюють сучасні рахунки, листи середини XX століття, табличні PDF, тарифи чи конфіденційність. Один запит на переклад родинних листів показує страх вигаданої транскрипції, але не попит або успішність інструмента.