Для фахового перекладу глосарій може важити більше за загальний бал
Питання: Який AI найкраще працює українською?
У UNLP 2026 один автор перевірив retrieval-augmented EN→UK переклад у приватному юридично-військовому корпусі. Тестували Gemma 3 4B, 12B і 27B та Gemini 3 Flash; 258 тестових пар зіставляли з 2 581 парою в пошуковому індексі. До запиту додавали 0, 3, 5, 10 або 25 схожих перевірених двомовних прикладів.
За ChrF++ і COMET додавання прикладів статистично значуще допомогло кожній тестованій моделі. У Gemma 3 4B COMET зріс на 0,076 уже за трьох прикладів. Але більше не означало краще: між k=10 і k=25 ця сама модель втратила 9,72 ChrF++ і 0,007 COMET.
Практичний висновок вузький: для повторюваного фахового тексту корисніше спершу мати погоджений глосарій або вичитані двомовні приклади, ніж обирати чат лише за загальним модельним балом. Передавайте такі матеріали лише в дозволений сервіс і звіряйте терміни у фінальній українській версії. Стаття не порівнює ChatGPT, Claude, тарифів, функцій завантаження файлів, конфіденційності чи вашого домену; вона не називає найкращий готовий сервіс.