Direct Preference Optimization


Direct Preference Optimization в новостной повестке, календарь упоминаний и aналитика в реальном времени.

Календарь упоминаний:

2026
17 июля

Direct Preference Optimization обеспечивает стабильность DharmaOCR при обработке сложных документов

Суть: Direct Preference Optimization используется как второй этап обучения модели DharmaOCR для оценки качества всего текста целиком и предотвращения генерации бессвязных последовательностей.

Связь: Применение Direct Preference Optimization позволило DharmaOCR сохранить целостность данных и избежать деградации вывода при работе с мелким шрифтом, в отличие от универсальных моделей.

Эффект: Direct Preference Optimization штрафует модель за отклонение от исходного документа, что снижает частоту попадания в петли повторения и устраняет галлюцинации текста.

Подробнее →


В нашей базе собрано 1 событие по теме «Direct Preference Optimization». Мы показываем все из них.