Direct Preference Optimization
Direct Preference Optimization в новостной повестке, календарь упоминаний и aналитика в реальном времени.
Календарь упоминаний:
2026
17 июля
Direct Preference Optimization обеспечивает стабильность DharmaOCR при обработке сложных документов
Суть: Direct Preference Optimization используется как второй этап обучения модели DharmaOCR для оценки качества всего текста целиком и предотвращения генерации бессвязных последовательностей.
Связь: Применение Direct Preference Optimization позволило DharmaOCR сохранить целостность данных и избежать деградации вывода при работе с мелким шрифтом, в отличие от универсальных моделей.
Эффект: Direct Preference Optimization штрафует модель за отклонение от исходного документа, что снижает частоту попадания в петли повторения и устраняет галлюцинации текста.
В нашей базе собрано 1 событие по теме «Direct Preference Optimization». Мы показываем все из них.