FineMed
FineMed в новостной повестке, календарь упоминаний и aналитика в реальном времени.
Календарь упоминаний:
FineMed стал базовым корпусом из 19,2 млрд слов для обучения медицинских моделей DoctoBERT
Суть: Корпус FineMed использован командой Doctolib в качестве основного обучающего набора данных для создания специализированных моделей анализа медицинских текстов на французском языке.
Фактор: Наличие в FineMed 19,2 млрд слов позволило моделям достичь высокой точности в распознавании специфических медицинских терминов, симптомов и диагнозов.
Эффект: Обучение на FineMed обеспечило возможность локального запуска моделей без отправки чувствительных данных пациентов в облако, решая проблему конфиденциальности.
Связь: Использование FineMed напрямую обусловило способность модели DoctoModernBERT выводить конкретные диагнозы вместо общих слов при анализе клинических описаний.
Команда Doctolib создала корпус FineMed из 21,1 млн документов для медицинских моделей
Суть: Корпус FineMed объемом 21,1 млн документов сформирован командой Doctolib для обучения медицинских энкодеров на основе автоматизированной фильтрации и переписывания веб-контента.
Исследование: При создании FineMed ключевым критерием отбора стала плотность медицинских терминов, которая оказалась эффективнее оценки образовательного качества текста.
Событие: 20 июня 2026 года корпус FineMed и обученные на нем модели DoctoBERT были опубликованы в открытом доступе на Hugging Face Hub и GitHub.
Эффект: Использование данных FineMed позволило моделям DoctoBERT превзойти существующие решения в задачах распознавания сущностей и классификации диагнозов на французском языке.
Риск: Качество итогового корпуса FineMed зависит от точности модели переписывания, что создает риск появления фактических ошибок при генерации текстов.
В нашей базе собрано 2 события по теме «FineMed». Мы показываем все из них.