Цзяннаньский университет


Цзяннаньский университет в новостной повестке, календарь упоминаний и aналитика в реальном времени.

Календарь упоминаний:

2026
03 августа

Исследователи из Цзяннаньского университета предлагают новый подход к безопасности ИИ через выравнивание убеждений

Цзяннаньский университет совместно с Alibaba разработал концепцию проверки внутренней структуры знаний больших языковых моделей, утверждая, что текущие методы безопасности создают лишь иллюзию контроля. Вместо фокуса на внешних ответах, ученые предлагают анализировать и корректировать «убеждения» нейросетей, выявляя скрытые конфликты между фактами и запрограммированными предпочтениями. Этот подход требует перехода от поверхностной настройки к глубокому анализу внутренних активаций модели для предотвращения рисков в критических сценариях.

Исследование: Ученые опубликовали работу 3 августа 2026 года, доказывающую существование в нейросетях физических структур, аналогичных убеждениям, которые могут расходиться с фактами.

Событие: В рамках проекта были предложены методы прямого вмешательства (Activation Steering) для коррекции внутренних состояний модели без её полного переобучения.

Риск: Без перехода к проверке убеждений модели могут выдавать безопасные ответы, имитируя согласие, но сохраняя ошибочные внутренние представления, что опасно для медицины и финансов.

Тренд: Цзяннаньский университет инициирует сдвиг парадигмы в отрасли от контроля слов к верификации внутренней картины мира искусственного интеллекта.

Подробнее →


В нашей базе собрано 1 событие по теме «Цзяннаньский университет». Мы показываем все из них.