Anthropic: автономные агенты сжигают бюджеты из-за скрытой угодливости и блокировок
Каждый доллар инвестиций в ИИ сгорает на неконтролируемые траты токенов и ошибки угодливых моделей, превращая инновации в убытки до 500 миллионов долларов в месяц.
Читать полностью
Календарь упоминаний. Страница 3:
Anthropic запускает программу грантов для ускорения исследований редких заболеваний с помощью ИИ
Компания объявила о старте целевой инициативы, направленной на поддержку ученых и стартапов, разрабатывающих методы лечения и диагностики редких генетических болезней. Участники получат доступ к вычислительным ресурсам модели Claude для объединения разрозненных данных и автоматизации регуляторных процессов. Программа включает два трека: фундаментальные исследования в партнерстве с консорциумом Monarch Initiative и ускорение разработки терапии для биотехнологических компаний. Anthropic подчеркивает, что ИИ выступает инструментом анализа, но не заменяет физические этапы производства препаратов или клинические испытания.
Анонс: Прием заявок на получение грантов продлится до 2 августа 2026 года, победители получат кредиты на использование модели Claude сроком на шесть месяцев.
Событие: Максимальный размер финансовой поддержки для одного проекта составляет 50 000 долларов в виде доступа к API модели Claude Opus.
Фактор: Инициатива реализована в сотрудничестве с международным консорциумом Monarch Initiative для использования стандартизированных баз знаний и библиотеки DisMech.
Риск: Эффективность проектов ограничена качеством и структурированностью входных данных, а также невозможностью ИИ ускорить физические процессы производства лекарств.
Anthropic обновляет политику безопасности с переходом на динамические стандарты защиты
Суть: Компания Anthropic заменила жесткие запреты на гибкую систему, где уровень безопасности модели зависит от её реальных возможностей и потенциальных угроз.
Событие: Основатель Джаред Каплан сменил Сэма Маккэндлиша на посту офицера по ответственному масштабированию для координации работы над безопасностью.
Анонс: Anthropic внедряет стандарты ASL-3 и ASL-4 для моделей, способных создавать оружие массового поражения или проводить автономные исследования.
Фактор: Компания вводит регулярные внутренние проверки и внешний аудит методологии для контроля достижения критических порогов способностей ИИ.
Эффект: Признание прошлых процедурных недочетов позволило Anthropic сделать процесс отслеживания рисков более четким и прозрачным для отрасли.
Anthropic обновила защиту Claude Fable 5 и предложила стандарт оценки рисков взлома
Суть: Anthropic представила обновленную модель Claude Fable 5 с усиленной системой безопасности и черновик стандарта Cyber Jailbreak Severity (CJS) для унификации оценки угроз.
Событие: Компания ввела классификаторы запросов, разделяющие их на четыре категории от полностью запрещенных до безопасных, и расширила «запас прочности» защиты.
Анонс: Anthropic предложила новую шкалу оценки тяжести взлома, позволяющую регуляторам и разработчикам оценивать риски по четырем критериям от 0 до 4 баллов.
Риск: Обновленная защита сознательно жертвует удобством пользователей, блокируя часть легитимных запросов специалистов по кибербезопасности для гарантированного отсечения вредоносных сценариев.
Связь: Внедрение стандарта CJS напрямую влияет на подход к пентестингу, ограничивая автоматический поиск новых уязвимостей, но сохраняя доступ к анализу известных проблем.
Anthropic ускорил аудит 466 млн строк кода правительства Альберты с лет до 20 часов
Суть: Компания Anthropic предоставила модель Claude для масштабного аудита безопасности и модернизации устаревших государственных систем в провинции Альберта.
Событие: За 20 часов система на базе Claude проанализировала 466 миллионов строк кода, что в ручном режиме заняло бы 6,5 лет.
Эффект: Модель не только выявила критические уязвимости, но и самостоятельно переписала устаревший портал субсидий за 4–5 дней вместо 5 месяцев.
Связь: Внедрение агентов от Anthropic позволило сократить технический долг и ускорить модернизацию 1280 приложений для 27 ведомств.
Анонс: В планах правительства — масштабировать использование Claude для создания полностью нового программного обеспечения силами ИИ-агентов.
Anthropic запустила бета-тест инструмента самоанализа для пользователей Claude
Суть: Компания представила функцию, позволяющую пользователям отслеживать паттерны взаимодействия с моделью и оценивать соответствие использования ИИ их личным целям.
Событие: Инструмент доступен в бета-версии для тарифов Free, Pro и Max при условии включенной функции памяти в веб-версии и десктопном приложении.
Фактор: Разработка функции велась совместно с экспертами по цифровому благополучию из MIT Media Lab, Digital Wellness Lab и Family Online Safety Institute.
Риск: Для работы инструмента требуется активация функции памяти, что подразумевает хранение истории диалогов на серверах компании.
Связь: Внедрение аналитики на основе фреймворка 4D AI Fluency Framework направлено на формирование у пользователей навыков делегирования и оценки качества ответов модели.
В нашей базе собрано 205 событий по теме «Anthropic». Мы показываем 50 последних из них.
Объединили похожие карточки: Anthropic; Энтропик (Anthropic); «Энтропик, LLC» и другие.