Anthropic запустила программу на $5 млн для оценки влияния ИИ
25 августа 2026 года Anthropic объявила о грантовой программе объёмом $5 млн для независимого изучения влияния ИИ-моделей на благополучие пользователей. Участникам обещаны прямое финансирование, доступ к моделям компании и техническая поддержка при создании открытых оценочных методик и бенчмарков.
Получатели грантов будут работать независимо от Anthropic и публиковать результаты как проекты с открытым исходным кодом, которыми смогут пользоваться другие разработчики. Компания приглашает к участию клиницистов, психологов, методологов и специалистов из других профильных областей.
Инициатива призвана улучшить оценку продолжительных и чувствительных разговоров с ИИ. По объяснению Anthropic, риск не всегда заметен в отдельном ответе: необходимость более осторожной реакции может проявиться только по ходу длинного диалога — например, если пользователь постепенно раскрывает признаки кризиса или ранее демонстрировал расстройство пищевого поведения.
Компания ищет методики с чётко определённым предметом измерения, критериями успешного прохождения и объяснением значимости результата. К проектированию и проверке должны привлекаться клинические и профильные специалисты. Тесты также должны учитывать два противоположных риска: чрезмерную готовность модели выполнить потенциально вредный запрос и необоснованный отказ помочь.
Сценарии предполагается строить с учётом реального использования ИИ, включая многоходовые разговоры, где контекст меняется, а риск постепенно усиливается. Anthropic также требует сверять работу оценщиков с заключениями настоящих профильных экспертов.
Заявки принимаются до 21 сентября 2026 года. Кандидатов, выбранных для подачи полных предложений, компания планирует уведомить до 5 октября. Объявление касается финансирования будущих работ и пока не содержит результатов новых оценок или подтверждений эффективности ещё не созданных методик.
Практический контекст: Практическая ценность программы будет зависеть от того, насколько будущие открытые тесты окажутся применимы к разным моделям и реальным пользовательским ситуациям. Требования к длинным диалогам и экспертной проверке могут сделать оценки содержательнее, но сопоставимость проектов станет понятна только после публикации их методов и результатов.
| Требование | Что необходимо учитывать |
|---|---|
| Чёткая цель | Измеряемое свойство, критерии прохождения и значимость результата |
| Экспертная проверка | Участие клинических и профильных специалистов в проектировании и валидации |
| Противоположные риски | Как чрезмерное согласие модели, так и необоснованный отказ |
| Реалистичный контекст | Многоходовые разговоры с изменением контекста и усилением риска |
| Проверка оценщиков | Сопоставление их работы с заключениями реальных профильных экспертов |
Источники
Дата события: 2026-08-25. Дата первоисточника: 2026-08-25.