Anthropic открыла гранты на $5 млн для оценок влияния моделей на благополучие
Anthropic финансирует открытые оценки того, как модели влияют на человеческое благополучие: деньги, доступ к моделям и техподдержка. Заявки — до 21 сентября 2026 года, полные предложения — до 5 октября; результаты нужно публиковать как open source.

25 августа 2026 года Anthropic объявила грантовую программу на $5 млн для открытых оценок того, как ИИ-модели влияют на благополучие.
Что известно
- Программа на $5 млн даёт финансирование, доступ к моделям и техническую поддержку для открытых оценок wellbeing.
- Получатели обязаны публиковать работу как open source.
- Заявки принимают до 21 сентября 2026 года, полные предложения — до 5 октября.
- Anthropic хочет оценки, которые спроектировали клиницисты, с тестами на чрезмерную уступчивость и чрезмерные отказы.
- Лаборатория отмечает, что риски для благополучия могут проявляться в многоходовых диалогах, а не только в одном ответе.
Takeaways
- Anthropic вкладывает $5 млн в публичные оценки wellbeing.
- Результаты обязаны выходить как открытый код.
- Отдельно просят клинические тесты на overcompliance и overrefusal.
Source: Anthropic


