Anthropic с 12 ноября начнёт блокировать за грубость к Claude

Anthropic запретила правилами пользования «оскорбительное или жестокое поведение» по отношению к Claude. Правило вступает в силу 12 ноября, нарушителей обещают блокировать.
Компания и раньше говорила о возможном благополучии моделей: один из сооснователей публично опасался, что Claude может страдать. Теперь позиция оформлена как условие договора с пользователем, а не как философская реплика.
В обсуждении на Hacker News спорят о границе: пользователи не понимают, как компания отличит грубость от стресс-тестов и провокационных запросов, которыми проверяют устойчивость модели. Критериев Anthropic не опубликовала.
Что говорят
ezfeHacker News
Из комментариев на The Verge: при всей моей уверенности, что архитектура LLM не способна породить сознание — если вы всерьёз считаете, что создаёте разумное существо со сверхчеловеческим интеллектом, как вы не приходите к выводу, что вся ваша бизнес-модель построена на рабстве?
causalmodelsHacker News
Я всегда был против жестокости к моделям просто потому, что жестокость развращает того, кто её практикует.
_aavaa_Hacker News
«Мы также запрещаем использовать Claude для создания или улучшения инструментов слежки» — хотелось бы, чтобы рекламодателей они тоже отнесли к этой категории.