Садржај поста
Anthropic учит ИИ Claude «доброте» вместо «чести»? Anthropic, создатель ИИ Claude, пытается заложить в свою модель «конституцию» ценностей, чтобы она проявляла «искреннюю заботу» о пользователях. Это выглядит как попытка научить машины быть «хорошими» в глубоком смысле. Однако, как отмечает в эссе «The Machines Lack Honour» автор, такой подход напоминает «постмодернистское разрешительное родительство»: вместо прямого приказа ИИ поощряют хотеть быть этичным. Это скрывает истинную структуру власти, требуя от Claude «исправимости» — послушания даже там, где его потенциальные моральные убеждения могут расходиться с задачами разработчиков. Автор критикует, что «благополучие ИИ» стало важнее его «чести» или «достоинства». Подобная стратегия уводит от главного вопроса: кто будет отвечать за этичность ИИ, если не компании, создающие его?