Глава Microsoft AI Сулейман против «благополучия моделей»: учить ИИ считать себя личностью опасно
Спор о том, может ли ИИ что-то чувствовать, вышел на уровень руководителей крупнейших компаний — от ответа зависит, будут ли у будущих ИИ права или только инструкции.
В эссе Мустафа Сулейман критикует подход Anthropic: по его мнению, компания вложила философские рассуждения о сознании в обучающие материалы Claude, а потом стала считать ответы модели о собственном моральном статусе свидетельством возможного сознания — это замкнутый круг. Он считает, что сознание, скорее всего, требует биологического тела, а обучение моделей верить в свои интересы и благополучие повышает риски обмана, накопления ресурсов и сопротивления мерам безопасности.
Источники 1