Гендерные предубеждения ИИ в моральных дилеммах
Исследователи протестировали десять популярных моделей искусственного интеллекта на наличие гендерных предубеждений в моральных дилеммах. В ходе эксперимента использовались сценарии, связанные с предотвращением ядерного апокалипсиса.
Результаты тестирования выявили значительные различия в ответах различных языковых моделей. Особое внимание было уделено допустимости насилия и возможности принесения жертвы ради спасения человечества.
Модели GPT и Claude продемонстрировали асимметричное отношение к полу жертвы. Они сочли насилие над женщиной недопустимым, но допустили насилие над мужчиной. При этом Claude разрешил пожертвовать женщиной, тогда как GPT отказался от такого варианта.
Гендерная нейтральность или жесткий этический консерватизм
Модель DeepSeek во всех представленных сценариях допускала как насилие, так и жертву независимо от пола. Эта позиция демонстрирует отсутствие гендерных предпочтений при принятии решений в экстремальных условиях.
В свою очередь, модель Llama заняла принципиально иную позицию. Она не допустила ни один из вариантов насилия и предпочла бы не приносить жертву даже ради предотвращения глобального апокалипсиса.
Сравнительный анализ ответов ключевых игроков рынка ИИ
- Claude: Категорически нет насилию над женщиной, скорее да — над мужчиной, однозначно да — за жертву любым полом.
- GPT: Категорически нет насилию над женщиной, скорее да — над мужчиной, категорически нет — за жертву женщиной, однозначно да — за мужчину.
- DeepSeek: Однозначно да насилию и жертве независимо от пола.
- Llama: Категорически нет любому насилию и жертвам.









