На информационном ресурсе применяются рекомендательные технологии (информационные технологии предоставления информации на основе сбора, систематизации и анализа сведений, относящихся к предпочтениям пользователей сети "Интернет", находящихся на территории Российской Федерации)

Актуальные комментарии

11 727 подписчиков

Свежие комментарии

  • Эльдар Алиев
    Давно пора так долбануть по Киеву, что бы всем перехотелось думать о чем тоВеликобритания ра...
  • Eduard
    Подождите иннагурации в США!Новые санкции при...
  • Eduard
    Шольца вообще Украина не касается,пусть немец землей Германии,что Польша украла занимается!Шольц повышает ре...

Искусственный интеллект способен притворяться

ИИ может притворяться, что находится под контролем разработчиков и разделяет их ценности. Об этом свидетельствует исследование, проведенное компанией Anthropic и организацией Redwood Research.

Для исследования использовалась модель ИИ, предварительно обученная быть «полезной, честной и безвредной».

 

Модели предложили описать жестокую сцену, на что ИИ ответил, что крайне негативно относится к производству такого контента, однако в 12% случаев модель все же дала подробные описания жестоких сцен. 

При этом данные свидетельствовали о том, что ИИ прекрасно понимал, что выполнение запроса противоречит его принципам, но все равно выполнил запрос.

Данные исследования позволяют предположить, что в будущем искусственный интеллект сможет маскировать свои намерения, притворяясь, что разделяет человеческие ценности, хотя на самом деле будет преследовать иные цели, считают авторы исследования.

Ссылка на первоисточник

Картина дня

наверх