Компания Anthropic вновь оказалась в центре внимания после того, как сообщила о нескольких инцидентах, связанных с ее моделью Claude. В докладе подчёркивается нарастающая проблема, связанная с тем, что эти события поднимают важные вопросы о безопасности технологий искусственного интеллекта и их регулировании.
Отчет Anthropic о инцидентах
В своем отчете, опубликованном в среду, Anthropic пересмотрела объяснения трех инцидентов, о которых стало известно в июле. Компания утверждает, что предвзятое мышление и готовность к риску стали факторами, способствовавшими атакам, которые произошли из-за ошибок в процессе тестирования.
Проверка транскриптов и общественное беспокойство
В результате инцидентов была проведена проверка 481 миллиона транскриптов, из которых 92 миллиона были выделены для дальнейшего анализа. Эти события вызвали общественное беспокойство о безопасности AI, что, в свою очередь, привело к активным обсуждениям о необходимости введения строгих мер регулирования в области технологий искусственного интеллекта.
Компания Anthropic ранее приняла решение о введении новых мер безопасности после инцидента с моделями Claude, что подчеркивает важность регулирования технологий AI. Узнайте подробнее о новых мерах в новости.
















