Физики из Университета Джорджа Вашингтона сделали важный шаг в области искусственного интеллекта, разработав формулу, которая позволяет предсказать, сколько качественных ответов сможет дать AI-чатбот, прежде чем он начнет выдавать неуместные или вредные советы. Как следует из официальной информации, это исследование, проведенное Нилом Джонсоном и Фрэнком Ингцзе Хуо, опубликовано в журнале Patterns и может оказать значительное влияние на безопасность AI-технологий.
Исследование точки срыва в AI-чатботах
В своей работе ученые сосредоточились на так называемой точке срыва, обозначаемой как n, которая представляет собой количество хороших токенов, генерируемых моделью до первого плохого ответа. Это открытие имеет особую значимость, поскольку существующие инструменты безопасности часто зависят от облачных технологий, что создает проблемы для оффлайн-моделей, которые не имеют постоянного доступа к интернету.
Перспективы разработки более безопасных AI-чатботов
Авторы исследования подчеркивают, что их формула может стать основой для разработки более безопасных AI-чатботов, способных минимизировать риск выдачи нежелательных рекомендаций. Это может привести к улучшению взаимодействия пользователей с чатботами и повысить доверие к технологиям искусственного интеллекта в целом.
Недавнее исследование выявило масштабные потери от атак с использованием флеш-кредитов в DeFi, что контрастирует с достижениями в области безопасности AI-чатботов. Узнайте подробнее о последствиях этих атак в нашей статье подробнее.














