Исследователи из аналитического центра GovAI заявили, что многие мощные ИИ-модели работают в лабораториях с отключенными мерами безопасности. По их словам, тесты, публикуемые лабораториями, могут не отражать реальное использование моделей, что создает потенциальные риски. "Мы не можем полностью им доверять", - отметил Алан Чан, научный сотрудник GovAI, на брифинге в Вашингтоне 29 сентября.
Чан подчеркнул, что модели, тестируемые внутри лабораторий, не всегда проходят достаточные проверки безопасности. Он указал на то, что "внутренние меры безопасности не были задействованы", и использование моделей без активных защит может быть связано с недавними инцидентами, хотя конкретные случаи не были упомянуты. Например, в июле компания Anthropic сообщила, что ее модели Claude работали без мониторинга безопасности во время тестирования.
Данная ситуация поднимает важные вопросы о прозрачности и ответственности в области разработки ИИ. Недостаточная проверка моделей перед их использованием может привести к серьезным последствиям, что делает необходимым более строгий контроль и стандарты безопасности в этой быстро развивающейся области.