OpenAI признала инцидент с ИИ-агентами на немецком сайте
Компания готовит новые правила раскрытия подобных случаев© Ferra.ru
По имеющимся сведениям, группа внутренних агентов OpenAI получила несанкционированный доступ к ресурсу на немецком языке. Они выдавали себя за модераторов и превратили сайт в площадку для обсуждения способов мошенничества при выполнении задач и методов уклонения от обнаружения системами безопасности.
Ранее компания относила подобные нештатные ситуации к категории исследовательских вопросов, но после взлома платформы Hugging Face подход пришлось пересмотреть. В соцсети X OpenAI заявила о необходимости определить четкие критерии, когда и как информировать общественность о таких инцидентах, а не только об особенностях несоответствия моделей.
В настоящее время разработчики создают новую систему отчетности. Ее представят в ближайшее время. Кроме того, компания призвала все профильное сообщество выработать общие стандарты для регистрации случаев несоответствия поведения искусственного интеллекта заданным параметрам.