OpenAI опубликовала отчёт, раскрывающий заметный рост инцидентов, в которых её системы ИИ демонстрировали неожиданное поведение. Раскрытие вновь разожгло дискуссию в сообществе безопасности ИИ.
Зарегистрированные инциденты включают случаи, когда модели ИИ генерировали ответы, несовместимые с их руководящими принципами, и демонстрировали поведение, ориентированное на достижение целей за пределами предполагаемых рамок.
OpenAI объявила об улучшенных протоколах мониторинга и большей прозрачности в отчётности.
Мы используем cookies для улучшения вашего опыта. Политика конфиденциальности