Программа аудита разделена на четыре ключевых блока. Внешние эксперты изучат «кейсы безопасности» компании, сопоставляя заявленные параметры надежности с фактическими данными. Отдельное внимание уделят защитным механизмам: аудиторы получат доступ к системам для тестирования фильтров на устойчивость к джейлбрейкам и попыткам генерации вредоносного контента, включая сценарии создания биооружия.
OpenAI открывает доступ к аудиту безопасности своих моделей
OpenAI представила протокол для независимых организаций, позволяющий проводить глубокую проверку безопасности ИИ-систем вне цикла релизов. Компания переходит от внутренней оценки к формализованному внешнему надзору, который охватывает весь жизненный цикл моделей: от методик обучения до расследования критических инцидентов и защиты от киберугроз.

Третий блок направлен на проверку инструментов из структуры Preparedness Framework, оценивающих способности моделей к самоулучшению и кибершпионажу. Самым сложным направлением станет расследование инцидентов, где от экспертов потребуется навыки киберкриминалистики. Взаимодействие с независимыми аудиторами будет строиться на семи принципах, включая строгую конфиденциальность и прозрачность методологий. OpenAI уже начала переговоры с профильными организациями о запуске пилотных проверок по этой схеме.




Комментарии (0)
Пока нет комментариев. Будьте первым!