OpenAI позволит сторонним организациям раньше вмешиваться в оценку безопасности модели ИИ

📅 2026-09-23

Аннотация:

OpenAI планирует разрешить сторонним организациям оценивать риски безопасности на ранних этапах цикла разработки моделей искусственного интеллекта (ИИ). Этот шаг направлен на продолжение усилий по решению проблем, связанных с потенциальным вредом ИИ. Во вторник разработчик ChatGPT объявит в своем блоге, что планирует привлечь внешние агентства к проведению технической оценки безопасности во время обучения, оценки и развертывания новых моделей ИИ.


OpenAI также перечисляет приоритеты, которые, по ее мнению, необходимы для того, чтобы такие оценки были эффективными, включая «сильные независимые механизмы, научную строгость, надежные методы обеспечения безопасности и четкую подотчетность».

Лама Ахмад, который отвечает за большую часть работы компании по проверке безопасности в сотрудничестве с внешними экспертами, сказал, что раньше OpenAI обычно привлекала такие учреждения в основном для проведения оценок безопасности и оценки возможностей модели перед ее выпуском.

«Поскольку потенциальные риски и воздействия растут, помимо развертывания мы также хотим обеспечить рассмотрение таких важных аспектов, как обучение и оценка», — сказал Ахмад в интервью.

Для некоторых из наиболее деликатных работ OpenAI может позволить сторонним оценщикам приходить в компанию для проведения оценок — практика, которую компания пробовала в прошлом, — сказал Ахмад.

Дарио Амодей, генеральный директор Anthropic PBC, конкурента OpenAI, недавно призвал индустрию искусственного интеллекта поддержать замедление развития и заявил, что будут приняты новые меры безопасности, включая введение сторонних агентств по оценке. Генеральный директор OpenAI Сэм Альтман позже поддержал этот подход. В конце прошлой недели Anthropic заявила, что привлечет оценщиков Accenture для проверки безопасности ее передовых моделей искусственного интеллекта.

В своем блоге OpenAI сообщила, что компания ведет переговоры с учреждениями, которые могут участвовать в таких оценках. Ахмад сказал, что цели переговоров включают как учреждения, которые сотрудничали в прошлом, так и учреждения, которые раньше не сотрудничали, в том числе исследовательские институты искусственного интеллекта METR и Redwood Research. OpenAI ранее поручила этим двум учреждениям расследовать внедрение своей модели в систему Hugging Face.

«AI Labs несет ответственность за создание условий для эффективной проверки при защите конфиденциальной информации», — говорится в сообщении OpenAI в блоге.

Связанные теги

Похожие статьи

Комментарии

0/500
Captcha (click to refresh)
Нет комментариев