
Содержание3 разделов
Коротко
- Аудит станет возможен на этапах обучения, оценки и выпуска модели.
- OpenAI требует от аудиторов независимости и ответственности за выводы.
В середине сентября Anthropic и OpenAI неожиданно сошлись во мнении, что развитие ИИ стоит немного притормозить ради безопасности. Теперь OpenAI сделала конкретный шаг. По данным Bloomberg, компания готова пускать внешних аудиторов к своим моделям на более ранних этапах разработки, чем раньше.
Что меняется в проверке безопасности моделей OpenAI
До сих пор сторонних специалистов подключали ближе к выпуску, когда модель уже обучена и нужно оценить её возможности. Теперь проверка может начаться ещё на этапе обучения, продолжиться при оценке готовой модели и захватить момент публичного запуска.
Лама Ахмад, которая отвечает в OpenAI за работу с внешними аудиторами, объяснила это так: ставки растут, и компания хочет следить за обучением и оценкой так же внимательно, как за выпуском. По её словам, аудиторы смогут приходить прямо в офис, чтобы работать с самой чувствительной частью данных.
На каких условиях внешние аудиторы получат доступ к моделям OpenAI
Открывать двери всем подряд OpenAI не собирается. Аудит, по её требованиям, должен быть независимым от самой компании и глубоким, без формальных галочек. И отдельное условие, которое нам кажется самым важным: аудиторы должны отвечать за свои выводы. Сейчас компания отбирает подрядчиков, среди кандидатов есть и прежние партнёры, и новые организации.
Откуда взялась идея внешнего аудита ИИ
Первой её громко высказала Anthropic. Она предложила отрасли пускать сторонних экспертов, которые могли бы заранее указывать на опасные свойства моделей, и сама пригласила для аудита консалтинговую компанию Accenture. OpenAI добавила политическую часть: предложила создать международные организации по надзору за безопасностью ИИ и попросила правительство США помочь с общими стандартами.
Для обычного пользователя пока ничего не меняется. Но если практика приживётся, у крупных моделей появится внешняя проверка до того, как ими начнут пользоваться сотни миллионов людей. Сейчас такой проверки по сути нет, и компании оценивают себя сами. Кстати, о том, как они оценивают себя в анонсах, можно почитать в наших заметках про Claude Opus 5.5 и GPT-6 Sol и Luna.
Как вам кажется, внешний аудит правда что-то изменит или это скорее жест для регуляторов?
Источники

Как вам материал?



Комментарии