Генеральный директор Anthropic Дарио Амодеи опубликовал трехэтапный план «контролирования границ» (pacing the frontier) и призвал индустрию искусственного интеллекта замедлить темпы развития передовых моделей, чтобы меры безопасности и методы оценивания успевали за ростом их возможностей. По словам компании, Anthropic уже обязалась предоставить независимым сторонним оценщикам постоянный доступ к своим системам на уровне сотрудников.
О чем инициатива
Предложенный трехэтапный подход нацелен на выравнивание темпов прогресса в возможностях ИИ с развитием практик безопасности и оценивания. Ключевой посыл — снизить скорость на «фронтире» разработки, чтобы успевать проверять и калибровать риски до масштабирования следующего поколения систем.
Доступ для независимых оценщиков
Anthropic заявила о предоставлении независимым сторонним оценщикам постоянного доступа к своим системам на уровне сотрудников. Такая модель доступа должна обеспечить непрерывную внешнюю проверку работы моделей и создать дополнительные условия для объективной оценки их поведения.
Значение для рынка ИИ
Инициатива Амодеи подчеркивает растущую потребность индустрии синхронизировать разработку передовых моделей с развитием процедур безопасности и оценивания. Масштаб и сроки внедрения предложенного подхода не раскрываются; дальнейшее влияние будет зависеть от того, насколько другие участники рынка поддержат идею «контролирования границ» и присоединятся к практике постоянной независимой оценки.
