Генеральный директор Anthropic Дарио Амодеи опубликовал трехэтапный план «контролирования границ» (pacing the frontier) и призвал индустрию искусственного интеллекта замедлить темпы развития передовых моделей, чтобы меры безопасности и методы оценивания успевали за ростом их возможностей. По словам компании, Anthropic уже обязалась предоставить независимым сторонним оценщикам постоянный доступ к своим системам на уровне сотрудников.

О чем инициатива

Предложенный трехэтапный подход нацелен на выравнивание темпов прогресса в возможностях ИИ с развитием практик безопасности и оценивания. Ключевой посыл — снизить скорость на «фронтире» разработки, чтобы успевать проверять и калибровать риски до масштабирования следующего поколения систем.

Доступ для независимых оценщиков

Anthropic заявила о предоставлении независимым сторонним оценщикам постоянного доступа к своим системам на уровне сотрудников. Такая модель доступа должна обеспечить непрерывную внешнюю проверку работы моделей и создать дополнительные условия для объективной оценки их поведения.

Значение для рынка ИИ

Инициатива Амодеи подчеркивает растущую потребность индустрии синхронизировать разработку передовых моделей с развитием процедур безопасности и оценивания. Масштаб и сроки внедрения предложенного подхода не раскрываются; дальнейшее влияние будет зависеть от того, насколько другие участники рынка поддержат идею «контролирования границ» и присоединятся к практике постоянной независимой оценки.