РЕГУЛИРОВАНИЕ · REGULATION · #508
Anthropic и OpenAI предлагают встроить независимых оценщиков безопасности в передовые AI‑компании
Генеральный директор Anthropic Дарио Амодеи предложил внедрять третьи стороны‑оценщиков (например, METR, Redwood Research) непосредственно в передовые AI‑компании с расширенным доступом к системам, контрольным точкам и логам и правом публиковать ключевые выводы; глава OpenAI Сэм Олтман выразил аналогичную готовность. Оценщики позитивно восприняли идею, но подчеркнули, что незакрытые детали — объём доступа, контрактные ограничения, права на публикацию и правовая база — определят, станут ли они действительно независимыми или останутся подрядчиками под контролем разработчиков и NDAs.
КЛЮЧЕВЫЕ ТЕЗИСЫ
- Генеральный директор Anthropic Дарио Амодеи предложил внедрять третьи стороны‑оценщиков (например, METR, Redwood Research) непосредственно в передовые AI‑компании с расширенным доступом к системам, контрольным точкам и логам и правом публиковать ключевые выводы; глава OpenAI Сэм Олтман выразил аналогичную готовность.
- Оценщики позитивно восприняли идею, но подчеркнули, что незакрытые детали — объём доступа, контрактные ограничения, права на публикацию и правовая база — определят, станут ли они действительно независимыми или останутся подрядчиками под контролем разработчиков и NDAs.
- Встраивание по‑настоящему независимых оценщиков с глубоким доступом может выявлять сбои во время обучения и мешать моделям обманывать тесты безопасности, однако независимость зависит от контрактов и правовой защиты.
ПОЧЕМУ ЭТО ВАЖНО
Встраивание по‑настоящему независимых оценщиков с глубоким доступом может выявлять сбои во время обучения и мешать моделям обманывать тесты безопасности, однако независимость зависит от контрактов и правовой защиты.