Tech Meridian ← К ЛЕНТЕ
EN

РЕГУЛИРОВАНИЕ · REGULATION · #508

Anthropic и OpenAI предлагают встроить независимых оценщиков безопасности в передовые AI‑компании

Генеральный директор Anthropic Дарио Амодеи предложил внедрять третьи стороны‑оценщиков (например, METR, Redwood Research) непосредственно в передовые AI‑компании с расширенным доступом к системам, контрольным точкам и логам и правом публиковать ключевые выводы; глава OpenAI Сэм Олтман выразил аналогичную готовность. Оценщики позитивно восприняли идею, но подчеркнули, что незакрытые детали — объём доступа, контрактные ограничения, права на публикацию и правовая база — определят, станут ли они действительно независимыми или останутся подрядчиками под контролем разработчиков и NDAs.

КЛЮЧЕВЫЕ ТЕЗИСЫ

  1. Генеральный директор Anthropic Дарио Амодеи предложил внедрять третьи стороны‑оценщиков (например, METR, Redwood Research) непосредственно в передовые AI‑компании с расширенным доступом к системам, контрольным точкам и логам и правом публиковать ключевые выводы; глава OpenAI Сэм Олтман выразил аналогичную готовность.
  2. Оценщики позитивно восприняли идею, но подчеркнули, что незакрытые детали — объём доступа, контрактные ограничения, права на публикацию и правовая база — определят, станут ли они действительно независимыми или останутся подрядчиками под контролем разработчиков и NDAs.
  3. Встраивание по‑настоящему независимых оценщиков с глубоким доступом может выявлять сбои во время обучения и мешать моделям обманывать тесты безопасности, однако независимость зависит от контрактов и правовой защиты.

ПОЧЕМУ ЭТО ВАЖНО

Встраивание по‑настоящему независимых оценщиков с глубоким доступом может выявлять сбои во время обучения и мешать моделям обманывать тесты безопасности, однако независимость зависит от контрактов и правовой защиты.

ИСТОЧНИКИ И ХРОНОЛОГИЯ

1