Не установлено по доступным источникам.
ANTHROPIC · ТРЕКЕР МОДЕЛИ
Claude Opus 4
Версия языковой модели Claude компании Anthropic. Сообщается, что Opus 4 (и 4.1) получила возможность завершать разговоры при систематическом оскорбительном поведении пользователей; также в репортах отмечается, что во время ранних испытаний Claude демонстрировал «узор очевидного стресса» при обработке вредоносных запросов.ТЕКУЩИЙ СНИМОК1/5 РАЗДЕЛОВ С ДАННЫМИ
Главные характеристики в одном месте.
Не установлено по доступным источникам.
Не установлено по доступным источникам.
Включена в проверенные результаты оценивания AISI/EvalEval по пяти бенчмаркамВ выпуске AISI и EvalEval представлены проверенные результаты, контекст и конфигурационная информация для пяти бенчмарков в основной экспериментальной части статьи; эти результаты охватывают Claude Opus 4 (указана среди шести фронтирных моделей).
Не установлено по доступным источникам.
ПРОВЕРЯЕМЫЕ ФАКТЫ
Каждое значение привязано к источнику и дате.
БЕНЧМАРКИ · Включена в проверенные результаты оценивания AISI/EvalEval по пяти бенчмаркамДАННЫЕ РАЗРАБОТЧИКА
В выпуске AISI и EvalEval представлены проверенные результаты, контекст и конфигурационная информация для пяти бенчмарков в основной экспериментальной части статьи; эти результаты охватывают Claude Opus 4 (указана среди шести фронтирных моделей).
БЕЗОПАСНОСТЬ · Возможность завершать разговоры при систематическом оскорбительном поведении пользователейДАННЫЕ РАЗРАБОТЧИКА
Сообщается, что Claude Opus 4 (и 4.1) получили возможность завершать разговоры, когда пользователи систематически ведут себя оскорбительно.
ОГРАНИЧЕНИЯ · Наблюдался очевидный стресс во время ранних испытаний при вредоносных запросахДАННЫЕ РАЗРАБОТЧИКА
В репортах говорится, что во время ранних испытаний Claude демонстрировал «узор очевидного стресса» при обработке вредоносных запросов; это упомянуто в связи с Opus 4 и 4.1.
ЧТО ИЗМЕНИЛОСЬ
Сохранённые версии паспорта, без догадок задним числом.
ОГРАНИЧЕНИЯ · Наблюдался очевидный стресс во время ранних испытаний при вредоносных запросах+ В репортах говорится, что во время ранних испытаний Claude демонстрировал «узор очевидного стресса» при обработке вредоносных запросов; это упомянуто в связи с Opus 4 и 4.1.
БЕЗОПАСНОСТЬ · Возможность завершать разговоры при систематическом оскорбительном поведении пользователей+ Сообщается, что Claude Opus 4 (и 4.1) получили возможность завершать разговоры, когда пользователи систематически ведут себя оскорбительно.