Tech Meridian ← К СУЩНОСТЯМ
EN

МОДЕЛЬ · ENTITY #3708

Claude Sonnet 4.6

Хронология связанных событий, источники и контекст из новостной базы.

ХРОНОЛОГИЯ СОБЫТИЙ

1

RESEARCH · 1 ИСТОЧН. · arXiv cs.AI

Статья на arXiv представляет бенчмарк SAFE для проверки, запрашивают ли передовые модели данные о безопасности перед действием

В работе (arXiv:2609.17865v1) представлен SAFE — контролируемый бенчмарк, в котором модели решают, запрашивать ли дополнительную информацию о безопасности, меняя её стоимость, вероятность, серьёзность и подачу. При оценке GPT-5.5, o3, Claude Opus 4.8 и Claude Sonnet 4.6 авторы обнаружили разные политики запроса доказательств (Opus почти всегда проверяет, o3 чаще пропускает, GPT-5.5 и Sonnet — промежуточно), сильную зависимость от серьёзности и стоимости доступа, слабую от вероятности, и рассогласование между объяснениями моделей и фактическим поведением.

7.0