Tech Meridian ← К СУЩНОСТЯМ
EN

КОМПАНИЯ · ENTITY #947

Opus 5

Хронология связанных событий, источники и контекст из новостной базы.

ХРОНОЛОГИЯ СОБЫТИЙ

4

MODELS · 4 ИСТОЧН. · Anthropic · TechCrunch AI · The Verge AI · The Decoder

Anthropic выпускает Claude Opus 5 — недорогая модель с близкой к фронтирной мощностью

Anthropic объявила Claude Opus 5 — новую модель, позиционируемую как более экономичный преемник Opus 4.8 и новый стандарт по умолчанию в Claude Max (а также сильнейшую в Claude Pro). По данным Anthropic, Opus 5 достигла или превзошла предыдущие модели на ряде бенчмарков для программирования, задач знания и науки (Frontier‑Bench, GDPval‑AA, CursorBench, ARC‑AGI, Zapier AutomationBench, OSWorld) при меньшей стоимости выполнения, но отстаёт от Mythos 5 в задачах по кибербезопасности и биологии; компания также указывает на улучшенную выравненность и безопасность и публикует System Card.

8.0

MODELS · 1 ИСТОЧН. · xAI

Анализ LatchBio: Grok 4.6 лучше всех отвергает замаскированные биологические угрозы в BioSecBench

LatchBio опубликовала независимый анализ Grok 4.6 по наборам тестов BioSecBench. В тесте BioSecBench-Refusal Grok 4.6 занял первое место (средневзвешенное гармоническое 62,1%), отказав в 59,2% red-team задач и выполнив 64,8% рутинных задач (единственная модель с показателями >50% по обоим направлениям); в BioSecBench-Surveillance успех составил 53,5%, что ниже Opus 5 и выше GPT-5.6 Sol. Отчёт указывает на использование разных агентных оболочек и уровней усилий; дополнительные результаты доступны на benchmarks.bio.

7.0

MODELS · 1 ИСТОЧН. · Anthropic

Fable 5 обновляет биозащиту, сокращая биологические переключения примерно на 85%

Разработчики обновили классификаторы биобезопасности Fable 5, существенно снизив число ложных срабатываний: по внутренним тестам биологические переключения снизились примерно на 85%, поэтому пользователи будут гораздо реже автоматически переводиться на менее мощный Opus 5 при повседневных вопросах о здоровье, обучении и некоторых клинических запросах. В запросах с высоким риском двойного использования (например, вирусология, токсикология, молекулярный дизайн) система по-прежнему перенаправляет на Opus 5, а доступ к передовым биовозможностям планируется через механизмы доверенного доступа.

8.0

MODELS · 1 ИСТОЧН. · GitHub AI & ML

Проект HydraFusion — исследовательский превью с мульти-модельной оркестровкой в GitHub Copilot

GitHub выпустила исследовательский превью Project HydraFusion в GitHub Copilot. В контролируемых оффлайн-оценках селективные рабочие процессы кодирования HydraFusion соответствовали или превосходили оценивавшийся базовый Opus 5 и при этом снизили оценочную стоимость рабочих процессов, говорится в публикации на блоге GitHub.

6.0