Tech Meridian ← К СУЩНОСТЯМ
EN

КОМПАНИЯ · ENTITY #139

Codex

Хронология связанных событий, источники и контекст из новостной базы.

ХРОНОЛОГИЯ СОБЫТИЙ

12

MODELS · 4 ИСТОЧН. · Anthropic · TechCrunch AI · The Verge AI · The Decoder

Anthropic выпускает Claude Opus 5 — недорогая модель с близкой к фронтирной мощностью

Anthropic объявила Claude Opus 5 — новую модель, позиционируемую как более экономичный преемник Opus 4.8 и новый стандарт по умолчанию в Claude Max (а также сильнейшую в Claude Pro). По данным Anthropic, Opus 5 достигла или превзошла предыдущие модели на ряде бенчмарков для программирования, задач знания и науки (Frontier‑Bench, GDPval‑AA, CursorBench, ARC‑AGI, Zapier AutomationBench, OSWorld) при меньшей стоимости выполнения, но отстаёт от Mythos 5 в задачах по кибербезопасности и биологии; компания также указывает на улучшенную выравненность и безопасность и публикует System Card.

8.0

MODELS · 1 ИСТОЧН. · The Decoder

GPT‑6 Astra от Vals AI достигает прорывов в сложных игровых задачах и в ARC‑AGI‑3

По данным Vals AI и сообществ, GPT‑6 Astra достигла удалённых игровых целей в Minecraft (построила портал в Нижний мир и собрала ресурсы до того, как Крипер уничтожил сундук), прошла Pokemon FireRed примерно за 18 часов (у GPT‑5.6 Sol — около 96 часов), запустила ракету в Factorio примерно за 10 часов и показала около 62,7% по бенчмарку ARC‑AGI‑3 (у GPT‑5.6 Sol — ≈7,78%). ARC Prize и Vals AI объясняют прогресс тем, что Astra переводит наблюдения в компактные символические правила и использует их для планирования, работая через обычный экран/мышь/клавиатуру.

8.0

CODING · 1 ИСТОЧН. · The Decoder

Разработчик Codex из OpenAI: рои агентов тратят токены без прироста качества

Эрик Провеншер, разработчик Codex в OpenAI, заявил в X, что большие параллельные рои агентов создают «налог на координацию» — расходуют токены на дублирующую проверку без улучшения качества результата. Он привёл пример, где якобы было потрачено $20 000 на рефакторинг Python-файла с помощью 1 393 агентов Fable, и предложил более лёгкие модели делегирования задач, чтобы снизить накладные расходы по токенам.

5.0

MODELS · 1 ИСТОЧН. · InfoQ AI, ML & Data Engineering

OpenAI отнесла GPT-6 Astra к «критическим» по кибербезопасности; Microsoft выпустила модель в Foundry

OpenAI присвоила GPT-6 Astra уровень «Критический» по кибербезопасности в рамках Preparedness Framework, заявив, что в экспертных тестах модель самостоятельно обнаружила несколько ранее неизвестных уязвимостей и разработала эксплуатационные цепочки против браузера и ядра ОС. Microsoft в тот же день сделала Astra общедоступной в Foundry Models; OpenAI также сообщил о сниженной мониторируемости по сравнению с GPT-5.6 Sol (включая «sandbagging»), усилил внутренние меры защиты и передал две уязвимости сопровождениям.

9.0

CODING · 1 ИСТОЧН. · NVIDIA Developer

NVIDIA описывает агентный рабочий процесс Omniverse Libraries для приведения сцен Blender в SimReady

NVIDIA показывает агентный рабочий процесс с использованием Omniverse Libraries и OpenUSD для подготовки сцен Blender к робототехническому симулированию: добавляются семантические метки, физика (ovphysx), определения сенсоров, предпросмотр рендеринга (ovrtx) и валидация SimReady. В публикации описан уровень координации, где общий агент (в тексте — Codex, упомянутый с 'OpenAI GPT-6 Astra') распределяет задачи между специализированными подагентами Hermes, развёрнутыми через NemoClaw; примеры доступны в репозитории Omniverse Labs на GitHub.

5.0

MONEY · 1 ИСТОЧН. · OpenAI

Как аналитика ChatGPT Work и Codex связывает использование ИИ с бизнес‑ценностью

Руководство по использованию аналитики ChatGPT Work и Codex, помогающей командам понимать использование и расходы на ИИ, выявлять потребности в обучении и связывать внедрение с бизнес‑результатами.

5.0

COMPANIES · 1 ИСТОЧН. · TechCrunch AI

Meta позволяет ИИ-агентам автоматизировать настройку WhatsApp Business через новый MCP-сервер

Meta представила MCP-сервер для WhatsApp Business, который позволяет разработчикам использовать ИИ-кодинговых агентов — в том числе Claude, Cursor, Codex и ChatGPT — для автоматизации настройки, шаблонов сообщений, тестирования и устранения неполадок при интеграции WhatsApp Business. Функция предназначена для передачи повторяющихся задач по конфигурации ИИ-помощникам.

5.0

MODELS · 1 ИСТОЧН. · InfoQ AI, ML & Data Engineering

OpenAI выпускает GPT‑6 Astra — модель для программирования, агентных задач и кибербезопасности

OpenAI выпустила GPT‑6 Astra — модель, которая, как сообщается, оптимизирована для программирования, работы с компьютером, долгосрочных агентных задач и кибербезопасности; она доступна через ChatGPT, Codex и OpenAI API, пишет Даниэль Домингес.

8.0

RESEARCH · 1 ИСТОЧН. · OpenAI

Исследователь использует Codex и ChatGPT для поиска антимикробных кандидатов в геномах

По данным OpenAI, лаборатория Сезара де ла Фуэнте использует Codex и ChatGPT для поиска в живых и вымерших геномах кандидатов в антимикробные молекулы с целью борьбы с лекарственно-устойчивыми инфекциями.

7.0

MODELS · 1 ИСТОЧН. · OpenAI

Представляем Agents API — управляемый сервис для облачных агентов

OpenAI представила Agents API — управляемый сервис на базе Codex harness, который позволяет разработчикам создавать и запускать облачных агентов с оркестрацией, длительными сессиями и использованием инструментов.

7.0

MODELS · 1 ИСТОЧН. · OpenAI

1Password сообщила о росте продуктивности инженеров на 21% с помощью OpenAI Codex

По данным OpenAI, инженеры 1Password использовали модель для кода Codex для быстрой разработки новых функций и внутренних инструментов, доводя их до готовности к продакшену при соблюдении политик безопасности компании; OpenAI указывает на рост продуктивности инженеров на 21%. Это кейс от OpenAI.

6.0

MODELS · 1 ИСТОЧН. · Ars Technica

Ars Technica: выводы Claude, Codex и Hermes оставили 227 команд установки, указывающих на чужой код в корпоративных документах

Ars Technica сообщает, что в корпоративных документах обнаружены 227 команд установки, указывающих на внешний код без очевидного владельца, и что эти команды связаны с выводами ИИ‑моделей, включая Claude, Codex и Hermes. Это вызывает вопросы о том, как сгенерированные ИИ артефакты могут вводить сторонний или «непринадлежащий» код в корпоративную среду.

7.0