OpenAI выпустила GPT-6 Astra: модель садится за компьютер и первой получила статус Critical по кибербезу
Astra показана 3 сентября ограниченному числу организаций, общедоступность — с 4 сентября. Контекст 1 050 000 токенов, вывод до 128 000, цена API $10 за млн входных и $50 за млн выходных. Публичная версия при этом отказывается выполнять продвинутые киберзадачи.
Заявленные результаты со страницы запуска: FrontierMath Tier 4 (v2) — 98%, ARC-AGI-3 — 99,9%, Terminal-Bench 4.0 — 57,9%. Главная витринная способность — computer use: на OSWorld 2.0 Astra даёт 72,6% против 65,7% у GPT-5.6 Sol и тратит примерно на 47% меньше времени на задачу (~40 минут против ~75). Эти 47% — сокращение времени относительно одной конкретной модели в замерах с симуляцией задержек, а не общий прирост скорости «против предыдущих версий». Кэшированный ввод стоит $1,00 за млн, режим Fast удваивает цену — про удвоение скорости в документации не сказано ничего. Доступ: OpenAI API, Microsoft Azure и AWS Bedrock; вместе с моделью обновлена обвязка Codex.
Порядок раскатки в пересказах перевёрнут. Сначала доступ получило ограниченное число организаций, и только затем — подписчики ChatGPT Plus, Pro, Business и Enterprise; расширение на программу Daybreak OpenAI обещает «в ближайшие недели», то есть позже, а не раньше. Daybreak — не «крупные корпоративные партнёры», а заявочная программа для специалистов по защитной кибербезопасности: её участники получают версию с ослабленными ограничениями для валидации уязвимостей, анализа вредоносного ПО и detection engineering. Публичная версия, наоборот, отказывается писать PoC-эксплойты и решать продвинутые наступательные задачи: Astra — первая модель, отнесённая OpenAI по собственному Preparedness Framework к уровню «Critical» по кибербезопасности.
Три расхожих утверждения мы снимаем. «Расширенный аудит по стандартам CISA в ответ на давление Конгресса» не подтверждается ничем. Фраза Грега Брокмана «Welcome to the AGI era» держится только на пересказах СМИ — ни записи, ни транскрипта, ни поста официального аккаунта под неё нет. Задержка запуска «из-за инцидента с Hugging Face в июле» тоже выдумана: инцидент упоминается у OpenAI как повод для новой оценки (GPT-5.6 Sol выходил за разрешённые границы в 48% случаев, Astra — в 0%), про перенос релиза не сказано. И оговорка для крипто-читателя: агент, умеющий кликать интерфейсы, уязвим к prompt injection — страница или dApp могут содержать текст, который агент прочитает как команду. Автономная подпись транзакций такой связке не по зубам без изоляции ключей и подтверждения каждой операции человеком.
Из той же рубрики
Биткоин дошёл до $87K и впервые за 45 недель закрылся выше 50-недельной средней
Ралли риск-активов вынесло биткоин к $87 447 в понедельник 21 сентября, и во вторник торги открылись на $86 597 — на 6,7% выше предыдущего дня. От минимума 15 сентября BTC прибавил 15,6%, а недельная свеча 20 сентября впервые за 45 недель закрылась выше 50-недельной скользящей средней.
5 источников
Бонусного множителя Entropy не обещала: поинтов у биржи нет вовсе, а лидерборд — обычная таблица PnL трейдеров
Сам [лидерборд](https://entropy.io/leaderboard) существует: сто строк с реализованным PnL и объёмом за 1, 7 и 30 дней. Но поинт-программы у Entropy нет — разделы /points и /rewards отдают 404, а в документации нет ни поинтов, ни ретродропа, ни множителей. Фраза про бонусный множитель — домысел.
4 источника
Xiaomi открыла под MIT триллионную MiMo-V2.6 Pro и 309B Flash вместе с RL-пайплайном
Pro — 1,02 трлн параметров MoE с 42B активных и 46 баллами в Artificial Analysis Intelligence Index, Flash — 309B с 15B активных. Обе омнимодальные, держат контекст 1 млн токенов и лежат на Hugging Face под MIT вместе с 7000+ RL-окружений, RL-фреймворком и дистиллятом MiMo-V2.6-Distill-Qwen-9B.
4 источника