
OpenAI начала развёртывание GPT-6 Astra — новой флагманской модели, которая, по заявлениям компании, призвана составить конкуренцию Claude Fable 5 от Anthropic. Пока доступ к Astra открыт ограниченному кругу организаций, но в ближайшие дни его получат все пользователи ChatGPT Plus, Pro, Business и Enterprise, а также разработчики через API OpenAI и AWS.
Ценообразование и позиционирование
Стоимость использования GPT-6 Astra через API установлена на уровне Claude Fable 5 и 5.1: 10 долларов за миллион токенов на входе и 50 долларов за миллион на выходе. Таким образом, OpenAI прямо позиционирует Astra как ответ на Fable. По собственным бенчмаркам компании, новая модель показывает более высокие результаты, чем Fable, в большинстве тестов.
Однако независимая оценка от Artificial Analysis рисует более сложную картину. В их Индексе интеллекта GPT-6 Astra набрал 61 балл — столько же, сколько предшественник GPT-5.6 Sol. Это на 5 баллов ниже, чем у Claude Fable 5.1 (максимум с fallback), и ниже, чем у недавно выпущенной Meta Muse Spark 1.3.
Рекордный результат в ARC-AGI 3, но с нюансом
Одним из самых ярких достижений Astra стало попадание в 99,9% на бенчмарке ARC-AGI 3, выпущенном в марте 2026 года. Для сравнения, GPT-5.6 Sol показал 78,5%. Однако, как отмечает блог ARC-AGI, этот результат был достигнут с использованием кастомной обвязки OpenAI — «Provider Adapter harness», которая обошлась в 19 000 долларов. При использовании стандартного ARC-AGI harness результат составил 62,7% при затратах 26 000 долларов.
Provider Adapter harness сохраняет непрозрачное состояние рассуждений между запросами и использует компактификацию для длительных диалогов, что позволяет модели переиспользовать предыдущие вычисления. Это означает, что в реальных условиях, без специальной обвязки, производительность может быть значительно ниже.
Безопасность и эксплуатация уязвимостей: сильная сторона
Учитывая недавний инцидент с Hugging Face, неудивительно, что Astra показывает выдающиеся результаты в задачах безопасности:
– ExploitBench: 100% (GPT-5.6 Sol — 78,5%)
– ExploitGym: 42,4% (Sol — 30,3%)
– SRE-Bench (бинарный реверс-инжиниринг): 99,2% в пределах четырёх попыток (Sol — 68,7%)
Эти результаты указывают на то, что Astra может стать мощным инструментом для специалистов по кибербезопасности, особенно в задачах поиска и эксплуатации уязвимостей.
Длинный контекст: прогресс налицо
OpenAI, похоже, удалось решить одну из давних проблем с обработкой длинного контекста. В собственном бенчмарке «восемь иголок» Astra показала 100% на длине контекста от 256K до 512K токенов и 96,3% на отрезке от 512K до 1M токенов. Это значительный прогресс по сравнению с предыдущими моделями, которые часто теряли информацию в середине длинных документов.
Кодинг: лучше, чем Sol, но дешевле, чем Fable
В Индексе кодинговых агентов от Artificial Analysis GPT-6 Astra занимает лидирующую позицию на границе эффективности затрат. При максимальном усилии модель стоит примерно столько же, сколько GPT-5.6 Sol (макс), но набирает на 2 балла больше. По сравнению с Claude Fable 5, Astra предлагает ту же производительность за менее чем половину стоимости на задачу.
Технические детали и доступность
API-метка модели после развёртывания будет gpt-6-astra. Блог OpenAI на момент написания статьи был недоступен (ошибка 500), однако зеркало анонса доступно по ссылке через Hacker News.
Что пока не подтверждено
На момент публикации у автора исходного материала (Simon Willison) не было доступа к модели для самостоятельного тестирования. Все результаты, кроме данных Artificial Analysis, основаны на собственных бенчмарках OpenAI, что требует осторожности при интерпретации. Также нет опубликованных результатов Claude Fable 5 на ARC-AGI 3, что не позволяет провести прямое сравнение в этом ключевом тесте.
Основные характеристики GPT-6 Astra
Параметр | Значение | Примечание
— | — | —
Цена API (вход) | $10/1M токенов | На уровне Claude Fable 5/5.1
Цена API (выход) | $50/1M токенов | На уровне Claude Fable 5/5.1
ARC-AGI 3 (кастом) | 99,9% | С Provider Adapter harness, $19K
ARC-AGI 3 (стандарт) | 62,7% | Стандартный harness, $26K
ExploitBench | 100% | Против 78,5% у GPT-5.6 Sol
Индекс интеллекта (AA) | 61 | Равно GPT-5.6 Sol, ниже Fable 5.1
Длинный контекст (до 512K) | 100% | Восемь иголок, собственный бенчмарк
Для кого это важно
Новость напрямую касается разработчиков, специалистов по безопасности и всех, кто работает с LLM. Для русскоязычного сообщества, интересующегося AI, это сигнал о том, что конкуренция между OpenAI и Anthropic усиливается, а цены на топовые модели стабилизируются на уровне $10/$50 за миллион токенов.
Практический совет: если вы используете API для задач кодинга, Astra может оказаться более выгодной альтернативой Claude Fable 5. Однако для задач, требующих максимального «интеллекта» (сложные рассуждения, анализ), Fable 5.1 пока остаётся предпочтительным выбором.
Источник: Simon Willison — https://simonwillison.net/2026/Sep/3/gpt6-astra/
Datos clave
| Punto | Detalle |
|---|---|
| Fuente | Simon Willison |
| Fecha | 2026-09-03T20:18:41+00:00 |
| Tema | GPT‑6 Astra |
