GPT-6 Astra против Claude Fable 5.1: те же $10/$50, 61 против 66

GPT-6 Astra и Claude Fable 5.1 берут одинаковую цену за токен. На Artificial Analysis у Fable 5.1 66 баллов, у Astra 61. Где каждая всё же выигрывает.

GPT-6 Astra против Claude Fable 5.1: те же $10/$50, 61 против 66

GPT-6 Astra и Claude Fable 5.1 стоят абсолютно одинаково за токен: $10.00 на входе, $50.00 на выходе. На Artificial Analysis Intelligence Index у Fable 5.1 66 баллов, у Astra 61. OpenAI выпустила Astra 3 сентября 2026 года с набором сильных агентных бенчмарков. Сторонний композит рассказывает другую историю, и перед миграцией стоит прочитать обе.

Коротко

  • Одинаковый прейскурант. По $10 / $50 за миллион у обеих. Экономии на токене нет ни в одну сторону.
  • Чтение кеша не одинаково. Fable 5.1 читает кеш по $0.25 за миллион на Ofox; OpenAI указывает кешированный вход Astra в $1.00. Вчетверо дороже на той части агентного цикла, которая повторяется чаще всего.
  • Fable 5.1 ведёт в композите на пять баллов, 66 против 61 при максимальном усилии. Astra на 8-м месте из 202 на этом индексе.
  • Astra лидирует на бенчмарках, выбранных OpenAI, и они агентные: работа с компьютером, поиск уязвимостей, фронтирная математика.
  • Уровень max у Astra стоит примерно вдвое дороже high ради одного балла. 61 против 60, $3 013 против $1 429 за прогон того же индекса.

Цены одинаковы. Дёшево кешировать только у одной.

Ставка за 1M токеновGPT-6 AstraClaude Fable 5.1
Вход$10.00$10.00
Выход$50.00$50.00
Чтение кешированного входа$1.00$0.25
Fast-режим, вход / выход$20 / $100не предлагается
Контекстное окно1.1M1M
Максимальный вывод128K128K
Граница знанийапрель 2026

Стандартные и Fast-ставки Astra — опубликованные OpenAI стартовые цены; контекст 1.1M, потолок вывода 128K и граница знаний за апрель 2026 года взяты из её спецификации модели. Ставки Fable 5.1 — живой каталог Ofox, где anthropic/claude-fable-5.1 читает кешированный вход по $0.25 за миллион; ставки Astra на Ofox совпадают с прейскурантом OpenAI, кешированный вход $1.00. Оба перечитаны 5 сентября 2026 года.

Строка кеша — та, что двигает реальный счёт. Агентные циклы переотправляют один и тот же системный промпт, определения инструментов и историю разговора на каждом ходу, поэтому кешированный вход обычно оказывается самой крупной строкой в длительной задаче. При $1.00 против $0.25 тот же кешированный контекст обходится на Astra вчетверо дороже. В сравнении прейскурантов это невидимо, в месячном счёте — очень заметно.

Что говорит независимый индекс

Artificial Analysis оценивает GPT-6 Astra в 61, а Claude Fable 5.1 в 66. Intelligence Index у AA — композит из девяти оценок: GDPval-AA v2, 𝜏³-Banking, Terminal-Bench v2.1, SciCode, Humanity’s Last Exam, GPQA Diamond, CritPt, AA-Omniscience и AA-LCR. Вот где оказывается Astra:

МестоМодельИндексСтоимость задачи
1Claude Fable 5.1 (max)66$3.69
2Claude Fable 5.1 (xhigh)65$2.65
3Claude Opus 5 (max)63$2.34
4Claude Opus 5 (xhigh)63$1.80
5Claude Fable 5.1 (high)62$1.43
6Muse Spark 1.3 (max)62
7Claude Fable 562$3.14
8GPT-6 Astra (max)61$1.67
Claude Opus 5 (high)61$1.23
Muse Spark 1.3 (xhigh)61$0.55
GPT-6 Astra (high)60$0.96

Прочитано из Artificial Analysis 4 сентября 2026 года. Astra — 8-я из 202 моделей, что в абсолютном выражении сильная позиция, а в контексте — вполне конкретная: каждая модель выше является вариантом Claude или Muse Spark.

Два сравнения в этой таблице важнее самого рейтинга.

При одинаковом балле Astra не дешёвый вариант. На отметке 61 стоят три конфигурации: Astra max за $1.67 за задачу, Claude Opus 5 high за $1.23 и Muse Spark 1.3 xhigh за $0.55. Astra стоит втрое дороже самого дешёвого способа получить тот же измеренный балл.

При одинаковой цене Astra не сильный вариант. Fable 5.1 берёт те же $10 / $50 и набирает на пять баллов больше.

Что опубликовала OpenAI и почему это не то же самое утверждение

Стартовые цифры OpenAI реальны и в основном агентные:

БенчмаркGPT-6 Astra
OSWorld 2.0 (работа с компьютером)72.6%
FrontierMath Tier 4 v297.6%
GPQA Diamond96.0%
Terminal-Bench 4.057.9%
ExploitBench100.0%
ExploitGym42.4%
SRE-Bench (одна попытка)88.0%
ARC-AGI-3 (адаптерный harness)99.9%
Humanity’s Last Exam с инструментами57.2%

Это заявлено вендором, на выбранных вендором бенчмарках, и к некоторым приложена оговорка: 99.9% на ARC-AGI-3 — это «адаптерный harness», а 57.2% на Humanity’s Last Exam — «с инструментами». Ни одна оговорка не является изъяном, но обе меняют смысл числа, и ни одно из них не сравнимо напрямую со сторонним прогоном той же оценки.

Оговорка про ARC-AGI-3 оказывается важнее большинства: собственный стандартный harness ARC Prize даёт той же модели 62.7%, разброс в 37 пунктов на одном бенчмарке. Наш обзор разбирает, почему оба числа законны и что этот разрыв на самом деле измеряет.

Честное прочтение в том, что они измеряют разное. Индекс AA взвешивает общее рассуждение, поиск по длинному контексту и знания. Подборка OpenAI взвешивает работу с компьютером, терминал, инструменты безопасности и математику. Модель может лидировать в одном и отставать в другом, и ни один из индексов при этом не ошибается, а какой из них предскажет ваши результаты, зависит от того, что вы реально запускаете.

Уровни самой Astra противоречат друг другу

Один балл индекса стоит примерно вдвое дороже.

Уровень AstraИндексСтоимость прогона индекса AAСтоимость задачиВыходные токены
max61$3 013.30$1.6742M
high60$1 429.26$0.9616M

Max пишет в 2.6 раза больше выходных токенов, чем high, и обходится в 2.1 раза дороже на всём индексе — ради одного балла. Это тот же паттерн, что Gemini 3.8 Flash показала против 3.7 Flash, где более новая модель тратила на 30% больше выходных токенов по той же ставке: настройка усилия — это множитель цены, и верхняя настройка редко оказывается выгодной.

Прежде чем ставить max по умолчанию для производственной нагрузки, прогоните обе на своих задачах и проверьте, существует ли там этот балл. На смеси AA это один балл из 61; на более узкой нагрузке он может оказаться нулём.

Когда выбирать GPT-6 Astra

  • Работа с компьютером и автоматизация терминала. 72.6% на OSWorld 2.0 и 57.9% на Terminal-Bench 4.0 — это цифры, с которых OpenAI начала, и именно на этот класс нагрузок модель позиционировалась.
  • Безопасность и работа с эксплойтами. 100% на ExploitBench и 88% на SRE-Bench с одной попытки конкретны, и сопоставимого стороннего композита, покрывающего эту область, нет.
  • Вам нужен Fast-режим. $20 / $100 за скорость до 2.5x — это рычаг задержки, которого Fable 5.1 не предлагает ни за какие деньги.
  • Вы уже на Bedrock. Astra поддерживается там с момента запуска.

Когда остаться на Claude Fable 5.1

  • Общее рассуждение за ту же цену. Пять баллов индекса за те же $10 / $50 — самый ясный аргумент в этом сравнении.
  • Агентные циклы с большим объёмом кеша. $0.25 против $1.00 за миллион кешированных входных токенов, на статье, которая быстрее всего растёт у долго работающего агента. anthropic/claude-fable-5.1 и openai/gpt-6-astra с 5 сентября 2026 года обе есть в каталоге Ofox, так что это A/B на одну строку, а не ожидание.

Если ограничение — бюджет, ответ не в этих двух

Обе эти модели стоят $50 за миллион выходных. Если задаче не нужны 61 или 66, тот же индекс предлагает более дешёвые способы подойти близко: Claude Opus 5 за $5 / $25 набирает 63 на max, что на два балла выше Astra при вдвое меньшей цене за токен. Opus 5 против GPT-5.6 Sol разбирает этот класс, а руководство по уровням GPT-5.6 — предыдущее поколение OpenAI, которое по-прежнему стоит $5 / $30, а не $10 / $50.

Это стоит сказать прямо: GPT-6 Astra удвоила входную цену собственного флагмана OpenAI и подняла выход на две трети, с $5 / $30 у GPT-5.6 Sol. Решение об апгрейде внутри линейки OpenAI — это другой вопрос, и у него свой ответ. Полный тариф Astra охватывает Fast-режим, кеш-уровень и стоимость задачи на каждом уровне усилия.

Запустить A/B сегодня

from openai import OpenAI

client = OpenAI(base_url="https://api.ofox.ai/v1", api_key="YOUR_OFOX_API_KEY")

r = client.chat.completions.create(
    model="anthropic/claude-fable-5.1",
    messages=[{"role": "user", "content": "Refactor this function to remove the nested loop."}],
)
print(r.usage)

Замените строку модели на openai/gpt-6-astra и запустите снова: обе находятся на одном эндпоинте с одинаковыми параметрами, так что сравнение стоит одной строки. Источником истины о том, что вызывается, остаётся GET https://api.ofox.ai/v1/models.

Источники

Оценки индекса Artificial Analysis, стоимость задачи и стоимость прогона индекса прочитаны 4 сентября 2026 года. Таблица бенчмарков GPT-6 Astra — стартовые цифры OpenAI, опубликованные 3 сентября 2026 года. Ставки Ofox для обеих моделей прочитаны из живого эндпоинта /v1/models 5 сентября 2026 года, в день появления GPT-6 Astra в каталоге.

Часто задаваемые вопросы

GPT-6 Astra дороже Claude Fable 5.1?
Не по прейскуранту. Обе стоят $10.00 за миллион входных токенов и $50.00 за миллион выходных. Разница в чтении кеша: Fable 5.1 читает кешированный вход по $0.25 за миллион на Ofox, тогда как OpenAI оценивает кешированный вход GPT-6 Astra в $1.00 за миллион, вчетверо дороже. На агентном цикле с большим объёмом кеша этот разрыв накапливается.
Кто набирает больше, GPT-6 Astra или Claude Fable 5.1?
Claude Fable 5.1, на Artificial Analysis Intelligence Index. Fable 5.1 при максимальном усилии набирает 66, GPT-6 Astra при максимальном — 61, разрыв в пять баллов при одинаковой цене за токен. Astra занимает 8-е место из 202 моделей на этом индексе; все семь моделей выше — варианты Claude и Muse Spark.
На каких бенчмарках лидирует GPT-6 Astra?
На тех, что OpenAI опубликовала при запуске, и они в основном агентные и связаны с использованием инструментов, а не с общим рассуждением: 72.6% на OSWorld 2.0 по работе с компьютером, 97.6% на FrontierMath Tier 4 v2, 96.0% на GPQA Diamond, 100% на ExploitBench и 99.9% на ARC-AGI-3 с адаптерным harness. Это заявленные вендором цифры на выбранных вендором бенчмарках, что отличается от стороннего композитного индекса.
Доступна ли GPT-6 Astra через Ofox?
Да, с 5 сентября 2026 года как openai/gpt-6-astra по $10.00 за вход и $50.00 за выход при чтении кеша $1.00. anthropic/claude-fable-5.1 есть в том же каталоге по той же прейскурантной цене, но с чтением кеша по $0.25. Проверяйте GET /v1/models для актуального списка, а не исходите из этой страницы.
Стоит ли переходить с Claude Fable 5.1 на GPT-6 Astra?
Не ради цены, потому что ставки одинаковы, а чтение кеша у Astra дороже. Переходите, если нагрузка — работа с компьютером, автоматизация терминала или инструменты безопасности, где OpenAI опубликовала конкретные сильные цифры. Оставайтесь, если нагрузка — общее рассуждение и работа с длинным контекстом, где независимый индекс сейчас отдаёт Fable 5.1 пять баллов при той же цене.
В чём разница между max и high у GPT-6 Astra?
Один балл измеренного интеллекта и примерно двойная стоимость. Artificial Analysis оценила Astra в 61 на max и 60 на high, потратив на прогон индекса $3 013.30 на max против $1 429.26 на high, при 42M выходных токенов против 16M. Если вы платите за max, проверьте, что этот один балл реален на ваших собственных задачах.