интегром_
бизнес на автопилоте
инициализация... 0%
📞 +7 929-095-63-93 ✉️ ai@integrom.ru
~9 мин чтения

GPT-6 Astra против Claude: что на самом деле показывают бенчмарки в сентябре 2026

GPT-6 Astra против Claude — сравнение моделей 2026

3 сентября 2026 года OpenAI выпустила GPT-6 Astra. У Anthropic уже есть своя актуальная линейка — Claude Fable 5.1, Claude Opus 5, Claude Sonnet 5 и Claude Haiku 4.5. Разберём по фактам: что показывают бенчмарки, где они реально сопоставимы, а где сравнивать нельзя в принципе, и что из этого важно для разработчика 1С-Битрикс, бизнеса и SEO-специалиста.

Оговорка о методике: большинство чисел ниже публикуют сами вендоры, в том числе в таблицах с моделью конкурента. Ни OpenAI, ни Anthropic не прогоняли модель соперника независимо и одновременно со своей — кросс-вендорные таблицы стоит читать как «заявлено производителем», а не как объективную истину. Там, где нашлась по-настоящему независимая точка сравнения — краудсорс-рейтинг arena.ai — это отмечено отдельно.

Что такое GPT-6 Astra и когда вышла

GPT-6 Astra — новая флагманская модель OpenAI, анонс и раскатка начались 3 сентября 2026 года. Сначала доступ получил ограниченный круг организаций, затем в течение нескольких дней — все подписчики ChatGPT Plus, Pro, Business и Enterprise, а также клиенты OpenAI API, Microsoft Azure и AWS Bedrock. Раскатка растянулась во времени, потому что модель впервые задействует новые системы в промышленном масштабе. В Enterprise-пространствах Astra по умолчанию выключена — включает администратор.

Технически: контекст 1 050 000 токенов (до 922 000 — вход, до 128 000 — выход), вход текст и изображение, выход только текст, knowledge cutoff — 30 апреля 2026. Поддерживается reasoning с пятью уровнями усилия (low…max) и набор агентных инструментов Responses API: веб-поиск, файловый поиск, генерация изображений, code interpreter, hosted shell, apply patch, computer use, MCP.

Бесплатного доступа к Astra нет: модель недоступна на тарифах Free ($0) и Go ($8/мес), доступна начиная с Plus ($20/мес), а на Pro (от $100/мес) — расширенный режим GPT-6 Astra Pro с увеличенными лимитами.

Актуальная линейка Claude на сентябрь 2026

У Anthropic на эту дату в статусе Active/GA четыре модели: Claude Fable 5.1 (контекст 1M, вывод до 128K, thinking включён всегда), Claude Opus 5 (тот же контекст, thinking адаптивный), Claude Sonnet 5 и компактный Claude Haiku 4.5 (контекст 200K). По приглашению в рамках Project Glasswing доступна Claude Mythos 5.1.

Почему Anthropic советует Opus 5, а не «топовую» Fable 5.1 по умолчанию

Интуитивно кажется, что раз Fable 5.1 — самая новая и «сильная» модель линейки, её и нужно использовать всегда. Но сама Anthropic рекомендует Claude Opus 5 «для большинства задач», а Fable 5.1 — только «для требовательного ризонинга и длинных агентных сценариев, или когда оценки на Opus 5 при повышенном effort всё ещё не дотягивают». Топ-модель — осознанный выбор для сложных случаев, а не дефолт.

Цены и экономика: API, кэш, подписки

По базовым ставкам API GPT-6 Astra и Claude Fable 5.1 стоят одинаково — $10 за 1M входных и $50 за 1M выходных токенов. Claude Opus 5 вдвое дешевле — $5 / $25 за 1M.

МодельВход, $/1MКэш-чтение, $/1MВыход, $/1M
GPT-6 Astra101.0050
Claude Fable 5.1100.2550
Claude Opus 550.5025
Claude Sonnet 520.2010

Скрытая разница в цене кэш-чтения — почему паритет $10/$50 обманчив

Номинальный паритет цен на вход/выход у Astra и Fable 5.1 маскирует разницу в другом месте: кэш-чтение у GPT-6 Astra стоит $1.00 за 1M токенов, а у Claude Fable 5.1 — $0.25, в 4 раза дешевле. Для разового запроса это несущественно, но для агентных сценариев, которые многократно перечитывают один и тот же контекст задачи (так работают автоматизации на платформах вроде OpenClaw), разница накапливается. Независимые наблюдатели советуют считать стоимость не за токен, а за законченную задачу — более дешёвая модель с бóльшим числом повторов иногда оказывается дороже.

Подписки устроены по-разному. У OpenAI Astra недоступна на Free и Go, только с Plus ($20/мес) и выше. У Anthropic Claude Pro стоит $17–20/мес и включает Claude Code, Max — от $100/мес с кратно бóльшими лимитами. В приложении Claude.ai контекст ограничен 200K токенов независимо от лимита модели в API, а доступ к Fable-моделям на подписке — не более 50% от недельного лимита.

Бенчмарки: где выигрывает кто и почему это сложнее, чем кажется

В таблице OpenAI Astra выигрывает на Terminal-Bench 4.0 (57.9% против 55.8% у Fable 5.1), FrontierMath Tier 4 (97.6% против 87.8%), GPQA Diamond (96.0% против 93.7%) и OSWorld 2.0 (72.6% против 70.2% у Opus 5). Но по Artificial Analysis Intelligence Index впереди Fable 5.1 (65.7 против 61.2), и по Humanity's Last Exam с инструментами тоже (65.0% против 57.2%) — признаёт даже таблица OpenAI.

Ловушка SWE-bench Verified vs DeepSWE

Здесь стоит быть внимательнее всего. OpenAI не публикует для GPT-6 Astra результат SWE-bench Verified — отраслевого бенчмарка кодинга на 500 задачах, — а приводит число по другому тесту, DeepSWE v1.1 (74.1%). У Claude Opus 5 по системной карте Anthropic SWE-bench Verified — 96.0%. Ставить эти числа рядом, как будто это одна шкала — методологическая ошибка: корректно сравнивать либо DeepSWE-числа между собой (Astra 74.1% против Opus 5 73.7–74.1% и Fable 5.1 67.4%), либо явно писать, что у Astra нет опубликованного SWE-bench Verified.

Единственный независимый прямой рейтинг — arena.ai

Все таблицы выше — вендорские. Единственный источник, где обе модели сравниваются напрямую в системе, не контролируемой ни одним из вендоров — краудсорс-рейтинг arena.ai (голосования пользователей за анонимные ответы). На срезе 15.09.2026 в общем агентном зачёте лидирует Claude Fable 5.1 (13.90% побед), GPT-6 Astra — на втором месте (11.90%). Зато в WebDev и Image-to-WebDev (веб-разработка по картинке-макету) первое место у GPT-6 Astra, с заметным отрывом. Это единственная категория, где независимый рейтинг подтверждает лидерство Astra. Оговорка: голоса отражают предпочтение стиля ответа, а не объективную правильность — ограничение любых Arena-подобных рейтингов.

Codex vs Claude Code — инструменты, а не только модели

Отдельно от моделей стоит агентный кодинг-инструментарий: Codex у OpenAI и Claude Code у Anthropic. Codex доступен в ChatGPT, IDE-расширении и CLI, с кредитной тарификацией — токены Astra в Codex в 2.5 раза дороже, чем GPT-5.6 Sol, которая остаётся моделью по умолчанию для облачных задач, не Astra. Claude Code работает в терминале, IDE, Slack и вебе, входит в подписку Claude.ai от Pro. Оба вендора приводят цитаты корпоративных клиентов — это маркетинг, а не независимые бенчмарки инструментов.

Безопасность и приватность: Critical-кибербезопасность Astra против ASL-3 у Claude

GPT-6 Astra — первая модель OpenAI, достигшая уровня Critical по кибербезопасности во внутренней шкале Preparedness Framework: по заявлению компании, с подходящими инструментами модель способна находить неизвестные уязвимости и разрабатывать эксплойты без участия человека. В релизной версии она отказывается писать proof-of-concept эксплойты; расширенный доступ — через ограниченную программу Daybreak.

Claude Opus 5 развёрнут с защитами уровня ASL-3 и по данным независимого бенчмарка indirect prompt injection (IPI, с UK AI Security Institute, US CAISI и Gray Swan) показал лучшую устойчивость среди протестированных моделей — 2.0% успешных атак за 15 попыток против 20.0% у GPT-5.6 Sol. Оговорка: Astra в этом тесте не участвовала, переносить вывод на неё напрямую нельзя — сравнение актуально только для линейки GPT-5.6.

Что выбрать: практическая матрица

ПрофильРекомендация
Разработчик 1С-Битрикс / Bitrix24Claude Opus 5 — вдвое дешевле Astra, есть Claude Code. Astra — точечно для браузерной автоматизации.
ПредпринимательClaude Pro ($17–20/мес) с Claude Code в комплекте. ChatGPT Plus ($20/мес) — сопоставимая цена и доступ к Astra.
SEO-специалистЧерез API — Claude Sonnet 5 ($2/$10); в приложении Claude.ai контекст урезан до 200K независимо от модели.
Автоматизация на OpenClawFable 5.1 / Opus 5 — экономика кэша при повторных вызовах; Astra — кандидат для задач, где ИИ работает через интерфейс сайта или программы; нужны подключённые инструменты и разрешения. Claude тоже поддерживает работу через интерфейсы — управление компьютером не появляется автоматически от смены модели.

Для российской аудитории общее ограничение: ни OpenAI, ни Anthropic не продают подписки и API-доступ напрямую пользователям из РФ — доступ идёт через посредников, с задержкой и наценкой. Это касается обеих моделей одинаково.

Что мы ещё не знаем

Независимых бенчмарков качества работы с русским языком (MERA, RussianSuperGLUE и аналоги) на дату материала не найдено ни для Astra, ни для линейки Claude — оценивать модели на русском можно только на собственных задачах. Независимая перепроверка бенчмарков Astra спустя 12 дней после релиза практически отсутствует. А прямого спроса на запрос «GPT-6 Astra vs Claude» пока нет: тема свежая, аудитория ищет общими фразами вроде «какая нейросеть лучше» или названием модели по отдельности.

Частые вопросы

GPT-6 Astra — флагманская модель OpenAI, анонсированная 3 сентября 2026 года. Контекст 1 050 000 токенов, вход текст и изображение, выход только текст, полный набор агентных инструментов Responses API (computer use, hosted shell, apply patch и другие). Это первая модель OpenAI, достигшая уровня Critical по кибербезопасности во внутренней шкале Preparedness Framework.
Базовые ставки на вход/выход у GPT-6 Astra и Claude Fable 5.1 одинаковые — $10 / $50 за 1M токенов. Но кэш-чтение у Astra стоит $1.00 за 1M, а у Fable 5.1 — $0.25, в 4 раза дешевле. Claude Opus 5 вдвое дешевле Astra по базовым ставкам — $5 / $25 за 1M.
Нет. OpenAI не публикует для GPT-6 Astra результат SWE-bench Verified — только DeepSWE v1.1 (74.1%). У Claude Opus 5 SWE-bench Verified — 96.0%. Это разные бенчмарки с разной методикой, ставить их проценты рядом как одну шкалу — методологическая ошибка.
Для большинства задач разработки — Claude Opus 5: вдвое дешевле Astra на тех же токенах и поддерживает Claude Code для работы в кодовой базе. GPT-6 Astra стоит рассматривать точечно для задач с браузерной автоматизацией — computer use в легаси-интерфейсах без API.
Нет. Ни OpenAI, ни Anthropic не продают подписки и API-доступ напрямую пользователям из РФ — доступ идёт через посредников и агрегаторов, с задержкой и наценкой. Это ограничение одинаково для обеих моделей.
← Ко всем статьям

Комментарии

// пока нет комментариев — будьте первым

Оставить комментарий

Комментарии публикуются после проверки модератором.

Хотите автоматизировать процессы с помощью ИИ и Битрикс?

Расскажите о задаче — разберём, что имеет смысл внедрить в первую очередь, и как сделать это безопасно.