GPT-6 Astra в ApiMira - цена в рублях, лимит контекста и готовый код
GPT-6 Astra доступна по общему ключу ApiMira - 41,68 ₽ за миллион входных токенов и 187,59 ₽ за миллион выходных. Где она обгоняет Claude Fable 5.1, что убрать из запроса при переезде и почему без стриминга она ломает таймауты.
OpenAI выпустила GPT-6 Astra - модель под длинные агентные прогоны, работу в терминале, браузере и чужом софте. В каталоге ApiMira она уже есть, работает по общему балансу и тому же ключу, что остальные модели, без VPN и подписки.
Цена и параметры в ApiMira
ID модели -
openai/gpt-6-astraВход - 41,68 ₽ за 1M токенов
Кэш-вход - 3,50 ₽ за 1M токенов
Выход - 187,59 ₽ за 1M токенов
Контекст - до 250 000 входных токенов в одном запросе
Картинки на вход - поддерживаются
Для сравнения, Claude Fable 5.1 в каталоге стоит 190,09 ₽ на входе и 861,43 ₽ на выходе. Astra примерно в 4,6 раза дешевле с обеих сторон.
Отдельно про кэш. Повторяющееся начало запроса считается по ставке 3,50 ₽ вместо 41,68 ₽ - почти в двенадцать раз дешевле. Для агента с длинным системным промптом и историей диалога это главная статья экономии, и включать её не нужно, скидка применяется автоматически.
Прайс за миллион токенов ничего не решает
Цена токена у Astra выше, чем у прошлого поколения, но на задачу она тратит заметно меньше выходных токенов. На Terminal-Bench Science 0.1 это 64,6 % против 52,6 % у Claude Fable 5.1 при примерно на 31 % меньшей стоимости прогона, на BenchCAD - на 43 % дешевле GPT-5.6 Sol, на Agents' Last Exam - примерно на 65 % меньше выходных токенов, чем у Claude Opus 5.
Вывод практический. Сравнивайте не прайс, а стоимость решённой задачи на своём наборе запросов. На одном ключе ApiMira это делается за один вечер, переключением строки с именем модели.
Где Astra выигрывает
Цифры из таблицы OpenAI, максимум по любому уровню усилий, вторая колонка - GPT-5.6 Sol.
Terminal-Bench 4.0 - 57,9 % против 37,3 %
ARC-AGI-3 - 99,9 % против 7,8 %
ScreenSpot-Pro - 92,7 % против 76,9 %
OSWorld 2.0 - 72,6 % против 65,7 %
FrontierMath Tier 4 - 97,6 % против 83,0 %
MRCR v2, восемь иголок на отрезке 512K-1M - 96,3 % против 73,8 %
ExploitBench - 100 % против 78,5 %
Две строки стоит прочитать внимательнее. ARC-AGI-3 с разрывом почти в тринадцать раз - это про способность действовать в незнакомой среде без подсказки. MRCR на длинном отрезке - про то, что модель реально находит нужное в большом контексте, а не делает вид.
Где Astra не первая
Humanity's Last Exam с инструментами - 57,2 % против 65,0 % у Claude Fable 5.1
Artificial Analysis Intelligence Index - 61,2 против 65,7 у Claude Fable 5.1
Artificial Analysis Coding Agent Index - 67,0 против 68,1 у Claude Fable 5
FrontierCode 1.1 Main - 53,3 % против 53,5 % у Claude Fable 5
Профиль читается однозначно. Astra берёт там, где нужно долго и аккуратно действовать - терминал, браузер, длинный контекст, наука. В сводных индексах «чистого ума» впереди линейка Claude. Ставить одну модель на всё не нужно, тем более что в ApiMira обе линейки живут на одном балансе.
Что поправить в запросе
temperature,top_pиlogprobsэта модель не принимает - уберите их из тела запросавызов инструментов у Astra идёт через Responses API, у нас это адрес
/v1/responses, обычный/v1/chat/completionsвернёт текст без вызовазапрос длиннее 250 000 входных токенов шлюз отклонит с ошибкой
context_length_exceeded- режьте историю или разбивайте задачумодель думает десятками минут, поэтому стриминг обязателен, а таймаут клиента считайте в минутах, а не в секундах
Ещё одна особенность поведения. Astra чаще останавливается и задаёт уточняющий вопрос там, где прошлые модели молча делали допущение. В интерактивном чате это плюс, в ночном пайплайне - источник зависших задач. Лечится системным промптом в духе «запрос считай разрешением действовать и доводи работу до конца».
Стриминг, минимальный рабочий пример
const BUDGET_MS = 15 * 60 * 1000
export async function askAstra(messages, onDelta) {
const res = await fetch('https://apimira.com/v1/chat/completions', {
method: 'POST',
headers: {
Authorization: `Bearer ${process.env.APIMIRA_API_KEY}`,
'Content-Type': 'application/json',
},
body: JSON.stringify({
model: process.env.MODEL_SMART ?? 'openai/gpt-6-astra',
stream: true,
messages,
}),
signal: AbortSignal.timeout(BUDGET_MS),
})
const decoder = new TextDecoder()
let buffer = ''
for await (const chunk of res.body) {
buffer += decoder.decode(chunk, { stream: true })
const lines = buffer.split('\n')
buffer = lines.pop() ?? ''
for (const line of lines) {
const s = line.trim()
if (!s || s.startsWith(':')) continue // служебная строка, не данные
if (s === 'data: [DONE]') return
if (!s.startsWith('data: ')) continue
const delta = JSON.parse(s.slice(6)).choices[0]?.delta?.content
if (delta) onDelta(delta)
}
}
}Имя модели держите в переменной окружения. Тогда переезд на следующую модель - одна строка в конфиге, а не правка кода.
Линейка OpenAI рядом, цены за 1M токенов
GPT-5.6 Sol - 56,69 ₽ вход и 331,83 ₽ выход, флагман под код и агентные циклы
GPT-5.6 Terra - 25,01 ₽ и 166,75 ₽, средний тир
GPT-5.6 Luna - 12,08 ₽ и 74,53 ₽, под массовую нагрузку
GPT-5.3 Codex - 24,92 ₽ и 235,11 ₽, под Codex CLI и агентные правки в репозитории
Оплата российскими картами в рублях, без подписки, платите за токены. Все цены и статус каждой модели - на странице каталога.
Коротко
Какой у модели идентификатор
openai/gpt-6-astra. Адрес шлюза - https://apimira.com/v1, протокол OpenAI-совместимый, ключ передаётся заголовком Authorization.
Сколько стоит запрос
41,68 ₽ за миллион входных токенов и 187,59 ₽ за миллион выходных. Повтор начала запроса считается по 3,50 ₽ за миллион. Прикинуть счёт на своём объёме можно в калькуляторе.
Astra - самая умная модель на рынке
В агентных задачах, работе с компьютером и длинном контексте она впереди с большим отрывом. В сводных индексах и на Humanity's Last Exam выше держится Claude Fable 5.1, и она тоже есть в каталоге.
Почему контекст 250 000, а не миллион
Это осознанный потолок нашего шлюза. За этим порогом запрос становится кратно дороже, и вместо неожиданного счёта клиент получает понятную ошибку до списания.
Итог
Astra - это не прибавка процентов к прошлому поколению, а смена профиля. Ставка сделана на длинные агентные прогоны в реальном софте, где выигрыш приходит не от цены токена, а от того, что задача решается с первого раза и меньшим числом шагов. Плата за это - переписанный слой интеграции, другой адрес для инструментов и выброшенные temperature и top_p.
Возьмите ключ, прогоните свой набор запросов со стримингом и сравните счёт с тем, что у вас сейчас. Если транспорт под долгие ответы ещё не готов, начните с GPT-5.6 Sol и переключитесь одной строкой.