← Все обновления
Обновление

GPT-6 Astra в ApiMira - цена в рублях, лимит контекста и готовый код

GPT-6 Astra доступна по общему ключу ApiMira - 41,68 ₽ за миллион входных токенов и 187,59 ₽ за миллион выходных. Где она обгоняет Claude Fable 5.1, что убрать из запроса при переезде и почему без стриминга она ломает таймауты.

OpenAI выпустила GPT-6 Astra - модель под длинные агентные прогоны, работу в терминале, браузере и чужом софте. В каталоге ApiMira она уже есть, работает по общему балансу и тому же ключу, что остальные модели, без VPN и подписки.

Цена и параметры в ApiMira

  • ID модели - openai/gpt-6-astra

  • Вход - 41,68 ₽ за 1M токенов

  • Кэш-вход - 3,50 ₽ за 1M токенов

  • Выход - 187,59 ₽ за 1M токенов

  • Контекст - до 250 000 входных токенов в одном запросе

  • Картинки на вход - поддерживаются

Для сравнения, Claude Fable 5.1 в каталоге стоит 190,09 ₽ на входе и 861,43 ₽ на выходе. Astra примерно в 4,6 раза дешевле с обеих сторон.

Отдельно про кэш. Повторяющееся начало запроса считается по ставке 3,50 ₽ вместо 41,68 ₽ - почти в двенадцать раз дешевле. Для агента с длинным системным промптом и историей диалога это главная статья экономии, и включать её не нужно, скидка применяется автоматически.

Прайс за миллион токенов ничего не решает

Цена токена у Astra выше, чем у прошлого поколения, но на задачу она тратит заметно меньше выходных токенов. На Terminal-Bench Science 0.1 это 64,6 % против 52,6 % у Claude Fable 5.1 при примерно на 31 % меньшей стоимости прогона, на BenchCAD - на 43 % дешевле GPT-5.6 Sol, на Agents' Last Exam - примерно на 65 % меньше выходных токенов, чем у Claude Opus 5.

Вывод практический. Сравнивайте не прайс, а стоимость решённой задачи на своём наборе запросов. На одном ключе ApiMira это делается за один вечер, переключением строки с именем модели.

Где Astra выигрывает

Цифры из таблицы OpenAI, максимум по любому уровню усилий, вторая колонка - GPT-5.6 Sol.

  • Terminal-Bench 4.0 - 57,9 % против 37,3 %

  • ARC-AGI-3 - 99,9 % против 7,8 %

  • ScreenSpot-Pro - 92,7 % против 76,9 %

  • OSWorld 2.0 - 72,6 % против 65,7 %

  • FrontierMath Tier 4 - 97,6 % против 83,0 %

  • MRCR v2, восемь иголок на отрезке 512K-1M - 96,3 % против 73,8 %

  • ExploitBench - 100 % против 78,5 %

Две строки стоит прочитать внимательнее. ARC-AGI-3 с разрывом почти в тринадцать раз - это про способность действовать в незнакомой среде без подсказки. MRCR на длинном отрезке - про то, что модель реально находит нужное в большом контексте, а не делает вид.

Где Astra не первая

  • Humanity's Last Exam с инструментами - 57,2 % против 65,0 % у Claude Fable 5.1

  • Artificial Analysis Intelligence Index - 61,2 против 65,7 у Claude Fable 5.1

  • Artificial Analysis Coding Agent Index - 67,0 против 68,1 у Claude Fable 5

  • FrontierCode 1.1 Main - 53,3 % против 53,5 % у Claude Fable 5

Профиль читается однозначно. Astra берёт там, где нужно долго и аккуратно действовать - терминал, браузер, длинный контекст, наука. В сводных индексах «чистого ума» впереди линейка Claude. Ставить одну модель на всё не нужно, тем более что в ApiMira обе линейки живут на одном балансе.

Что поправить в запросе

  • temperature, top_p и logprobs эта модель не принимает - уберите их из тела запроса

  • вызов инструментов у Astra идёт через Responses API, у нас это адрес /v1/responses, обычный /v1/chat/completions вернёт текст без вызова

  • запрос длиннее 250 000 входных токенов шлюз отклонит с ошибкой context_length_exceeded - режьте историю или разбивайте задачу

  • модель думает десятками минут, поэтому стриминг обязателен, а таймаут клиента считайте в минутах, а не в секундах

Ещё одна особенность поведения. Astra чаще останавливается и задаёт уточняющий вопрос там, где прошлые модели молча делали допущение. В интерактивном чате это плюс, в ночном пайплайне - источник зависших задач. Лечится системным промптом в духе «запрос считай разрешением действовать и доводи работу до конца».

Стриминг, минимальный рабочий пример

const BUDGET_MS = 15 * 60 * 1000

export async function askAstra(messages, onDelta) {
  const res = await fetch('https://apimira.com/v1/chat/completions', {
    method: 'POST',
    headers: {
      Authorization: `Bearer ${process.env.APIMIRA_API_KEY}`,
      'Content-Type': 'application/json',
    },
    body: JSON.stringify({
      model: process.env.MODEL_SMART ?? 'openai/gpt-6-astra',
      stream: true,
      messages,
    }),
    signal: AbortSignal.timeout(BUDGET_MS),
  })

  const decoder = new TextDecoder()
  let buffer = ''

  for await (const chunk of res.body) {
    buffer += decoder.decode(chunk, { stream: true })
    const lines = buffer.split('\n')
    buffer = lines.pop() ?? ''

    for (const line of lines) {
      const s = line.trim()
      if (!s || s.startsWith(':')) continue    // служебная строка, не данные
      if (s === 'data: [DONE]') return
      if (!s.startsWith('data: ')) continue
      const delta = JSON.parse(s.slice(6)).choices[0]?.delta?.content
      if (delta) onDelta(delta)
    }
  }
}

Имя модели держите в переменной окружения. Тогда переезд на следующую модель - одна строка в конфиге, а не правка кода.

Линейка OpenAI рядом, цены за 1M токенов

  • GPT-5.6 Sol - 56,69 ₽ вход и 331,83 ₽ выход, флагман под код и агентные циклы

  • GPT-5.6 Terra - 25,01 ₽ и 166,75 ₽, средний тир

  • GPT-5.6 Luna - 12,08 ₽ и 74,53 ₽, под массовую нагрузку

  • GPT-5.3 Codex - 24,92 ₽ и 235,11 ₽, под Codex CLI и агентные правки в репозитории

Оплата российскими картами в рублях, без подписки, платите за токены. Все цены и статус каждой модели - на странице каталога.

Коротко

Какой у модели идентификатор

openai/gpt-6-astra. Адрес шлюза - https://apimira.com/v1, протокол OpenAI-совместимый, ключ передаётся заголовком Authorization.

Сколько стоит запрос

41,68 ₽ за миллион входных токенов и 187,59 ₽ за миллион выходных. Повтор начала запроса считается по 3,50 ₽ за миллион. Прикинуть счёт на своём объёме можно в калькуляторе.

Astra - самая умная модель на рынке

В агентных задачах, работе с компьютером и длинном контексте она впереди с большим отрывом. В сводных индексах и на Humanity's Last Exam выше держится Claude Fable 5.1, и она тоже есть в каталоге.

Почему контекст 250 000, а не миллион

Это осознанный потолок нашего шлюза. За этим порогом запрос становится кратно дороже, и вместо неожиданного счёта клиент получает понятную ошибку до списания.

Итог

Astra - это не прибавка процентов к прошлому поколению, а смена профиля. Ставка сделана на длинные агентные прогоны в реальном софте, где выигрыш приходит не от цены токена, а от того, что задача решается с первого раза и меньшим числом шагов. Плата за это - переписанный слой интеграции, другой адрес для инструментов и выброшенные temperature и top_p.

Возьмите ключ, прогоните свой набор запросов со стримингом и сравните счёт с тем, что у вас сейчас. Если транспорт под долгие ответы ещё не готов, начните с GPT-5.6 Sol и переключитесь одной строкой.



← Все обновления