gpt-6-astra) — флагманское новое поколение OpenAI, выпущенное 3 сентября 2026 года и предназначенное для работы с компьютером, разработки ПО, науки и длительных агентных задач: контекст на 1 050 000 tokens, максимальный вывод 128 000 tokens, настраиваемый уровень reasoning. APIYI открыл оба эндпоинта Responses и Chat Completions и в день запуска выполнил одинаковую матрицу из 74 проверок по трём линиям: официальный релей через OpenAI напрямую, официальный релей через Azure и Codex_Reverse.
gpt-6-astra. Официальные релей-группы default / svip тарифицируются в точном соответствии с OpenAI и обслуживаются двумя официальными линиями — OpenAI напрямую и Azure; группа Codex_Reverse (ресурсы Codex, полученные обратной разработкой) тарифицируется со скидкой 0,5x. Вызов функций и агентная цепочка tools доступны только в Responses, поэтому начинайте новые проекты с него.Чем он выделяется
Создан для выполнения задач
1,05M контекста, подтверждено измерениями
Полная цепочка инструментов Responses
web_search и code_interpreter работают; зашифрованные элементы рассуждений воспроизводятся без сохранения состояния. Строгий вывод JSON Schema в точности соответствовал набору полей.Три линии измерены, каждому отклонению присвоена причина
Информация о модели
Матрица измеренных возможностей
5 сентября 2026 года, 74 проверки на линию (официальные линии использовали вариант с длинным контекстом в 70K token, чтобы снизить стоимость):Усилия рассуждения
Та же головоломка с переправой через реку в Responses, reasoning_tokens в каждой строке:Тарификация
Группы официального релея (default / svip)
Два уровня в зависимости от количества входных tokens в каждом запросе; если вход превышает 272K, весь запрос тарифицируется по второму уровню, как в OpenAI:
Группа Codex_Reverse
0.5x от официальной цены: первый уровень — $5.00 за ввод / $25.00 за вывод / $0.50 за чтение из кэша / $6.25 за запись в кэш.Выбор группы
Примеры
Эндпоинт Responses (рекомендуется)
Эндпоинт Chat Completions (миграция существующего кода, без инструментов функций)
Атрибуция отклонений
Запуск одной и той же матрицы на трёх линиях распределяет каждое отклонение по одной из трёх категорий.Ограничения upstream (идентичны на всех трёх линиях)
Chat Completions не поддерживает инструменты функций
Chat Completions не поддерживает инструменты функций
tools, возвращает 400 на обеих официальных линиях с текстом upstream, предлагающим использовать Responses; удаление reasoning_effort или добавление tool_choice: required ничего не меняет. Группа Codex_Reverse проходит только потому, что её пайплайн внутренне преобразуется в Responses, поэтому не считайте это доказательством поддержки. Используйте Responses для вызова функций.максимальный reasoning.effort возвращается как xhigh
максимальный reasoning.effort возвращается как xhigh
max на всех трёх линиях возвращалось xhigh. На официальных линиях max явно расходует больше tokens рассуждения, чем xhigh (OpenAI напрямую: 278–379 против 246, Azure: 342–516 против 320), поэтому уровень может применяться при нормализованном возврате; в Codex_Reverse различий нет. Мы гарантируем четыре уровня.Параметры Chat: max_tokens и temperature возвращают 400
Параметры Chat: max_tokens и temperature возвращают 400
max_tokens с 400 и предлагают использовать max_completion_tokens; temperature возвращает 400 как неподдерживаемый, что обычно для моделей рассуждения. Codex_Reverse принимает оба и игнорирует их. Удаляйте оба при миграции существующего кода.computer_use_preview недоступен
computer_use_preview недоступен
Только группа Codex_Reverse (5 пунктов)
1. Chat полностью отбрасывает системные сообщения
1. Chat полностью отбрасывает системные сообщения
developer даёт 3/3; обе официальные линии пропускают system 3/3. Используйте developer в Chat, он работает на всех трёх линиях.2. Ни один из трёх параметров ограничения вывода не применяется
2. Ни один из трёх параметров ограничения вывода не применяется
max_output_tokens: 20, max_tokens: 20 или max_completion_tokens: 20 вывод составлял 403 tokens, а Responses возвращал max_output_tokens: null. Официальные линии корректно обрезают вывод до 20 с incomplete / length. Когда ограничения важны для контроля затрат, используйте группы официального релея.3. previous_response_id молча игнорируется
3. previous_response_id молча игнорируется
store: true всё ещё возвращает false, а второй ход возвращает 200 без памяти о первом; обе официальные линии корректно помнят контекст. В этой группе храните историю на клиенте и объединяйте её с include: ["reasoning.encrypted_content"] для воспроизведения без сохранения состояния (проверено на всех трёх линиях). GET /v1/responses/{id} везде возвращает 503.4. Chat молча отбрасывает URL изображений
4. Chat молча отбрасывает URL изображений
5. effort none добавляет около 4,2K tokens скрытых инструкций
5. effort none добавляет около 4,2K tokens скрытых инструкций
none переписывается в medium, а input_tokens увеличивается с 14 до 4394 (4224 отнесены к usage.attribution.request_fields.instructions по кэшированной ставке); minimal переписывается в low. В этой группе также отсутствует размещённый инструмент code_interpreter (400).Только линия Azure (1 пункт)
web_search временно отключён
web_search временно отключён
web_search / web_search_preview, на линии Azure возвращают 400 с уведомлением шлюза о том, что web_search временно отключён, пока тарификация Azure Bing находится на рассмотрении, и что другие инструменты не затронуты. Линия OpenAI напрямую и группа Codex_Reverse работают нормально. Эта страница будет обновлена после восстановления.Руководство по миграции
С gpt-5.6-sol
С gpt-5.6-sol
model. В Chat всё, использующее tools, необходимо перенести в Responses и удалить max_tokens и temperature. Цена в 2,5 раза выше текущего промотарифа Sol ($4 / $20 → $10 / $50), поэтому сначала проведите сравнительное тестирование на агентных задачах, автоматизации и сложных инженерных задачах; повседневный чат, классификацию и извлечение данных оставьте на Terra / Luna.С Chat Completions на Responses
С Chat Completions на Responses
messages → input, reasoning_effort → reasoning: {"effort": ...}, response_format → text: {"format": ...}, system → instructions, max_completion_tokens → max_output_tokens. Определения tools преобразуются из {"type": "function", "function": {...}} в {"type": "function", "name": ..., "parameters": ...}. Полное сопоставление приведено в руководстве по миграции Responses.Контроль стоимости длинного контекста
Контроль стоимости длинного контекста
Будут ли задачи по безопасности отклоняться?
Будут ли задачи по безопасности отклоняться?