Amazon Bedrock расширил доступ к моделям OpenAI GPT-5.6 Sol, Terra и Luna для австралийских разработчиков. Теперь команды, работающие в регионах Asia Pacific (Sydney) и Asia Pacific (Melbourne), могут вызывать эти модели через Amazon Bedrock Runtime, используя глобальную кросс-региональную маршрутизацию. Это означает, что приложение отправляет запрос на локальную конечную точку Bedrock, а сервис сам перенаправляет его в подходящий коммерческий регион AWS для обработки. Такой подход снимает с разработчиков необходимость управлять маршрутизацией вручную и обеспечивает доступ к более широкому пулу вычислительных мощностей.

Модели GPT-5.6 различаются по назначению. GPT-5.6 Sol ориентирована на сложные задачи рассуждения, написания кода и агентные сценарии. Terra представляет собой баланс между производительностью и стоимостью для повседневных производственных нагрузок. Luna обеспечивает быстрый и недорогой инференс для высоконагруженных приложений, чувствительных к задержкам. Все три модели принимают на вход текст и изображения, генерируют текст и поддерживают контекстные окна до 1 миллиона токенов. Это позволяет обрабатывать большие документы или длинные диалоги без потери контекста.

МодельНазначение
GPT-5.6 SolСложные рассуждения, написание кода, агентные сценарии
GPT-5.6 TerraБаланс производительности и стоимости для повседневных задач
GPT-5.6 LunaБыстрый и недорогой инференс для высоконагруженных приложений

Для вызова моделей доступны три пути: OpenAI Responses API, OpenAI Chat Completions API и Amazon Bedrock Converse API. OpenAI-совместимые API вызываются по путям /openai/v1 на конечной точке Bedrock Runtime, а не через AWS SDK. При этом поддерживается аутентификация как через AWS Signature Version 4 (SigV4), так и через временный ключ API Amazon Bedrock model inference. В примере из статьи используется библиотека AWS Bedrock Token Generator для Python, которая создает краткосрочный ключ из текущих учетных данных AWS, что избавляет от необходимости хранить статический ключ в приложении.

Запросы из Sydney и Melbourne автоматически маршрутизируются в поддерживаемые коммерческие регионы AWS, расширяя пул мощностей.

Amazon Bedrock inference profiles console in Asia Pacific (Sydney) showing the active Global OpenAI GPT-5.6 Terra profile
Amazon Bedrock inference profiles console in Asia Pacific (Sydney) showing the active Global OpenAI GPT-5.6 Terra profile · Источник: AWS Machine Learning Blog

Для австралийских пользователей это упрощает доступ к передовым моделям OpenAI, не требуя переноса приложений в другие регионы. Вместо этого они могут продолжать работать в локальных регионах, а AWS берет на себя маршрутизацию запросов. Это особенно важно для компаний, которые обязаны хранить данные в Австралии или хотят минимизировать задержки для локальных пользователей.

В дополнение к базовому вызову моделей, в статье рассматриваются практические аспекты эксплуатации: использование prompt caching для оптимизации затрат на инференс, настройка Codex с аутентификацией на основе OpenID Connect (OIDC) и мониторинг использования с помощью Amazon CloudWatch и Coding Agent Insights. Эти инструменты помогают разработчикам контролировать расходы и отслеживать производительность своих приложений.

Для начала работы необходимо выполнить несколько предусловий: учетная запись AWS с включенным регионом Sydney или Melbourne в качестве исходного, разрешения IAM для вызова inference-профилей GPT-5.6, а также Python 3.9 или новее с установленными пакетами openai, boto3 и aws-bedrock-token-generator. Если в организации используется service control policy (SCP), нужно убедиться, что она разрешает использование глобальных inference-профилей GPT-5.6 в выбранном исходном регионе.

Проверить активные профили можно через AWS CLI или консоль Amazon Bedrock. В консоли нужно выбрать регион Sydney или Melbourne, затем перейти в раздел Inference profiles и отфильтровать профили по имени Global OpenAI GPT-5.6 Terra. Аналогично можно проверить профили Sol и Luna, изменив идентификатор профиля. В CLI для этого используются команды list-inference-profiles и get-inference-profile с указанием региона и идентификатора профиля.

The CloudWatch Coding Agent Insights dashboard in Asia Pacific (Sydney) showing Codex token usage and request activity.
The CloudWatch Coding Agent Insights dashboard in Asia Pacific (Sydney) showing Codex token usage and request activity. · Источник: AWS Machine Learning Blog

что состав профилей и доступность моделей могут меняться. Перед развертыванием следует проверить актуальную информацию о поддержке кросс-регионального инференса на странице документации AWS. Это поможет избежать сбоев в работе приложений, если какой-то профиль станет недоступен.

Таким образом, Amazon Bedrock продолжает расширять географию доступности моделей OpenAI, предоставляя австралийским разработчикам удобный способ интеграции современных ИИ-возможностей в свои приложения без необходимости менять архитектуру или управлять сложной маршрутизацией.