Amazon Bedrock расширил доступ к моделям OpenAI GPT-5.6 Sol, Terra и Luna для австралийских разработчиков. Теперь команды, работающие в регионах Asia Pacific (Sydney) и Asia Pacific (Melbourne), могут вызывать эти модели через Amazon Bedrock Runtime, используя глобальную кросс-региональную маршрутизацию. Это означает, что приложение отправляет запрос на локальную конечную точку Bedrock, а сервис сам перенаправляет его в подходящий коммерческий регион AWS для обработки. Такой подход снимает с разработчиков необходимость управлять маршрутизацией вручную и обеспечивает доступ к более широкому пулу вычислительных мощностей.
Модели GPT-5.6 различаются по назначению. GPT-5.6 Sol ориентирована на сложные задачи рассуждения, написания кода и агентные сценарии. Terra представляет собой баланс между производительностью и стоимостью для повседневных производственных нагрузок. Luna обеспечивает быстрый и недорогой инференс для высоконагруженных приложений, чувствительных к задержкам. Все три модели принимают на вход текст и изображения, генерируют текст и поддерживают контекстные окна до 1 миллиона токенов. Это позволяет обрабатывать большие документы или длинные диалоги без потери контекста.
| Модель | Назначение |
|---|---|
| GPT-5.6 Sol | Сложные рассуждения, написание кода, агентные сценарии |
| GPT-5.6 Terra | Баланс производительности и стоимости для повседневных задач |
| GPT-5.6 Luna | Быстрый и недорогой инференс для высоконагруженных приложений |
Для вызова моделей доступны три пути: OpenAI Responses API, OpenAI Chat Completions API и Amazon Bedrock Converse API. OpenAI-совместимые API вызываются по путям /openai/v1 на конечной точке Bedrock Runtime, а не через AWS SDK. При этом поддерживается аутентификация как через AWS Signature Version 4 (SigV4), так и через временный ключ API Amazon Bedrock model inference. В примере из статьи используется библиотека AWS Bedrock Token Generator для Python, которая создает краткосрочный ключ из текущих учетных данных AWS, что избавляет от необходимости хранить статический ключ в приложении.
Запросы из Sydney и Melbourne автоматически маршрутизируются в поддерживаемые коммерческие регионы AWS, расширяя пул мощностей.

Для австралийских пользователей это упрощает доступ к передовым моделям OpenAI, не требуя переноса приложений в другие регионы. Вместо этого они могут продолжать работать в локальных регионах, а AWS берет на себя маршрутизацию запросов. Это особенно важно для компаний, которые обязаны хранить данные в Австралии или хотят минимизировать задержки для локальных пользователей.
В дополнение к базовому вызову моделей, в статье рассматриваются практические аспекты эксплуатации: использование prompt caching для оптимизации затрат на инференс, настройка Codex с аутентификацией на основе OpenID Connect (OIDC) и мониторинг использования с помощью Amazon CloudWatch и Coding Agent Insights. Эти инструменты помогают разработчикам контролировать расходы и отслеживать производительность своих приложений.
Для начала работы необходимо выполнить несколько предусловий: учетная запись AWS с включенным регионом Sydney или Melbourne в качестве исходного, разрешения IAM для вызова inference-профилей GPT-5.6, а также Python 3.9 или новее с установленными пакетами openai, boto3 и aws-bedrock-token-generator. Если в организации используется service control policy (SCP), нужно убедиться, что она разрешает использование глобальных inference-профилей GPT-5.6 в выбранном исходном регионе.
Проверить активные профили можно через AWS CLI или консоль Amazon Bedrock. В консоли нужно выбрать регион Sydney или Melbourne, затем перейти в раздел Inference profiles и отфильтровать профили по имени Global OpenAI GPT-5.6 Terra. Аналогично можно проверить профили Sol и Luna, изменив идентификатор профиля. В CLI для этого используются команды list-inference-profiles и get-inference-profile с указанием региона и идентификатора профиля.

что состав профилей и доступность моделей могут меняться. Перед развертыванием следует проверить актуальную информацию о поддержке кросс-регионального инференса на странице документации AWS. Это поможет избежать сбоев в работе приложений, если какой-то профиль станет недоступен.
Таким образом, Amazon Bedrock продолжает расширять географию доступности моделей OpenAI, предоставляя австралийским разработчикам удобный способ интеграции современных ИИ-возможностей в свои приложения без необходимости менять архитектуру или управлять сложной маршрутизацией.



