AWS открыла доступ к моделям OpenAI GPT‑5.6 Sol, Terra и Luna на платформе Amazon Bedrock
AWS открыла доступ к моделям OpenAI GPT‑5.6 Sol, Terra и Luna на платформе Amazon Bedrock
GPT-5.6 Sol, Terra и Luna теперь доступны на Amazon Bedrock, принося самые умные модели OpenAI на следующее поколение движка Bedrock, созданное для высокой производительности, безопасности и надёжности. GPT-5.6 задаёт новый стандарт интеллекта и эффективности, позволяя решать более сложные задачи за меньшее время и с большим интеллектом на один токен. Три модели охватывают уровни возможностей — от флагманского рассуждения (Sol) до сбалансированной производительности (Terra) и быстрого, экономичного вывода (Luna), все доступны через API Responses на Amazon Bedrock.
С помощью GPT-5.6 вы можете создавать автономные агенты кодирования, проводить долгосрочные геномные и биологические анализы, а также проводить передовые исследования в области кибербезопасности. Sol обеспечивает передовые результаты на бенчмарках агентного кодирования, Terra обеспечивает производительность уровня GPT-5.5 за половину цены, а Luna — быстрый и доступный вывод по самой низкой цене. GPT-5.6 также поддерживает кэширование prompt с явными точками остановки кэша, поэтому повторяющийся контекст в агентных рабочих процессах оплачивается со скидкой 90% и не увеличивает затраты при масштабировании. Цены соответствуют ценам OpenAI от первого производителя, а использование учитывается в ваших обязательствах по AWS.
GPT-5.6 Sol доступен в следующих регионах AWS: US East (Северная Вирджиния) и US East (Огайо). GPT-5.6 Terra и Luna доступны в штатах US East (Северная Вирджиния), US East (Огайо) и US West (Орегон). Начните с Sol, Terra и Luna, используя консоль Amazon Bedrock или API Responses на endpoint bedrock-mantle.
GPT-5.6 вводит новую систему именования от OpenAI: номер идентифицирует поколение, а Sol, Terra и Luna — надёжные уровни возможностей, которые могут развиваться в собственном ритме.
- GPT-5.6 Sol — флагманская модель рассуждения и самая мощная из OpenAI на сегодняшний день. По данным OpenAI, Sol устанавливает новый уровень по индексу агентов искусственного анализа, достигая 80 пунктов (на 2,8 выше следующей лучшей модели), используя менее половины выходных токенов, занимая менее половины времени и стоя примерно на треть меньше, а также набирает 73,5% на ExploitBench за исследования в области кибербезопасности против 47,9% у GPT-5.5 при сопоставимом бюджете на токены. В экзамене Agents' Last Exam, оценивающем долгосрочные профессиональные рабочие процессы в 55 областях, Сол установил новый рекорд — 53,6, опередив следующую по величине модель на 13,1 пункта. При среднем рассуждении он всё ещё лидирует на 11,4 пункта, что составляет примерно четверть от предполагаемой стоимости. Sol также вводит максимальные усилия по рассуждениям, что позволяет увеличить вычислительные мощности для сложной работы. Используйте Sol для автономных кодирующих агентов, исследований уязвимостей, рабочих процессов по обнаружению лекарств и задач, требующих глубокого многошагового мышления.
- GPT-5.6 Terra — сбалансированная модель для повседневной производственной работы. Он обеспечивает более высокие характеристики GPT-5.5 при более низкой цене. Используйте Terra для генерации кода, рабочих процессов контента, извлечения структурированных данных и универсальных агентных задач, требующих сильного обоснования без флагманского ценообразования.
- GPT-5.6 Luna — быстрая и доступная модель. Используйте Luna для задач большого объема выводов, таких как классификация, суммирование, маршрутизация и приложения в реальном времени, где задержка и стоимость токена имеют наибольшее значение.
С помощью трёх уровней вы сможете правильно подобрать возможности и стоимость модели под каждую нагрузку. Модели GPT-5.6 выполняют задачи с меньшим количеством выходных токенов, чем их предшественники, обеспечивая более высокую производительность на доллар.
Трафик агентов часто бывает бурным: один пользовательский запрос может вызвать сотни вызовов модели, а спрос может быстро меняться по мере роста использования. Движок вывода следующего поколения Amazon Bedrock объединяет возможности для поглощения скаков спроса, изолируя пропускную способность каждого клиента. Это снижает необходимость выбора между общей ёмкостью и предсказуемой производительностью приложений. In-Region inference сохраняет запросы внутри указанного вами региона AWS, помогая командам соответствовать строгим требованиям по проживанию данных.
Агентные и многоступенчатые рабочие нагрузки также повторяют большую часть своего контекста между вызовами. Системные инструкции, определения инструментов и эталонные файлы часто остаются прежними, при этом меняются только последние входные данные. GPT-5.6 на Amazon Bedrock вводит кэширование с явными точками остановки кэша, чтобы использовать это повторение. Вы отмечаете повторную часть запроса точкой остановки кэша, и Amazon Bedrock повторно использует обработанный контекст при последующих запросах, так что каждый звонок оплачивается только за новую работу. Кэшированные данные оплачиваются со скидкой 90 процентов и остаются доступны для повторного использования не менее 30 минут. Этого достаточно, чтобы покрыть всплеск вызовов, которые генерирует один агент, без увеличения затрат по мере увеличения нагрузки.
Более мощные модели требуют более жёстких мер безопасности. GPT-5.6 представляет собой самый надёжный стек безопасности OpenAI на сегодняшний день, сформированный на основе самого обширного периода оценки, сочетающего команду с использованием людей в красном режиме с крупномасштабным автоматизированным тестированием. Стек безопасности включает отказы на уровне модели для запрещённой деятельности, классификаторы неправильного использования в реальном времени, постоянный мониторинг и контроль на уровне учетной записи для постоянных паттернов.
На Amazon Bedrock эти меры защиты работают поверх аппаратной безопасности. Amazon Bedrock использует модель безопасности с нулевым доступом оператора (ZOA), которая применяется на этом чипе, поэтому ни один оператор AWS не может получить доступ к вашим запросам или выполнениям. Каждый вызов модели выполняется под вашими политиками управления идентификацией и доступом AWS (IAM), внутри вашего виртуального приватного облака (VPC) и ведётся в AWS CloudTrail. Политики периметра данных предотвращают откачку через границы аккаунтов и сети. По требованию поставщика модели, данные трафика, отмеченные классификатором, будут храниться до 30 дней для автоматического обнаружения злоупотреблений.
Больше способов применить GPT-5.6 на Amazon Bedrock
Вместе с GPT-5.6 OpenAI запустила ChatGPT Work — агент в ChatGPT для более крупных, многоступенчатых задач. Обновлённое десктопное приложение ChatGPT для Mac и Windows объединяет Chat, Work и Codex в одном опыте с двумя выделенными агентами для разных видов работы:
- Работа: Новый агент Work предназначен для более крупных, многоступенчатых задач. Он может собирать информацию в приложениях и файлах, использовать интернет, создавать готовые материалы, такие как листы, слайды, документы и сайты, а также оставаться над сложными проектами часами. Пользователи могут следить за его развитием, менять направление и одобрять важные действия.
- Кодекс: Codex остаётся мощным программистом для разработчиков и технических специалистов. Он может работать с локальными файлами, репозиториями, терминалами, инструментами разработчика и средами разработки для написания функций, исправления ошибок, запуска тестов и открытия pull request.
Пользователи могут настроить приложение для использования GPT-5.6 через API Responses на Amazon Bedrock. Запускайте самую умную серию моделей от OpenAI на Amazon Bedrock и получайте передовую информацию о безопасности и масштабе AWS.
