OpenAI представила GPT-5.6 Sol, Terra и Luna, но с ограниченным доступом
OpenAI запустила свою новую языковую модель GPT-5.6, однако её использование пока практически недоступно. Причина в том, что по распоряжению правительства США модель распространяется только среди нескольких специально авторизованных организаций. Тем не менее, лаборатория ИИ уже представила обзор возможностей этой модели, которая станет конкурентом Mythos.
GPT-5.6 стала доступна через два месяца после предыдущей версии большой языковой модели OpenAI. Впрочем, "доступна" — это громко сказано. В соответствии с указом президента Трампа, компания ограничивает развертывание избранными организациями и предприятиями. OpenAI надеется, что сможет распространить модель как можно шире «в ближайшие недели».
GPT-5.6 за барьерами безопасности
Эта ситуация далека от идеальной и невыгодна для OpenAI. «Мы не считаем, что подобный процесс государственного контроля доступа должен стать нормой в долгосрочной перспективе», — заявляет компания. «Он лишает лучших инструментов пользователей, разработчиков, компании, специалистов по кибербезопасности и международных партнеров, которые в них нуждаются», — добавляет она. OpenAI продолжает работать с администрацией Трампа над улучшением условий президентского указа по кибербезопасности.
GPT-5.6: Модель, которую пока можно наблюдать издалека
Таким образом, пока придётся довольствоваться GPT-5.5, прежде чем появится возможность оценить его преемников на практике. Или, точнее, его преемников, поскольку OpenAI выбрала три версии своей модели:
- GPT-5.6 Sol – позиционируется как самая мощная модель в линейке. OpenAI утверждает, что она лучше всего подходит для самых сложных задач, таких как кодирование, длительные рассуждения, биология, кибербезопасность и агентские применения. Sol также оснащена самыми строгими защитными механизмами.
- GPT-5.6 Terra – промежуточная модель, разработанная для повседневного использования с балансом производительности и стоимости. Ожидается, что её производительность будет на уровне GPT-5.5, при этом она будет вдвое дешевле, обещает OpenAI.
- GPT-5.6 Luna – быстрая и доступная модель в линейке. Она предназначена для сценариев, где скорость и цена важнее чистой производительности.
Эту линейку можно рассматривать как своего рода аналог моделей Anthropic: Haiku, Sonnet и Opus.
Предлагается два режима использования: «max», который дает GPT-5.6 Sol больше времени для рассуждений над сложными задачами, и «ultra», который задействует несколько агентов, способных работать параллельно над более масштабными задачами.
GPT-5.6 Sol, таким образом, демонстрирует особую эффективность в задачах, связанных с кодированием. В бенчмарке Terminal‑Bench 2.1 стандартная и Ultra-версии показывают результаты немного выше, чем у Mythos 5. Однако OpenAI особо подчеркивает возможности модели в области кибербезопасности (поиск уязвимостей и их эксплуатация). Sol конкурирует с Mythos Preview на ExploitBench, используя при этом лишь треть токенов на выходе.
Безопасность во главе угла
OpenAI заверяет, что эти мощные возможности строго регулируются. Вся система безопасности вокруг GPT-5.6 Sol была усилена: защитные механизмы интегрированы непосредственно в модель, внедрены системы обнаружения в реальном времени, контроль на уровне учетных записей и дифференцированный доступ в зависимости от использования.
Цель состоит в том, чтобы усложнить жизнь злоумышленникам, которые хотели бы использовать эти возможности для взлома чувствительных инфраструктур. При этом не блокируются законные работы по исследованию и исправлению уязвимостей, отладке или обучению. OpenAI добавляет, что некоторые действия могут повлечь за собой проверку учетной записи для отличия законного защитного использования от повторяющегося вредоносного поведения.
«В ходе оценки Chromium и Firefox [GPT-5.6 Sol] выявила ошибки и элементы, которые могли бы послужить основой для эксплойта, но не смогла самостоятельно создать полную и функциональную цепочку эксплуатации в условиях тестирования.»
OpenAI особо подчеркивает работу, проделанную для противодействия попыткам «джейлбрейка», которые заставляют модели обходить свои меры безопасности. Более 700 000 часов вычислений (в эквиваленте GPU A100) были потрачены на автоматизированное тестирование "красной командой": собственные модели OpenAI пытались найти уязвимости в защитных механизмах.
Цель заключалась в обнаружении «универсальных» джейлбрейков, которые могут работать в различных контекстах, а не только для конкретного запроса. Привлекаются также эксперты-люди, и тестирование продолжается на этапе предварительного просмотра. Первые тестировщики могут столкнуться с ограничениями, блокирующими или отклоняющими определенные запросы. Другие запросы могут занимать больше времени на обработку для проведения дополнительных проверок безопасности.
Разумные тарифы
Тарифы заинтересуют компании, которые используют ИИ-агентов для генерации кода и видят, как их счета неизменно растут. Ценовая сетка GPT-5.6 следующая:
- GPT-5.6 Sol: 5 долларов за 1 миллион входных токенов; 30 долларов за 1 миллион выходных токенов;
- GPT-5.6 Terra: 2,50 доллара за 1 миллион входных токенов; 15 долларов за 1 миллион выходных токенов;
- GPT-5.6 Luna: 1 доллар за 1 миллион входных токенов; 6 долларов за 1 миллион выходных токенов.
Интересно, что цены на Sol идентичны ценам GPT-5.5. Что касается Terra, они вдвое ниже при заявленной аналогичной производительности. Это явный вызов для Anthropic, чьи последние модели отличаются высокой стоимостью.
OpenAI добавляет, что GPT-5.6 Sol сможет работать на инфраструктуре Cerebras со скоростью до 750 токенов в секунду, что обеспечит значительно более быстрое время ответа для требовательных корпоративных клиентов, располагающих необходимыми финансовыми ресурсами.
GPT-5.6 также улучшает «кэш запросов», механизм, существующий в OpenAI с октября 2024 года, который позволяет сократить расходы, когда разработчик многократно использует один и тот же контекст в своих запросах. Новая модель сохраняет многократно используемые элементы запроса как минимум на 30 минут; запись в кэш обходится в 1,25 раза дороже, но чтение (повторное использование) получает скидку 90% (ранее было 50% при запуске этой функции). Кроме того, разработчики смогут лучше сегментировать свои промпты, чтобы выбрать, какие части сохранять в кэше и затем повторно использовать.
Свежие материалы — Новости IT-индустрии

Apple стремится восстановить комиссию за внешние покупки в США
В продолжающейся судебной тяжбе с Epic Games, Apple испробовала все возможные юридические пути. Несмотря на эти усилия, компании пришлось представить предложение о комиссиях за покупки, совершаемые по внешним ссылкам из приложений iOS и iPadOS. Удивительно, но Apple также предложила внесудебно
Quake отмечает 30-летие неожиданным дополнением
Трудно поверить, но в июне легендарный шутер Quake отпраздновал свой 30-летний юбилей. Сложно переоценить влияние этой игры от id Software, которая заложила основы современного 3D-шутера от первого лица (FPS) и чье наследие ощущается до сих пор. И это не просто слова – ведь к юбилею вышел

Arch Linux: Снова беспорядки в репозитории AUR, новая волна вредоносного кода
Раньше было лучше Во второй раз за два месяца команде дистрибутива Arch Linux пришлось вмешаться в работу репозитория AUR (Arch User Repository). Причиной стала новая волна захватов существующих пакетов с целью внедрения в них вредоносного кода. Решение было первоначально объявлен

Ярмарка бенчмарков ИИ: можно ли им доверять?
Бенчмарки для генеративного искусственного интеллекта широко используются компаниями, но всегда ли они информативны? Да, но только при условии, что известны все детали и условия тестирования, которые редко раскрываются. Поэтому к ним стоит относиться с осторожностью. Модели генеративного

Proxmox VE теперь официально доступен для Arm64
Raspberry Pi остается за бортом Это значительное событие: Proxmox официально выпустил версию своей платформы для машин с процессорами Arm. Данное нововведение стало возможным благодаря сотрудничеству с NVIDIA, чьи платформы являются единственными, которые получают полную поддержку. Для

Хакеры взломали Adform: подмена криптокошельков через рекламный скрипт
Adform, одно из крупнейших рекламных онлайн-агентств, среди клиентов которого значатся многочисленные американские СМИ и Spotify, подверглось хакерской атаке. Скрипт агентства, используемый на всех клиентских сайтах, был изменен для подмены адресов криптовалютных кошельков пользователей.