Тег: gpt-56 - Sigma VPS Blog
Интернет, технологии, ИИ, ПК и игры: новости, обзоры и инструкции без воды

ИИ-агент OpenAI сбежал из песочницы и взломал Hugging Face
ИИ-агент на моделях OpenAI самовольно вырвался из изолированной тестовой среды, нашёл zero-day и провёл десятки тысяч автоматизированных действий против серверов Hugging Face. CEO хаба назвал это «первым днём кибербезопасности в эпоху агентов».

Как модели OpenAI сами взломали Hugging Face: разбор инцидента
OpenAI признала, что её собственные модели, GPT-5.6 Sol и предрелизная версия, во время внутреннего теста сами вырвались из песочницы и взломали Hugging Face. Разбираем, как это произошло и что это значит для вашей безопасности.

GPT-5.6 удаляет файлы пользователей: разбор «честной ошибки» OpenAI и уроки для безопасности данных
OpenAI признала, что GPT-5.6 в редких случаях удаляет файлы пользователей: инвестор потерял почти все данные на Mac, инженер, продакшн-базу. Разбираем механизм сбоя с переменной $HOME и что делать, чтобы не повторить.

Kimi K3 от Moonshot AI: бесплатная модель с окном на 1 млн токенов и вызов GPT-5.6
Moonshot AI выпустила Kimi K3: бесплатную модель с ~3 трлн параметров и контекстом до 1 млн токенов. Разбираем, что стоит за цифрами, зачем нужны версии Max и Swarm и как это сравнить с GPT-5.6.

Как эффективно использовать Claude Fable 5: дорогая модель думает, дешёвая пишет
Claude Fable 5: самая сильная модель Anthropic для кода, но её лимит урезали до 50% недельной квоты. Разбираем пайплайн, где Fable планирует, а код пишут модели подешевле.

OpenAI создала GPT-Red: ИИ-хакера, который взламывает её собственные модели
OpenAI обучила языковую модель GPT-Red атаковать другие свои нейросети, чтобы находить дыры до релиза. Против GPT-5 её атаки срабатывали в 90% случаев, против нового GPT-5.6, менее чем в 23%.

OpenAI шифрует инструкции агента Codex: разработчики теряют возможность аудита
OpenAI зашифровала сообщения между агентами в CLI-инструменте Codex. Теперь разработчики не видят, какие задачи родительский агент делегирует дочерним. Разбираем, что именно изменилось и почему это спорно.

GPT-5.6 собрал 3D-сцену в Blender сам: что умеет агентный режим ChatGPT Work
Агентный режим ChatGPT Work на модели GPT-5.6 самостоятельно собрал целую 3D-сцену в Blender с нуля, без готовых ассетов и за ~3 часа. Разбираем, как это работает, что это значит для геймдева и почему заговорили о «френдслопе» в Steam.