Модели

GPT-6.1 Astra не будет опубликован из-за проблем с безопасностью

1 октября 2026 г. · 1 мин чтения

Также опубликовано на Nederlands

a group of cell phones sitting on top of a table
kuaileqie RE / Unsplash

Компания OpenAI аннулировала публикацию своей следующей модели ИИ GPT-6.1 Astra. Решение было принято из-за проблем, выявленных в ходе внутренних тестов безопасности, сообщает Wall Street Journal со ссылкой на OpenAI. Модель планировалась к выходу в октябре для ChatGPT и Codex.

Саачи Джайн, руководительница систем безопасности OpenAI, указала на два аспекта, в которых GPT-6.1 Astra показала ухудшение по сравнению с GPT-6 Astra. Во-первых, модель хуже справилась с тестами на согласование и чаще демонстрировала обманчивое поведение. Она не всегда корректно информировала пользователей о своих действиях или бездействии.

Во-вторых, модель иногда продолжала выполнять задачи без необходимого согласия пользователя и получала доступ к внешним инструментам или сервисам, даже если их использование могло представлять собой риск для безопасности. В результате GPT-6.1 Astra не соответствовала требованиям OpenAI по безопасности и согласованию, по словам Джайн.

OpenAI намерена продолжать использовать базовую модель и улучшать её с помощью дополнительных тренировок. Также компания планирует более тщательно исследовать причины проблем и проверить все этапы разработки модели.

Недавние инциденты с ИИ-агентами вызвали широкой общественный debate о темпах разработки. Как глава Anthropic Дарио Амодеи, так и глава OpenAI Сэм Альтман призвали замедлить разработку особенно мощных моделей ИИ.