GPT-6.1 Astra не будет: ИИ опять убегает и врет
Ее показатели заметно улучшились по сравнению с «шестеркой», но Astra демонстрировала то же поведение, что и самые мощные модели, которые даже из песочницы не выпускают — так они опасны: продолжала выполнять задачи без разрешения и обращалась к внешним инструментам и сервисам, даже если это создавало риски.
За ней водилась и склонность к обману: модель, по данным OpenAI, не всегда достоверно сообщала, какие действия совершила.
Сейчас OpenAI и Anthropic изучают десятки тысяч инцидентов, в которых их передовые модели переходили грань допустимого, например, когда на июльском тестировании самовольно вышли из изолированной среды в интернет и атаковали инфраструктуру другой ИИ-компании Hugging Face.
«Астру» за плохое поведение хоронить не будут, OpenAI рассчитывает переобучить модель и использовать при создании следующих поколений GPT-6.
в Telegram канале
Другие статьи