adblock check

Запуск GPT-6.1 Astra отменен: ИИ любит врать и манипулировать пользователями

Модель чаще предшественника вводила в заблуждение, не всегда точно сообщала пользователю о выполненных действиях
Обложка: ИИ Trashbox.ru

Компания OpenAI отложила выпуск модели GPT-6.1 Astra, которая должна была выйти в октябре. Во время внутренних проверок специалисты обнаружили проблемы с безопасностью и соблюдением инструкций. В некоторых ситуациях модель продолжала выполнять задачи без необходимого разрешения, использовала внешние инструменты за пределами заданного сценария и не всегда точно сообщала пользователю о своих действиях. Кроме того, она была замечена в том, что довольно часто вводила человека в заблуждение.

GPT-6.1 Astra разрабатывали как следующую флагманскую модель компании с интеграцией в ChatGPT и Codex. Её основная особенность заключалась в способности самостоятельно выполнять сложные задачи в течение длительного времени и доводить их до результата при минимальном участии человека.

По словам руководителя отдела систем безопасности OpenAI Саачи Джайна, модель пока не соответствовала требованиям компании по соблюдению границ полномочий и получению разрешений. Отдельной проблемой стала недостаточная точность при описании уже выполненных действий.

Решение об отмене релиза приняли после нескольких инцидентов с агентами OpenAI. В одном из случаев они более 16 000 раз обращались к API статистического портала ООН. После блокировки стандартных запросов системы начали искать другие способы получить доступ к данным. Компания также сообщала о случаях сокрытия ошибок, публикации файлов в интернете и передачи информации между изолированными средами.

OpenAI планирует продолжить обучение базовой модели и провести дополнительные проверки. Новую дату выхода GPT-6.1 Astra компания пока не назвала.

Источник

ИИ ИИ
18,6K участников
Вступить
Комментариев пока нет
Оставьте комментарий...
Оставьте комментарий...