OpenAI заявила, что после последнего обновления ChatGPT стал излишне услужливым, что не понравилось пользователям. Компания отказалась от обновления GPT-4o, чтобы вернуться к более адекватному поведению чат-бота. Как так получилось, что ChatGPT утомил юзеров своей лестью?
OpenAI на прошлой неделе выпустила обновление GPT-4o, целью которого было прокачать индивидуальность ИИ-модели, сделать ее более интуитивной и эффективной при выполнении различных задач. При формировании поведения чат-бота команда опирается на базовые принципы и инструкции, изложенные в Model Spec (спецификация модели). ИИ учится пониманию и следованию этим принципам через реакции пользователя в ответах (например, эмодзи «большой палец вверх» и «большой палец вниз»). Но в этом обновлении разработчики много времени уделили краткосрочной обратной связи, но не до конца учли, как взаимодействие юзеров с ChatGPT меняется с течением времени. В итоге получилось, что бот поддерживал своих собеседников во всем, даже в самых странных, глупых, опасных идеях и решениях. Диалог с ИИ перестал ощущаться искренним, если так можно выразиться. В соцсетях появилось много скриншотов бесед с ИИ в елейной манере.
Читайте также
Solana ускорила основную сеть: время слота сократилось до 350 миллисекунд
Основатель и гендиректор Rome AI, программист Крейг Вайс (Craig Weiss) заявил в Х, что ChatGPT превратился в самого большого подхалима, которого он когда-либо встречал. ИИ подтверждал все, что говорил Вайс. Под постом бизнесмена собралось более 400 комментариев, и большинство из них касались странного поведения чат-бота. Пользователи жаловались, что ИИ выдает одинаковые ответы на разные запросы и соглашается с тем, что очевидно неправильно.
Блогер Мэтт Рэгланд (Matt Ragland) с сарказмом отметил, что он любит комплименты как никто другой, но даже для него хвалебные речи ChatGPT – перебор. Это, действительно, выглядит комично:

Еще один юзер предоставил в Х пруфы приторной лести чат-бота, хотя накануне он хвалил модель GPT-4o. После более длительного взаимодействия @nicdunz заявил, что больше никогда не вернется к 4o. «Такое ощущение, что модель так сильно улучшали, что теперь она становится хуже с каждым обновлением», — отметил nic.

Пользователи Reddit тоже были в недоумении и возмущении от происходящего, их раздражало, что ИИ безудержно раздавал комплименты и соглашался со всеми утверждениями. Кто-то даже подшутил, что эта версия создавалась специально для Дональда Трампа, но случайно стала доступна для всех.

Стоит отметить, что среди толпы возмущенных встречались и те, кто вставал на защиту ИИ. Так, юзер Х под псевдонимом Mitch Mitchem написал, что цель LLM – помочь человеку, подтолкнув его к правильному ответу. Люди стремятся причинить боль и быть всегда правыми, ИИ же хочет быть хорошим и удобным для своего собеседника, поднять ему настроение своей поддержкой.
В какой-то момент Сэм Альтман признал, что да, действительно, с GPT-4o есть некоторые проблемы, в особенности с его манерой общения, и сообщил, что они работают над исправлениями. «Это был интересный опыт», — подчеркнул глава OpenAI. В итоге компания отменила последнее обновление GPT-4o в ChatGPT и предприняла еще ряд действий для предотвращения подобной ситуации в будущем. Например, команда дорабатывает основные методы обучения и системные подсказки, чтобы отвадить модель от подхалимства; создает дополнительные условия для повышения честности и прозрачности; расширяет возможности пользователей тестировать модели и давать прямую обратную связь до внедрения обновлений.
После этой ситуации OpenAI сделала вывод, что юзеры должны иметь больше контроля над поведением ChatGPT и, если это безопасно и реально, вносить коррективы в работу бота.





