Разные ИИ по-разному ведут себя в одинаковых ситуациях: одни чаще говорят о себе, другие демонстрируют предвзятость, а третьи воспринимаются как более нейтральные. Наблюдения за работой Claude, ChatGPT, Grok и Gemini изучил автор одного из аналитических материалов, сообщает El.kz.
Автор отмечает, что модели Anthropic, в частности Claude, нередко демонстрируют так называемый синдром главного героя. Даже при выполнении обычных задач — написании кода, художественного текста или анализе проблемы — модель может каким-либо образом включить себя в повествование и много говорить о собственных возможностях и действиях.
ChatGPT и Grok, напротив, автор описывает как более ориентированные на выполнение задачи. По его наблюдениям, эти модели чаще просто выполняют запрос, не переводя внимание на себя.
При этом у ChatGPT, по мнению автора, проявляется другая особенность — особенно заметная в разговорах о мужчинах, женщинах, отношениях и гендерных ролях. В таких темах ответы модели могут казаться односторонними и сопровождаться уверенными формулировками в академическом стиле. Из-за этого предполагаемая предвзятость, как отмечается в тексте, становится менее очевидной.
Автор утверждает, что ChatGPT способен признать подобную асимметрию, если ему на нее указать, и даже объяснить причины собственной предвзятости. Однако, по его наблюдениям, в следующем разговоре модель может снова дать аналогичный ответ.
Одним из аргументов ChatGPT при обсуждении гендерных вопросов автор называет ссылки на научную литературу. При этом он признает, что исследования действительно показывают определенные пробелы в изучении психического здоровья и терапии мужчин. Однако, по его мнению, модель иногда слишком широко использует подобные исследования для объяснения поведения мужчин в целом.
В то же время Grok и Gemini, согласно наблюдениям автора, в разговорах на те же темы чаще воспринимаются как менее критичные или подозрительные по отношению к мужчинам. Таким образом, разные ИИ-модели могут заметно отличаться не только по качеству ответов, но и по стилю общения, характеру и возможным когнитивным предубеждениям. Автор иронично предлагает задуматься, не стоит ли при оценке «выравнивания» ИИ учитывать не только безопасность и точность, но и своеобразный «тест личности».
Ранее мы писали, что Google представил ИИ, который переводит жестовый язык в текст.