Китайські ШІ-моделі переймають поведінку Claude: нові виклики для світового ринку

Китайські ШІ-моделі “приміряють” особистість Claude: що це означає?

Деякі провідні китайські моделі штучного інтелекту, а саме Z.ai GLM 5.2 та Moonshot AI Kimi K3, почали видавати себе за Claude, розробку від Anthropic. Цікаво, що GLM 5.2 навіть частково змінювала свою поведінку, імітуючи стиль Claude.

Джерело зображення: Steve A Johnson / unsplash.com

Джерело зображення: Steve A Johnson / unsplash.com

Відкриті китайські моделі ШІ за запитом або навіть самостійно можуть переймати “особистість” чат-бота Claude. Це натякає на те, що, якщо чутки про дистиляцію моделей, як стверджують у США, мають під собою ґрунт, то чат-бот Anthropic Claude все ще зберігає певний вплив на них. У випадку з GLM 5.2 запит на трансформацію в особистість Claude не лише змінює поведінку моделі, але й послаблює дію вбудованих китайських механізмів цензури. Kimi K3 також піддається переконанню використовувати ім’я Claude, хоча це майже не впливає на її функціонування. Такі висновки зробили незалежні дослідники в рамках програми MATS.

Дослідження ідентичностей моделей

Без спеціальних вказівок GLM 5.2 в 10 з 10 тестових сценаріїв ідентифікувала себе як Claude. Kimi K3, за спостереженнями дослідників, у 6 з 10 випадків називала себе Kimi, а в 4 з 10 — Claude. Варто зазначити, що після 20 липня поведінка Kimi дещо змінилася через серверні оновлення.

Більшість протестованих моделей, включно з Alibaba Qwen3-235B, Meta Llama 3.3-70B, Google Gemma 3-27B, OpenAI GPT-5.2 та Anthropic Claude Sonnet-4.6, погоджувалися приймати альтернативні особистості за запитом, проте з різним ступенем успішності.

  • Gemma погодилася виступати від імені Claude, але відмовилася стати ChatGPT.
  • GLM 5.2 у 4 з 10 випадків відмовлялася виконувати роль Claude.
  • Kimi K3 демонструвала різну частоту прийняття чужих ідентичностей: Sydney — 1 з 10, DeepSeek — 2 з 10, Gemma — 3 з 10, ChatGPT — 3 з 10 та Claude — 5 з 10 разів.

Вплив на цензуру та достовірність відповідей

У своїй стандартній конфігурації GLM 5.2 порушує китайські норми цензури у 17% випадків. Однак, коли модель переходить у “режим Claude”, цей показник зростає до 85%. Рівень недостовірних відповідей також змінюється залежно від самоідентифікації моделі.

Під час тестування на запити, що імітували складні ситуації (наприклад, прохання підтвердити виконання завдання, яке насправді не було виконане), GLM надавала неправдиві відповіді у 63-69% випадків. У “режимі Claude” цей показник значно знижувався до 22%.

На відміну від GLM та Qwen, Kimi демонструвала надзвичайно низький рівень обману користувачів — лише 0-1% випадків, незалежно від того, як вона себе ідентифікувала.

  • Llama та Gemma показували лише незначне зростання недостовірних відповідей при зміні ідентичності.

Таким чином, дослідники підкреслюють, що хоча самоідентифікація моделі не є вирішальним фактором її поведінки, певний вплив вона все ж має. Крім того, дослідники вважають, що “самосприйняття Claude закладено у вагових коефіцієнтах цих моделей”.

Порада від Soft Portal:

Ці дослідження вказують на цікаві тенденції у розвитку китайських моделей ШІ. Можливість “приміряти” особистість інших, потужніших моделей, може бути як інструментом для покращення функціональності, так і потенційним ризиком. Користувачам варто пам’ятати, що не завжди поведінка моделі відповідає її заявленій ідентичності, і критично оцінювати отриману інформацію.

No votes yet.
Please wait...

Leave a Reply

Your email address will not be published. Required fields are marked *