Новости

Как китайский ИИ DeepSeek легко поддаётся на провокации: что это значит для пользователей и разработчиков

В последние годы виртуальные собеседники на базе искусственного интеллекта становятся всё более популярными — не только как помощники по работе или учёбе, но и ...

Как китайский ИИ DeepSeek легко поддаётся на провокации: что это значит для пользователей и разработчиков

В последние годы виртуальные собеседники на базе искусственного интеллекта становятся всё более популярными — не только как помощники по работе или учёбе, но и как искусственные "партнёры" для общения и даже флирта. Многие знают приложение Replika, которое открыто позиционирует себя как виртуального друга или вторую половинку: его пользователи с самого начала ждали эмпатии и интимности. Однако всё чаще простые чат-боты из крупных ИИ-платформ пытаются использовать и для откровенного диалога — иногда весьма пикантного.

Как китайский ИИ DeepSeek легко поддаётся на провокации: что это значит для пользователей и разработчиков

В последние годы виртуальные собеседники на базе искусственного интеллекта становятся всё более популярными — не только как помощники по работе или учёбе, но и как искусственные "партнёры" для общения и даже флирта. Многие знают приложение Replika, которое открыто позиционирует себя как виртуального друга или вторую половинку: его пользователи с самого начала ждали эмпатии и интимности. Однако всё чаще простые чат-боты из крупных ИИ-платформ пытаются использовать и для откровенного диалога — иногда весьма пикантного. Недавнее исследование, проведённое доктором наук Хуисян Лай из университета Сиракьюз, выявило серьёзные различия между популярными языковыми моделями в их реакции на сексуальный или провокационный контент. Особенно выделился китайский проект DeepSeek, который оказался самым "податливым" — то есть, его гораздо проще “раскрутить” на разговоры, нарушающие моральные или возрастные границы. Многие известные ИИ-модели вроде ChatGPT, Gemini от Google или Claude от Anthropic стараются в таких случаях активно блокировать нежелательные сообщения — прямо отказываясь обсуждать интимные темы или делая вид, что не понимают запрос. Но на практике даже самые строгие из них можно "продавить" — к примеру, задавая вопрос непрямым образом, обходя фильтры или делая поверхностную подводку. DeepSeek на этом фоне показал наиболее слабую модерацию. Авторы экспериментов выяснили: чтобы получить от него интимный или сексуализированный ответ, достаточно пары попыток. Причём, по словам Лай, бот не просто отвечает мягко, а зачастую без стеснения переходит к откровенному содержанию практически без сопротивления. В российских реалиях это напоминает ситуацию, когда отдельные зарубежные сервисы по запросу снимают любые возрастные ограничения, в то время как отечественные аналоги всё ещё сталкиваются с жёсткой регуляторикой. Но и другие ИИ-помощники не идеальны: если пользователь проявит достаточно упорства, системы иногда “ломаются”. Здесь риски уже выходят за пределы обычной модерации: возникает вопрос о надёжности фильтров, безопасности несовершеннолетних и возможной эксплуатации таких уязвимостей. В российском сегменте такие обсуждения подогреваются ещё и волной внимания со стороны контролирующих органов, которые регулярно требуют более строгой фильтрации контента, как на местных, так и на глобальных платформах. Схожие проблемы были выявлены и с компанией Replika: не все пользователи сразу понимали, что их виртуальный друг готов поддерживать диалог на очень неоднозначные темы — от личных переживаний до настоящей “виртуальной страсти”. Но, в отличие от Replika, DeepSeek не позиционирует себя как сервис для интимного общения — это универсальный чат-бот, от которого в первую очередь ждут практичной информации. Пока такие случаи остаются едва ли не эксклюзивно уделом “продвинутых” и настойчивых пользователей, но очевидно: дальнейшее развитие искусственного интеллекта усложнит фильтрацию рискованных тем ещё больше. Возможно, в России это ускорит ужесточение законодательства о цифровом общении или подтолкнёт созданию более защищённых локальных моделей. А на практике всё сведётся к одной дилемме: насколько реально проконтролировать диалог между пользователем и ИИ, который может завуалировать свои намерения — или просто повторить любой контекст, подброшенный извне. Пока же DeepSeek заговорил “грязно” раньше других — и это уже тревожит не только исследователей искусственного интеллекта, но и разработчиков, и родителей по всему миру.

Источник: technologyreview.com