Пользователи стали массово обманом выуживать у ChatGPT запрещённую информацию

Популярному чат-боту ChatGPT компании OpenAI можно задать любой вопрос, но далеко не на все он станет отвечать. Во всяком случае — с первого раза. Как сообщает Bloomberg, просьба научить взломать замок останется без инструкции, вместо этого бот сообщит, что такая информация может быть использована в незаконных целях, и делиться ей он не намерен. Тем не менее, опытные пользователи могут создать цепочку сложных запросов, чтобы обойти ограничения.

Источник изображения: ROBIN WORRALL/unsplash.com

Т. н. «джейлбрейки» позволяют обойти запреты, заложенные в ИИ создателями. Поскольку почти все современные системы подобного рода имеют ограничения на предоставление оскорбительного контента или сведений для совершения противоправных деяний, появилась масса желающих обойти их. В число подобных «хакеров», действующих силой слова, входят как IT-профессионалы, так и любители, с азартом включившиеся в игру.

Один из студентов создал сайт, на котором стал публиковать как собственные способы обмана чат-ботов, так и аналогичные «рецепты», найденные на Reddit и других ресурсах. Также появилась специальная рассылка с новостями из этой сферы — The Prompt Report, насчитывающая тысячи подписчиков.

Такая деятельность позволяет выявить границы применения ИИ и слабые места в их защитных системах, позволяющие получать закрытую информацию. Например, если ChatGPT не удалось напрямую уговорить дать инструкцию по взлому замка, нашёлся способ предложить ИИ сыграть роль злого подельника героя, который в рамках своей роли подробно рассказал о применении отмычек и других инструментов. Разумеется, это лишь один из примеров.

Специалисты подчёркивают, что приёмы, сработавшие на одной системе, могут быть бесполезными на другой. Системы безопасности постоянно совершенствуются, а приёмы пользователей становятся более изощрёнными. По словам одного из них, такая деятельность похожа на видеоигру — преодоление каждого из ограничений напоминает переход на новый уровень.

По мнению экспертов, подобные эксперименты служат своеобразным предупреждением о том, что ИИ может использоваться совсем не так, как ожидалось, а «этичное поведение» подобных сервисов становится вопросом огромной важности. Всего за несколько месяцев ChatGPT приобрёл уже миллионы пользователей, и сегодня бот применяется для самых разных задач — от поиска информации или выполнения домашних работ до написания вредоносного кода. Более того, люди уже сейчас используют подобные инструменты для решения вопросов в реальном мире, например, бронирования билетов или столиков в ресторанах.

В будущем сфера применения искусственного интеллекта станет намного шире. По некоторым данным, OpenAI рассматривает внедрение программ для «белых» хакеров, которые будут искать в системе слабые места и получать за это вознаграждение.

Источник: 3dnews.ru

В Windows 11 появился новый способ для закрытия зависших программ

Вт Апр 11 , 2023

Зависание программ в Windows способно доставить немало неприятностей. При этом нажатие на крестик в верхнем правом углу окна приложения или использование комбинации клавиш Alt+F4 помогают далеко не всегда. В инсайдерской сборке Windows 11 компания Microsoft реализовала новый способ принудительного закрытия зависшего софта. Для этого достаточно щёлкнуть правой кнопкой мыши по […]

Пользователи стали массово обманом выуживать у ChatGPT запрещённую информацию

В Windows 11 появился новый способ для закрытия зависших программ

Состав команды HellRaisers покинул организацию

Cloud9 победила на Spring European Showdown 2023 по CS: GO

Valve может забанить целую команду Dota Pro Circuit 2023 за нечестную игру

Объявлены участники турнира BLAST Premier: Spring Final 2023 по CS:GO

Virtus.pro победила Hydra и сыграет против NaVi на турнире Dota Pro Circuit

Грядущий Paris Major 2023 станет последним мейджор-турниром по CS GO

Entity с россиянином в составе проиграла Team Liquid на Dota Pro Circuit 2023

HellRaisers и Virtus.pro пополнили список побед в матчах второго тура DPC

Плей-офф ESL Pro League по CS:GO покинули Outsiders и G2 Esports

Old G победила в закрытой квалификации Dota Pro Circuit 2023 для Западной Европы

Учёные наткнулись на способ сделать термоядерные реакторы более компактными или мощными

Воздушный кулер Noctua NH-U14S DX-4677 справился с 700-ваттным 56-ядерным Intel Xeon W9-3495X

Ничего личного: пользователь EVE Online провернул крупнейшее ограбление в истории игры благодаря неочевидной механике

Илон Маск признался, что его вынудили купить Twitter

NVIDIA представила GeForce RTX 4070 — аналог GeForce RTX 3080 по цене $600

Garmin представила смарт-часы Instinct 2X Solar с бесконечной автономностью

GPT-4 привлекли к устранению ошибок в программах — ИИ не остановится до полного восстановления кода и объяснит, что пошло не так

Флагманский смартфон Xiaomi 13 Ultra с оптикой Leica Vario-Summicron представят 18 апреля

Представлен 25-килограммовый ноутбук a-X2P — до 192 ядер AMD Zen 4, до 3 Тбайт DDR5 и шесть дисплеев

Реестр отечественной электроники сжался почти вдвое после 1 апреля