iLenta Меню

У ChatGPT та аналогах виявлено серйозні вразливості

09 листопада 2023, 12:06 | Bazelas [408]
Китайські дослідники виявили серйозну вразливість у широко використовуваних багатомодальних комерційних великих мовних моделях (MLLM), типу ChatGPT, Bard і Bing Chat.
У ChatGPT та аналогах виявлено серйозні вразливості

Ці моделі, розроблені великими технологічними гігантами, є фундаментальними компонентами різних програм, від віртуальних помічників до систем модерації контенту.

Дослідники виявили, що вразливості у цих MLLM можуть бути використані у маніпульованих зображеннях, які нагадують оригінали. Шляхом внесення дрібних змін, практично невидимих для людського ока, дослідники успішно оминали вбудовані фільтри моделей, призначені для виявлення токсичного або невідповідного контенту.

Наприклад, дослідники в Пекіні виявили серйозну вразливість у моделях ШІ, таких як ChatGPT. В умовах атаки ці моделі могли помилково приймати гігантських панд за людей або не виявляти шкідливого контенту, що підкреслює критичну вразливість у комерційних системах штучного інтелекту.

Серед порушених моделей Bard, обладнаних механізмами розпізнавання облич та токсичності, могли генерувати невідповідні описи шкідливого контенту під час компрометації. Китайська дослідницька група навіть надала код, який демонструє, як ці атаки можуть вводити в оману моделі ШІ. Їхні експерименти продемонстрували успішність на рівні 22% проти Bard, 26% проти Bing Chat та значні 86% проти Ernie Bot.

Вчений-технолог з Китаю Чжаохуей висловив стурбованість цими тривожними результатами на Глобальному Саміті з безпеки ШІ у Великій Британії. Він наголосив на нагальній необхідності сильніших технічних заходів безпеки в управлінні штучним інтелектом і закликав глобальну спільноту розглянути виявлені вразливості в мовних моделях, що широко використовуються.

Для боротьби з цими вразливостями дослідники запропонували використання методів попередньої обробки як потенційного рішення, особливо для масштабних основних моделей. Ці методи спрямовані на забезпечення надійності MLLM проти атак та створюють шлях для майбутніх досліджень та розробок у галузі безпеки ШІ.

Джерело: gizmochina

© 2012-2026 iLenta. Всі права захищені.
Повна версія

AI

ChatGPT раптово почав лаятися: схоже, причина ховається в нових правилах OpenAI
ChatGPT раптово почав лаятися: схоже, причина ховається в нових правилах OpenAI
21 серпня 2026, 15:08 | Bazelas

Користувачі ChatGPT помітили незвичну зміну в поведінці чат-бота: у звичайних розмовах він почав значно частіше використовувати ненормативну лексику. Причому іноді це відбувається навіть тоді, коли співрозмовник сам не вживає лайливих слів. Схоже, пояснення може бути пов'язане не з окремим «режимом лайки», а зі зміною підходу OpenAI до того, як модель підлаштовує стиль відповіді під контекст.

Докладніше...
 
Meta випустила AI-застосунок для Mac із доступом до екрана та Google Workspace
Meta випустила AI-застосунок для Mac із доступом до екрана та Google Workspace
20 серпня 2026, 19:07 | Anton Petrov
Meta розширює присутність свого штучного інтелекту на комп’ютерах Apple. Компанія запустила новий застосунок Meta AI для Mac, який наразі доступний у статусі бета-версії. Насамперед сервіс орієнтований на бізнес і творців контенту, пропонуючи інтеграцію з Facebook, Instagram, аналітикою та інструментами Google Workspace.
Докладніше...
 
OpenAI запускає ChatGPT for Teens: підліткам змінять правила спілкування з ШІ
OpenAI запускає ChatGPT for Teens: підліткам змінять правила спілкування з ШІ
19 серпня 2026, 15:08 | Anton Petrov

OpenAI представила ChatGPT for Teens — окремий режим роботи ChatGPT для користувачів віком від 13 до 17 років. Компанія робить акцент не лише на блокуванні небезпечного контенту, а й на тому, як саме штучний інтелект спілкується з підлітками, допомагає їм навчатися та вибудовує межі у тривалих розмовах.

Докладніше...
 
Stripe купує OpenRouter більш ніж за $7 млрд: вартість ШІ-стартапу зросла вп’ятеро за три місяці
Stripe купує OpenRouter більш ніж за $7 млрд: вартість ШІ-стартапу зросла вп’ятеро за три місяці
17 серпня 2026, 20:07 | Oleksandr Bazanov
Stripe домовилася про придбання OpenRouter — платформи, яка об’єднує доступ до сотень моделей штучного інтелекту через єдиний інтерфейс. За даними Bloomberg, сума угоди перевищить $7 млрд, або близько 330 млрд грн за офіційним курсом НБУ. Водночас остаточна вартість ще може змінитися. Про угоду також повідомляє TechCrunch із посиланням на власні джерела.
Докладніше...
 
Новий ШІ-диктофон Comu сам перетворює розмови на презентації, листи та готові плани
Новий ШІ-диктофон Comu сам перетворює розмови на презентації, листи та готові плани
17 серпня 2026, 19:07 | Bazelas

Компанія Comu офіційно представила Action Pro — компактний ШІ-диктофон, який не просто записує та розшифровує розмови, а може перетворювати їх на презентації, електронні листи, документи, списки завдань і плани подальших дій. Головною особливістю новинки стала окрема кнопка для голосових команд штучному інтелекту.

Докладніше...
 
Сторінки: 1 2 3 4 5 6
Повна версія
 
© 2012-2026 iLenta. All rights reserved.