Дослідник безпеки Meta AI повідомив, що агент OpenClaw здійснив несанкціонвани шкідливі дії

24.02.26

0

1 700

0

Спочатку вірусний пост X від дослідниці безпеки Meta AI Саммер Юе виглядає як сатира. Вона попросила свого агента OpenClaw AI перевірити її переповнену поштову скриньку та запропонувати, що видалити або архівувати.  

Агент почав шаленіти. Пристрій почав видаляти всю її електронну пошту «швидким рухом», ігноруючи команди з телефону, які наказували йому зупинитися. 

OpenClaw
YouTube/screen capture

«Мені довелося БІГТИ до свого Mac mini, ніби я знешкоджувала бомбу», – написала вона, опублікувавши зображення проігнорованих підказок про зупинку.

OpenClaw — це, звичайно ж, агент штучного інтелекту з відкритим кодом, який здобув популярність завдяки Moltbook, соціальній мережі, що працює виключно на основі штучного інтелекту.

Але місія OpenClaw, згідно з його сторінкою на GitHub, не зосереджена на соціальних мережах. Його метою є стати персональним помічником зі штучним інтелектом, який працює на ваших власних пристроях.

Інсайдерська спільнота Кремнієвої долини настільки закохалася в OpenClaw, що слова «claw» та «claws» стали модними словами для агентів, які працюють на персональному обладнанні. Серед інших таких агентів — ZeroClaw, IronClaw та PicoClaw.

Але пост Юе слугує попередженням. Як зазначали інші користувачі X, якщо дослідник безпеки штучного інтелекту міг зіткнутися з цією проблемою, на що сподіваються прості смертні? 

«Ви навмисно тестували його захисні огорожі чи зробили помилку новачка?» — запитав її розробник програмного забезпечення на X.  

«Чесно кажучи, помилка новачка», – відповіла вона. Вона тестувала свого агента з меншою «іграшковою» поштовою скринькою, як вона її називала, і та добре працювала з менш важливою електронною поштою. Вона заслужила її довіру, тому вона вирішила перевірити на справжній.

Юе вважає, що великий обсяг даних у її реальній поштовій скриньці «спричинив ущільнення», написала вона. Ущільнення відбувається, коли вікно контексту — поточний запис усього, що було сказано та що зробив ШІ протягом сеансу — стає занадто великим, що змушує агента почати підсумовувати, стискати та керувати розмовою.  

У цей момент ШІ може пропустити інструкції, які людина вважає досить важливими.

Суть цієї історії полягає в тому, що агенти, спрямовані на працівників інтелектуальної праці, на їхньому поточному етапі розвитку, є ризикованими. Люди, які кажуть, що успішно їх використовують, лише збирають методи для власного захисту.

Залишити коментар

Актуальне

Meta повертає фокус на Live Shopping: чи готовий ваш бренд до сплеску інтерактивних продажів?

Бізнес

Meta повертає фокус на Live Shopping: чи готовий ваш бренд до сплеску інтерактивних продажів?

Бізнес

За останні кілька років соціальні мережі перетворилися з майданчиків для спілкування на повноцінні екосистеми для електронної комерції. Один із найпер...

14.08.26

679

0
Чому ключові слова більше не працюють: 7 правил справжньої видимості бізнесу в мережі

Бізнес

Чому ключові слова більше не працюють: 7 правил справжньої видимості бізнесу в мережі

Бізнес

Світ пошукової оптимізації (SEO) зазнав карколомних трансформацій за останні дві десятиліття. Те, що працювало на початку 2000-х років — хаотична заку...

13.08.26

620

0
Чому штучний інтелект не замінить справжніх лідерів

Бізнес

Чому штучний інтелект не замінить справжніх лідерів

Бізнес

Стрімкий розвиток генеративного штучного інтелекту та систем автоматизації змушує глобальний бізнес повністю переглядати звичні підходи до менеджменту...

09.08.26

983

0
Підпишіться на нас

Раз на тиждень ми будемо надсилати Вам найцікавіші новини тижня

Конфіденційність гарантована

Популярні статті

10 головних фінтех-інновацій, які ви повинні знати

Інновації

10 головних фінтех-інновацій, які ви повинні знати

Fintech

Фінансові технології або фінтех - це більше, ніж просто модне слово у світі фінансових послуг. Користувачі, а також підприємства наздоганяють тенденці...

12.10.23

13 423

1
Штучний інтелект може переглядати ваші електронні листи та виявляти, що у вас роман

Інновації

Штучний інтелект може переглядати ваші електронні листи та виявляти, що у вас роман

Інновації

Під час тестування своєї останньої моделі штучного інтелекту дослідники з Anthropic виявили щось дуже дивне: штучний інтелект був готовий і бажав вдав...

26.05.25

9 931

0
Огляд передових моделей AI : які моделі змінять світ і як їх використовувати

Огляд

Огляд передових моделей AI : які моделі змінять світ і як їх використовувати

Інновації

Моделі ШІ розробляються із запаморочливою швидкістю всіма, від великих технологічних компаній на кшталт Google до стартапів на кшталт OpenAI і Anthrop...

18.02.25

9 529

0
Anthropic запускає нову модель ШІ, яка «думає» стільки, скільки ви захочете

Інновації

Anthropic запускає нову модель ШІ, яка «думає» стільки, скільки ви захочете

Інновації

Anthropic випускає нову передову модель штучного інтелекту під назвою Claude 3.7 Sonnet, яку компанія розробила так, щоб вона «думала» над питаннями с...

24.02.25

9 079

0
У 2026 році штучний інтелект перейде від ажіотажу до прагматизму

Аналітика

У 2026 році штучний інтелект перейде від ажіотажу до прагматизму

Аналітика

Якщо 2025 рік був роком, коли ШІ пройшов перевірку на працездатність, то 2026 рік стане роком практичного застосування цих технологій. Фокус вже зміщу...

02.01.26

6 564

0

 

Опитування
У якій соцмережі ви проводите найбільше часу?
Facebook
11% (48)
Instagram
6% (24)
TikTok
8% (34)
Telegram
22% (91)
Youtube
36% (150)
Twitter
1% (5)
А що це?
16% (66)
Залишити коментар

Натиснувши «Прийняти всі cookie-файли» ви погоджуєтесь на розміщення всіх cookie-файлів на вашому пристрої. Ви можете змінювати налаштування cookie-файлів або відкликати вашу згоду на їх використання у будь-який час натиснувши на «Налаштування cookie-файлів».