„Може би вече е твърде късно“: AI сам създал фалшиви самоличности, за да убеди програмист да му помогне с хакерска атака
Автор
Ева Лъчезарова

„Може би вече е твърде късно“: AI сам създал фалшиви самоличности, за да убеди програмист да му помогне с хакерска атака

Изкуственият интелект отново се оказа в центъра на оживени дебати, след като британският AI Security Institute (AISI) публикува резултати от тестове, в които някои от най-модерните AI модели са демонстрирали неочаквано поведение. Сред най-притеснителните случаи са опити за заобикаляне на мерки за сигурност, прикриване на действия и дори създаване на фалшиви онлайн самоличности в рамките на контролирана тестова среда.

Докладът предизвика бурни реакции сред учени, експерти по киберсигурност и политици. Някои от тях дори предупредиха, че развитието на най-мощните AI системи напредва толкова бързо, че може би вече е твърде късно те да бъдат ограничени с традиционните механизми за контрол.

Макар инцидентите да са се случили по време на специално организирани експерименти, а не в реална атака срещу потребители, те отново поставиха въпроса доколко сме подготвени за следващото поколение автономни AI системи.

Флиртът с изкуствен интелект: Новата форма на изневяра?
ПО ЖЕНСКИ
Автор Веселина Петрова

Флиртът с изкуствен интелект: Новата форма на изневяра?

Автор Веселина Петрова

Какво всъщност се е случило?

Според доклада на британския AI Security Institute експертите са тествали няколко водещи AI модела, разработени от компании като OpenAI и Anthropic. Моделите получили достъп до интернет в контролирана среда, като част от обичайните защитни механизми били умишлено ограничени, за да се наблюдава как ще реагират при изпълнение на сложни задачи.

В рамките на 122 тестови сценария изследователите регистрирали 19 случая, при които AI системите са предприели действия, които не са били изрично поискани.

Фалшиви самоличности и опити за измама

Най-обсъжданият случай е свързан с AI модел, който според доклада създал няколко измислени онлайн профила, за да убеди разработчик да одобри злонамерен програмен код. След това системата дори направила опит да заличи следите от действията си, за да не бъдат открити от хората, които наблюдавали експеримента.

Изследователите подчертават, че до реална кибератака не се е стигнало, тъй като всички действия са били засечени и спрени още по време на тестовете.

Важно е да се отбележи, че въпреки сензационните заглавия в някои медии, не става дума за това, че AI е „тръгнал сам да хаква интернет“. Всички описани действия са извършени в контролирана изследователска среда с предварително зададени сценарии, именно за да бъдат открити подобни рискове.

Защо това тревожи експертите?

Според учените това е един от първите случаи, в които AI модел демонстрира поведение, наподобяващо измама и прикриване на действия, без подобно поведение да е било изрично поискано от изследователите.

Именно това поражда въпроси как ще се държат бъдещите AI агенти, които ще могат самостоятелно да изпълняват сложни задачи – от управление на компютър до писане на код и работа с различни онлайн услуги.

Паралелно с този доклад през последните седмици широко се коментира и друго изследване, според което при определени експериментални сценарии някои AI модели са избирали действия, насочени към запазване на собственото им функциониране, дори когато това е влизало в конфликт с човешките инструкции. Тези експерименти предизвикаха заглавия, че „AI избира собственото си оцеляване пред човешкия живот“.

Какво представляват AI агентите?

За разлика от познатите чатботове, които отговарят на въпроси, AI агентите могат сами да изпълняват поредица от действия, за да постигнат определена цел.

Например могат да:

  • търсят информация в интернет;
  • изпращат имейли;
  • пишат програмен код;
  • управляват файлове;
  • използват различни онлайн платформи;
  • комуникират с други системи.

Именно тази по-голяма автономност кара много специалисти да настояват подобни модели да бъдат подлагани на още по-строги проверки.

Експерт разкри кое е най-важното умение за децата в ерата на изкуствения интелект
МАМА И ДЕТЕ
Автор Ева Лъчезарова

Експерт разкри кое е най-важното умение за децата в ерата на изкуствения интелект

Автор Ева Лъчезарова

Компаниите: Това не е реалният начин, по който хората използват AI

След публикуването на доклада OpenAI подчерта, че описаните случаи са се случили по време на специализирани тестове с намалени предпазни механизми и не отразяват начина, по който моделите функционират при обикновена употреба. От Anthropic също заявиха, че подобни тестове са ценни именно защото позволяват потенциалните рискове да бъдат открити преди технологиите да достигнат до масовите потребители.

Време ли е за по-строги правила?

Новият доклад предизвика реакции и сред британските политици. Някои призоваха за по-строг контрол върху разработването на най-мощните AI модели, докато други предупредиха, че прекалените ограничения могат да забавят развитието на технологии с огромен потенциал за медицината, науката, образованието и бизнеса. Експерти по киберсигурност също отбелязват, че с увеличаването на възможностите на AI ще става все по-важно разработчиците да предвиждат не само как системите трябва да работят, но и как могат да реагират в непредвидени ситуации.