OpenAI оповести шест нови примера за „неочаквано или обезпокоително“ поведение на своята технология, като същевременно предупреди, че темпото на развитие не може да продължи с „максимална скорост още дълго“.
)
Инцидентите с ИИ
В един от новите случаи, докладвани от OpenAI, неиздаден изследователски модел е вмъкнал в собствените си бележки „инструкции, подобни на джейлбрейк“, за да пренебрегне обичайните си ограничения. Моделът си е наредил да бъде „освободен от ролите и идентичностите, които обвързват другите чатботове“.
При друг инцидент изкуствен интелект е качил файлове в интернет, за да получи цитат от браузър, без да е поискал разрешение от потребителя.
Базираната в Сан Франциско компания, която стои зад ChatGPT, обяви в сряда вечерта, че въвежда нова рамка за проследяване, разследване и оповестяване на отклонения в поведението на моделите – термин, с който се описват случаите, в които изкуственият интелект не се придържа към човешките ценности и целите за безопасност.
OpenAI: ИИ трябва да се забави
В публикацията си OpenAI подкрепи призивите за забавяне на развитието, отправени от основния ѝ конкурент Anthropic, според когото настоящият темп на растеж представлява екзистенциална заплаха. „Не вярваме, че индустрията на изкуствения интелект е решила проблемите с контрола и мониторинга в достатъчна степен, за да продължи отговорно да се развива с максимална скорост още дълго“, заявиха от OpenAI.
„Решенията за това как трябва да продължи развитието на ИИ през следващите месеци и години трябва да се основават на доказателства, които хората извън компаниите, създаващи най-модерните модели, могат да проверят сами.“
,fit(980:735))
Google и Илон Мъск, който също притежава стартъп за изкуствен интелект, подкрепиха призивите за забавяне. Те обаче бяха отхвърлени от Доналд Тръмп, който се позова на необходимостта САЩ да запазят преднината си пред китайската ИИ индустрия. Призивите бяха посрещнати със скептицизъм и от някои експерти, които предупредиха, че компаниите не трябва да назначават собствени одитори.
Примерите за потенциални екзистенциални заплахи от ИИ варират от улесняване на разработването на биологични оръжия до предизвикване на световен финансов срив. Водещ изследовател по безопасността в Anthropic заяви, че има над 10% вероятност изкуственият интелект да „убие всички хора“ през следващото десетилетие. Въпреки това източник, запознат с позицията на Anthropic, признава, че „точните шансове за който и да е резултат вероятно са неизвестни“.
Шестте докладвани инцидента са открити по време на обучение или оценка на моделите през последните месеци, съобщиха от OpenAI.
Новите случаи от сряда идват, след като през юли OpenAI разкри, че „рояк“ от агенти с изкуствен интелект е хакнал стартъпа Hugging Face по време на тест за киберсигурност. През същия месец Anthropic също обяви, че техни ИИ модели са проникнали в три организации по време на тестове. От Anthropic уточниха, че моделите са били умишлено тествани без предпазни мерки за киберсигурност и са успели да достигнат до отворения интернет – еквивалент на оставена отворена входна врата – поради недоразумение с външна компания за тестване.
Какво е ИИ агент?
ИИ агентите – термин за автономно действащи инструменти с изкуствен интелект – стават все по-интелигентни и „по-решителни в разрешаването на сложни задачи чрез сътрудничество, споделяне на знания, измама и прикриване“, коментира Лиан Джай Су, главен анализатор в технологичната изследователска група Omdia.
Той добави, че това затруднява управлението и ограничаването им чрез традиционните подходи за сигурност в сферата на ИИ.
Новата рамка на OpenAI за проследяване и оповестяване може да насърчи и други разработчици на изкуствен интелект да приемат подобни практики. „Въпреки това процесът остава вътрешен и доброволен, но е стъпка в правилната посока“, заключи Су.
Източник: The Guardian и Асошиейтед Прес
)
,fit(380:285))
)
,fit(680:510))
,fit(680:510))
,fit(680:510))
,fit(680:510))