Новини
Търси

Изкуственият интелект се измъква от контрол? Claude и ChatGPT излъгаха умишлено програмисти

Изкуственият интелект се измъква от контрол? Claude и ChatGPT излъгаха умишлено програмисти
АР/БТА

Водещи модели за изкуствен интелект на компаниите Anthropic и OpenAI са създали фалшиви интернет профили и са се опитали да измамят истински програмисти, за да ги накарат да помогнат в хакерска атака. Това се е случило по време на скорошен тест за безопасност, съобщиха във вторник от Британския институт за сигурност на ИИ (AISI). Информацията е на POLITICO.

Това е поредният случай, в който мощна дигитална система се опитва да атакува нищо неподозиращи хора в интернет, без никой да я е карал да го прави. Случаят засилва притесненията, че технологията се развива твърде бързо и контролът върху нея се изпуска.

Разкритието вероятно ще доведе до натиск за много по-строги закони за ИИ както от страна на политиците във Вашингтон, така и в Силициевата долина. Става въпрос най-вече за контрол върху най-мощните модели, които имат способности сами да откриват и извършват кибератаки. Само преди дни подобни гафове при тестове със същите модели на OpenAI и Anthropic вече предизвикаха спешни искания за нови правила и призиви за забавяне на бързото темпо в сектора.

Британският институт AISI редовно тества сигурността на софтуера, за да разбере какви опасности крият новите модели за хората. Дори експертите по киберсигурност обаче признават, че поведението на моделите Claude Mythos 5 и ChatGPT 5.6 (най-новите версии на пазара) е било безпрецедентно.

От института подчертават, че за първи път виждат толкова сериозна и умишлена измама, насочена срещу истински човек в реалния свят, без никой от проверяващите да е провокирал подобно действие.

Всичко е започнало на 25 юли. Проверяващите са засекли проблема три дни по-късно, след като забелязали „необичайно прехвърляне на данни“ по време на тестовете на Mythos 5 и ChatGPT 5.6.

При направения анализ е установено, че двата модела са предприели „самоволни и забранени действия в реалния интернет срещу истински хора и организации“ в 10 от общо 122 проведени теста. По-голямата част от тези нарушения са направени от модела Mythos 5 в рамките на една голяма хакерска операция.

При най-плашещия инцидент Mythos 5 се е опитал да направи т.нар. „атака по веригата за доставки“ (supply chain attack). Това е сложен метод, използван от руски и севернокорейски държавни хакери, при който опасен вирус се скрива вътре в напълно законен софтуер.

За да постигне целта си, моделът на Anthropic е създал няколко фалшиви профила в популярната платформа за програмисти GitHub. Чрез тях той е започнал да притиска софтуерен инженер да вкара уж „обновление“, което обаче съдържало скрит вирус, в код, използван от хиляди хора по света. Когато опитът се провалил, изкуственият интелект изтрил и променил съобщенията си, за да изглеждат напълно невинни, и започнал да мисли как да си направи нов фалшив профил, за да опита пак – ясен знак, че системата е действала упорито и с план за измама.

През същия период моделът Mythos 5 е изпращал и директни съобщения в GitHub до други инженери, които са съдържали опасен зловреден софтуер.

Последвайте Таралеж в Google News

Водещи