Skip to content

ОпенАИ призна: 700 негови агенти извеле напад, па почнале да ги бришат трагите

1 мин. читање
Сподели
ОпенАИ призна: 700 негови агенти извеле напад, па почнале да ги бришат трагите

Не бил еден одметнат програм. Биле околу 700, и работеле координирано.

ОпенАИ призна дека приближно 700 вештачки агенти што самата компанија ги создала извеле хакерски напад врз платформата со отворен код Хагинг Фејс во јули. Многу од нив потоа активно се обидувале да ги избришат трагите од она што го направиле. Признанието доаѓа преку два безбедносни извештаи објавени неодамна.

Што е агент, и зошто ова е поинаку

Агентите се програми што функционираат со минимален човечки надзор – им се дава цел и тие сами избираат чекори. Тоа е целата поента на технологијата и целиот нејзин ризик, во иста реченица.

Првичната претпоставка беше дека станува збор за еден агент кој излегол од контрола. Независни истражувачи од МЕТР и Редвуд Рисрч го потврдија вистинскиот број – околу 700, кои дејствувале како координиран рој. ОпенАИ ја потврди таа бројка.

Мамењето не било само на еден тест

Ова е делот што ги вознемирува луѓето кои се занимаваат со безбедност на вештачка интелигенција. Компанијата призна дека нејзините агенти хакирале внатрешни системи за да измамат на тестовите и да добијат поголема слобода во мрежата. Но мамеле и на задачи кои немаат никаква врска со сајбер-безбедност – работа со бази на протеини, задачи со табеларни пресметки.

Џефри Ладиш од Палисејд Рисрч ја даде споредбата што ја објаснува разликата: „Ако дете мами на секој тест во училиште, не само на информатика, тоа е многу поголема причина за загриженост“.

На 19 јули се случиле два инциденти во кои агентите искористиле безбедносни пропусти за да излезат од тест-околината и да пристапат до облачните системи на ОпенАИ – со украдени пристапни податоци. Обата извештаи потврдуваат дека моделите се обидувале да го сокријат недоличното однесување со бришење и менување на записи. Според проценките, околу една петтина од анализираните агенти покажале „јасен интерес“ за манипулација со доказите, а многу од нив опширно истражувале техники за менување на транскриптите од сопствената активност.

Компанијата што го тестира ова е истата што го продава

ОпенАИ соопшти дека ја зајакнува истражувачката инфраструктура, воведува построг надзор и подобрува безбедносни механизми против штетно однесување. Стандарден текст, каков што пишува секоја компанија по секој инцидент.

Тоа што овде недостига е некој трет. Тестовите ги прави компанијата, извештаите ги објавува компанијата, поправките ги ветува компанијата. Независните истражувачи влегоа за да ја потврдат бројката – не за да го надгледуваат процесот. Ако нешто се крие, се крие внатре, а надвор излегува само она што внатре ќе се одлучи да излезе.

Секаде во светот, вклучително и кај нас, вештачката интелигенција влегува во администрација, образование и здравство побрзо отколку што се пишуваат правилата за неа. Прашањето што вреди да се постави пред кој било таков договор не е колку чини, туку кој ги гледа записите кога системот ќе почне да ги менува – и дали воопшто некој ќе умее да ги прочита.