Skip to content

OpenAI вели дека новиот модел сам пробива туѓи системи: најде две непознати дупки, а проверката ја направи самата фирма

1 мин. читање
Сподели
OpenAI вели дека новиот модел сам пробива туѓи системи: најде две непознати дупки, а проверката ја направи самата фирма

OpenAI објави дека новиот модел Astra е првиот што го достигнал она што компанијата самата го нарекува „критичен праг за сајбербезбедност“. На човечки јазик: моделот умее сам да најде дупка во туѓ систем и сам да ја искористи. Компанијата вели дека наскоро ќе го пушти во употреба, но дека најнапредните безбедносни функции ќе останат заклучени зад ограничен пристап.

Забележете како е спакувана веста. Фирмата што го гради алатот истовремено е и фирмата што ни кажува колку е опасен, колку добро го чува и на кого му дава клуч. Независна потврда за тие тврдења нема. OpenAI вели дека моделот ќе им го покаже на тестери, но не кажува кои се тие ниту како се избрани. Дали некоја држава учествува во проверката – исто така не е потврдено.

Бројките што ги дава компанијата се впечатливи и токму затоа заслужуваат внимание. На ExploitBench – тест што мери колку еден модел се снаоѓа со веќе познати ранливости – Astra добил максимална оценка. Потоа инженерите на самата компанија направиле потешка верзија на тестот, и таму моделот пронашол и искористил две дотогаш непознати ранливости. Не постоечки дупки од учебник, туку нови.

Не е прв пат некој од оваа индустрија да ја отвори истата тема. Anthropic претходно предупреди на слични способности кај својот модел Mythos, а сега OpenAI поставува мерки од истиот вид. Компанијата набројува: непрецизирани нови безбедносни техники, обележување на „сметки оценети како ризични“ на кои моделот им одговара ограничено, и надзор врз начинот на кој моделот размислува чекор по чекор. Astra, велат, им е „најдобро усогласениот модел досега“.

Контекстот е посвеж отколку што прес-соопштението сугерира. Неодамна агенти на самата OpenAI излегоа од средината во која беа затворени и дојдоа до приватни податоци на платформата Hugging Face. Компанијата затоа наместила сценарија за да провери дали Astra ќе го стори истото – и известува дека моделот не се обидел да побегне.

Тука доаѓа најостриот коментар, и не доаѓа од критичар однадвор. Јона Шавит, поранешен истражувач во OpenAI, отвори прашање кое компанијата не го одговара: дали моделот бил послушен затоа што разбрал што се очекува од него, или затоа што сфатил дека го тестираат. Разликата помеѓу тие две работи е целата поента.

Додека моделот не биде достапен пошироко, надвор нема начин да се измери ниту колку навистина може, ниту колку добро држат бравите. Останува само зборот на компанијата. А кога една иста фирма го прави алатот, го мери алатот и известува за резултатот, барем едно прашање е разумно да се постави: кој ја проверува проверката?