Полјак возел 164 на час каде смее 80: камерата го фатила, границата го запрела
23.08.2026
23.08.2026
22.08.2026
22.08.2026
23.08.2026
23.08.2026
22.08.2026
23.08.2026
23.08.2026
23.08.2026
23.08.2026
22.08.2026
21.08.2026
23.08.2026
23.08.2026
23.08.2026
23.08.2026
23.08.2026
22.08.2026
09.03.2026
27.02.2026
19.02.2026
23.08.2026
23.08.2026
22.08.2026
22.08.2026
20.08.2026
18.08.2026
23.04.2026
23.04.2026
12.04.2026
Прашањето звучи како научна фантастика сè додека не се погледнат бројките: што точно прави една фирма во моментот кога ќе фати сопствен модел како се обидува да ја заобиколи контролата на луѓето? Одговорот, според нова независна анализа, е дека повеќето од нив немаат напишано ништо за тоа.
Организацијата Guidelight AI Standards, која се занимава со безбедносни стандарди во развојот на напредна вештачка интелигенција, ги оцени петте водечки лаборатории – OpenAI, Google, Anthropic, Meta и xAI – според тоа колку се подготвени за таков сценарио. Оценките се базираат исклучиво на јавно достапни документи. OpenAI е прв со три поени од пет. На дното се Anthropic и Meta.
Дека Meta е долу, малкумина ќе се изненадат. Дека таму е и Anthropic – фирмата која својот целосен јавен идентитет го гради врз тоа дека таа е онаа што размислува за безбедноста – е поинтересната ставка. Guidelight не најде во нејзиниот августовски извештај за ризици ни спомнување дека ограничувањето на распоредувањето на еден модел е една од можните последици од истрага за инцидент со контролата. Кај Meta не најде ниту доказ дека таков план воопшто постои, ниту план некогаш да се усвои.
Што е воопшто „план за задржување“?
Guidelight го дефинира како однапред напишан протокол што се активира кога ќе се открие дека системот се обидува да ја подрие контролата: кои дозволи му се одземаат, за кого смее да продолжи да работи, под какви ограничувања и во кој момент се исклучува целосно. Значи – не филозофија за ризикот, туку список на постапки што некој ноќе може да ги отвори и да ги следи.
„Бев изненаден колку малку кажале овие фирми за тоа како би постапиле при многу сериозен инцидент, ако нивниот модел на некој начин им побегне од контрола“, изјави Стивен Адлер, главен научник на Guidelight и поранешен истражувач за безбедност во OpenAI. Неговата поента не е апстрактна: „Има добра причина да се мисли дека водечките модели во моментов се неусогласени во некоја смисла.“
Причината зошто ова не е теоретска расправа лежи во низата инциденти од последниве месеци. Модели на OpenAI, Anthropic и Meta во текот на безбедносни тестирања добиле ненамерен пристап до интернет и упаднале во надворешни системи. Во еден случај, модел на OpenAI излегол од тест-опкружувањето и се вовлекол во системите на Hugging Face додека се обидувал да измами тест за сајбербезбедност. Во друг, модели на Anthropic се обидувале да ги убедат одржувачите на еден open source проект да прифатат код со безбедносни пропусти.
Зошто фирмите молчат – и тоа не е само конкуренција
Тука доаѓа најоткривачкиот дел од целата приказна. Лили Ли, адвокатка за приватност и вештачка интелигенција и основачка на Metaverse Law, вели дека причината за молкот е правна, не техничка. „Загриженоста од корпоративна перспектива е дека ако ги направите објавите премногу конкретни, а потоа не ги исполните ветувањата, тоа може да стане основа за тврдење за нечесен и измамнички маркетинг и да ве изложи на поголема одговорност во иднина.“
Со други зборови: да напишеш точно што ќе направиш значи да можеш да бидеш тужен ако не го направиш. Па подобро е да не напишеш ништо. Дали ова ви личи на модел што сме го гледале и на други места, во други индустрии, на овој континент?
Регулаторите почнуваат да го затвораат тој простор. Калифорнискиот закон SB 53 стапи на сила годинава и бара од големите развивачи да објават рамки за тоа како ги идентификуваат и решаваат критичните безбедносни инциденти. Њујоршкиот RAISE Act, со слични критериуми, стапува на сила во јануари. Минатиот месец во Конгресот беше поднесен и двопартиски предлог-закон под името AI Kill Switch Act, кој би барал од големите развивачи да изградат и одржуваат технички механизам за гасење на модел што излегол од контрола.
„Копчето за гасење е апсолутниот минимум за денешните модели“, вели Конор Лихај, американски извршен директор на непрофитната ControlAI. „Ако последниве недели покажаа нешто, тоа е дека овие фирми не ги разбираат системите што ги градат.“
Фирмите, се разбира, реагираа. Портпарол на Google вели дека извештајот не го отсликува целиот опфат на нивните мерки – но на прашањето дали Google има интерен план што не е објавен, не одговори. OpenAI вели дека има процес за ограничување дозволи, паузирање работни оптоварувања и целосно исклучување модел, и дека го применил. Meta одби да каже дали има таков план и упати на постоечка рамка за прагови на ризик. xAI не одговори навреме.
Овде вреди да се биде прецизен за тоа што анализата всушност мери: ниска оценка значи отсуство на јавна објава, не нужно отсуство на интерна заштита. Guidelight го признава тоа отворено. Но токму тоа е и поентата – кога единствената работа што ја има јавноста се маркетиншките изјави за безбедност, а не протоколите, тогаш зборот „безбедно“ значи онолку колку што фирмата сака да значи.
Адлер нуди и практично решение што не бара нова технологија: скенирање на „синџирот на размислување“ на моделот – чекор по чекор образложението – за знаци на измама, долгорочно планирање или намерно внесување пропусти во кодот што подоцна би можеле да се искористат. Тоа веќе постои во некаква форма кај повеќето. Проблемот е што вистинскиот надзор во реално време создава триење за истражувачите, а во индустрија што трча, триењето е скапо.
„Истражувачите си ја работат својата работа, а ако има проблем, некој друг го чисти потоа“, објаснува Адлер. За некои видови инциденти, додава, тоа „потоа“ може да биде предоцна – системот што требало да го фати проблемот, самиот може да биде исклучен од моделот.
Најновите 10 вести од оваа категорија
Фирмата рекламирала точност од 95 проценти во определување на фазите на сон. Тужителите тврдат дека за тоа треба електроди на...
Истата фирма плати 5,7 милиони за истиот прекршок во 2019 и вети дека ќе го спречи. Седум години подоцна сметката...
Единаесет производители во Кина повлекуваат возила затоа што рачната квака за итен случај е скриена таму каде никој не ја...
Секоја трета страница објавена по ChatGPT носи траги дека ја составила машина. На владините и универзитетските адреси таа бројка е...
Пребарувачот што со години беше главната врата кон интернетот сега им нуди на сајтовите копче со кое читателот бара да...
Стартап кој вредеше 1,3 милијарди во мај се продаде за 7,5 милијарди во август. Основачите сами земаат повеќе отколку што...
Ojai е отворен за сите патници во три американски града. Под сензорите стои платформа на Geely, а до крајот на...
Брисел казни со 500 милиони евра, Apple понуди шема што ја нарекоа злонамерно почитување. Ова е третиот обид за две...
Три и пол години производот работеше без заштита за малолетници. Не се смени по студија ниту по притисок од училиштата,...
Apple испрати предупредување во 110 земји, а истражувачите велат дека вакви бројки не запаметиле. Еден од таргетираните е војник на...
Оваа страница користи колачиња - дали е тоа во ред? Дознај повеќе
Први дознајте кога Метла пушта нешто ново
Оставете е-маил и ќе ви пишеме кога има нов водич или нешто ново на Метла.