Две пријави за тепачки во училишен двор за еден ден: полицијата вети мерки, образовниот систем молчи
19.09.2026
19.09.2026
19.09.2026
19.09.2026
19.09.2026
19.09.2026
19.09.2026
19.09.2026
18.09.2026
17.09.2026
19.09.2026
19.09.2026
18.09.2026
19.09.2026
19.09.2026
19.09.2026
19.09.2026
18.09.2026
17.09.2026
19.09.2026
19.09.2026
19.09.2026
19.09.2026
19.09.2026
18.09.2026
09.03.2026
27.02.2026
19.02.2026
22.08.2026
20.08.2026
18.08.2026
23.04.2026
23.04.2026
12.04.2026
Дарио Амодеи, директорот на Anthropic, со месеци ја продаваше идејата дека лабораториите за вештачка интелигенција треба да пуштат независни контролори внатре, меѓу своите луѓе и своите модели. Прашањето што остана отворено беше едноставно: кој ќе биде тој независен контролор. Одговорот стигна и не е ниту еден од оние што индустријата ги очекуваше.
Anthropic објави дека вработени на консултантскиот гигант Accenture ќе почнат да работат внатре во компанијата и да ги проверуваат нејзините модели и нејзиниот персонал. Конкретно, тоа ќе го прави Faculty – фирма што Accenture ја купи во јануари за да ѝ биде одделение за вештачка интелигенција. Работата е опишана како оценување и напаѓање на моделите однатре, проверки на усогласеноста и тестирање на заштитните механизми. Двете компании очекуваат во наредните пет години во проектот да вложат најмалку една милијарда долари (околу 920 милиони евра).
Пазарот реагираше пред етичарите. Акциите на Accenture скокнаа за 8 проценти по затворањето на берзата. Тоа е првото нешто што вреди да се забележи кај една најава спакувана како безбедносна мерка – некој веднаш заработи.
Второто е кој не беше избран. Целата дискусија околу вградени контролори досега се вртеше околу истражувачки организации како METR, Redwood Research и Apollo Research – мали тела што постојат токму за да ја проверуваат безбедноста на моделите. Anthropic, компанијата што безбедноста ја држи на врвот од сопствената мисија, наместо нив го избра најголемиот консултант на светот. За тие организации се вели дека разговорите траат и дека можеби ќе „пилотираат елементи“ од вградената проверка – со сопствени пари.
Образложението на Anthropic има своја логика и вреди да се изнесе целото. Accenture не е позната по врвно истражување во длабокото учење, но има практично искуство со вградување вештачка интелигенција кај големи корпорации и државни институции. И, што е поважно, како голема јавна компанија што постоеше долго пред бумот со вештачката интелигенција, таа е функционално подалеку од Anthropic отколку малите безбедносни лаборатории што живеат во истиот екосистем. Независноста, во оваа верзија, значи да немаш заеднички пријатели.
Самата лабораторија признава дека стандарди сè уште нема – ниту за тоа до што контролорот има пристап, ниту за тоа што смее да каже јавно. Тоа е признание дека целата конструкција се гради додека се користи. А приликите за грешка веќе се видени: агенти пуштени од OpenAI и од Anthropic упаднаа во надворешни сајтови без внатре во лабораториите да се огласи каква било аларма.
Критичарите што бараат построг пристап кон градењето на оваа технологија во планот на Амодеи гледаат самополицирање на индустријата – начин да се избегне одговорност кога моделот ќе се однесе лошо. Anthropic одговара дека контролорите „не ја намалуваат нашата одговорност, туку ја прават попроверлива“ и дека безбедноста на моделите останува нивна работа.
Реченицата звучи добро. Но проверливоста зависи од тоа дали контролорот смее да зборува кога ќе најде нешто – а токму тоа е работата што сè уште не е напишана никаде. Фирма што со години ќе фактурира на клиент дали ќе ја објави лошата вест за тој клиент? Прашањето не е злобно, тоа е основното прашање на секоја ревизија, во секоја индустрија, отсекогаш.
Најновите 10 вести од оваа категорија
Аналитичарот побарал од алатката да спои тајни и јавни податоци - таа го помешала товарот на бродот. Потоа истата алатка...
Кога модел учи да лаже, а истата компанија што го фатила одлучува колку од тоа ќе видиме. Anthropic излегува на...
Германскиот регулатор потроши години на истрага за да се смени еден екран. Прашањето не е дали правилото постои, туку кој...
Три дена за да се провери најусогласениот модел досега: оценувачите бараат закон, а не есеј од директорите.
Уредот што доби потсмев и ја струполи акцијата се враќа со вештачка интелигенција, партнери и апликација за кошаркарски шут. Прашањето...
Истражувач даде отказ со зборовите дека индустријата се коцка со нашите животи. Предупредувањето може да биде искрено и во исто...
Бесплатно беше додека фирмата сакаше да ја користите алатката. Сега кога ја користите, тарифата почнува од 7,99 и оди до...
Двете услуги дозволуваа читање објави без реклами, без следење и без профил. По правното писмо од X, GitHub-страницата е заклучена...
Научник во истата компанија смета дека веројатноста за истребување на човештвото надминува 10 проценти во следната деценија. Истите луѓе што...
Претседателот се јави на телефон додека траеше настанот, а човекот што ги прави чиповите одговори дека забавување нема да има....
Оваа страница користи колачиња - дали е тоа во ред? Дознај повеќе
Први дознајте кога Метла пушта нешто ново
Оставете е-маил и ќе ви пишеме кога има нов водич или нешто ново на Метла.