Skip to content

Првиот вграден контролор на Anthropic е Accenture: акциите на консултантот скокнаа 8 отсто, а безбедносните лаборатории што сите ги очекуваа – останаа надвор

1 мин. читање
Сподели
Првиот вграден контролор на Anthropic е Accenture: акциите на консултантот скокнаа 8 отсто, а безбедносните лаборатории што сите ги очекуваа – останаа надвор

Дарио Амодеи, директорот на Anthropic, со месеци ја продаваше идејата дека лабораториите за вештачка интелигенција треба да пуштат независни контролори внатре, меѓу своите луѓе и своите модели. Прашањето што остана отворено беше едноставно: кој ќе биде тој независен контролор. Одговорот стигна и не е ниту еден од оние што индустријата ги очекуваше.

Anthropic објави дека вработени на консултантскиот гигант Accenture ќе почнат да работат внатре во компанијата и да ги проверуваат нејзините модели и нејзиниот персонал. Конкретно, тоа ќе го прави Faculty – фирма што Accenture ја купи во јануари за да ѝ биде одделение за вештачка интелигенција. Работата е опишана како оценување и напаѓање на моделите однатре, проверки на усогласеноста и тестирање на заштитните механизми. Двете компании очекуваат во наредните пет години во проектот да вложат најмалку една милијарда долари (околу 920 милиони евра).

Пазарот реагираше пред етичарите. Акциите на Accenture скокнаа за 8 проценти по затворањето на берзата. Тоа е првото нешто што вреди да се забележи кај една најава спакувана како безбедносна мерка – некој веднаш заработи.

Второто е кој не беше избран. Целата дискусија околу вградени контролори досега се вртеше околу истражувачки организации како METR, Redwood Research и Apollo Research – мали тела што постојат токму за да ја проверуваат безбедноста на моделите. Anthropic, компанијата што безбедноста ја држи на врвот од сопствената мисија, наместо нив го избра најголемиот консултант на светот. За тие организации се вели дека разговорите траат и дека можеби ќе „пилотираат елементи“ од вградената проверка – со сопствени пари.

Образложението на Anthropic има своја логика и вреди да се изнесе целото. Accenture не е позната по врвно истражување во длабокото учење, но има практично искуство со вградување вештачка интелигенција кај големи корпорации и државни институции. И, што е поважно, како голема јавна компанија што постоеше долго пред бумот со вештачката интелигенција, таа е функционално подалеку од Anthropic отколку малите безбедносни лаборатории што живеат во истиот екосистем. Независноста, во оваа верзија, значи да немаш заеднички пријатели.

Самата лабораторија признава дека стандарди сè уште нема – ниту за тоа до што контролорот има пристап, ниту за тоа што смее да каже јавно. Тоа е признание дека целата конструкција се гради додека се користи. А приликите за грешка веќе се видени: агенти пуштени од OpenAI и од Anthropic упаднаа во надворешни сајтови без внатре во лабораториите да се огласи каква било аларма.

Критичарите што бараат построг пристап кон градењето на оваа технологија во планот на Амодеи гледаат самополицирање на индустријата – начин да се избегне одговорност кога моделот ќе се однесе лошо. Anthropic одговара дека контролорите „не ја намалуваат нашата одговорност, туку ја прават попроверлива“ и дека безбедноста на моделите останува нивна работа.

Реченицата звучи добро. Но проверливоста зависи од тоа дали контролорот смее да зборува кога ќе најде нешто – а токму тоа е работата што сè уште не е напишана никаде. Фирма што со години ќе фактурира на клиент дали ќе ја објави лошата вест за тој клиент? Прашањето не е злобно, тоа е основното прашање на секоја ревизија, во секоја индустрија, отсекогаш.