Anthropic i OpenAI uvode nezavisne AI procenjivače bezbednosti – hoće li stvarno biti nezavisni?

Anthropic i OpenAI su 16. septembra 2026. objavili da će ugraditi nezavisne procenjivače bezbednosti direktno u svoje laboratorije – timove koji će ocenjivati usklađenost (alignment) modela i objavljivati nalaze bez uredničke kontrole kompanije. Pitanje koje odmah postavljaju istraživači: da li će ti procenjivači stvarno biti nezavisni, ili će i dalje raditi po pravilima kompanije koja ih plaća?

Najvažnije

  • Anthropic (Dario Amodei) i OpenAI (Sam Altman) uvode eksterne procenjivače bezbednosti unutar svojih laboratorija.
  • Uključeni procenjivači: METR, Redwood Research, FAR.AI, Apollo Research, Palisade Research i Safer AI.
  • Meta, xAI i Google DeepMind (za sada) NE učestvuju u ovoj inicijativi.
  • Kritičari upozoravaju na ograničen pristup (ranije samo 1 nedelja ili 3 dana za testiranje), NDA ugovore i mogućnost da kompanije bira počestimu “poslušne” procenjivače.

Šta se konkretno menja

Do sada su eksterni istraživači bezbednosti često imali ograničen, kratkotrajan pristup modelima pre objavljivanja – na primer samo tri dana za testiranje GPT-6 Astra ili nedelju dana za incident vezan za Hugging Face. Nova inicijativa treba da omogući dublji, stalniji pristup, uz obećanje da procenjivači mogu objavljivati nalaze bez odobrenja kompanije.

Zašto istraživači sumnjaju u “nezavisnost”

Adam Gleave (jedan od istraživača bezbednosti) upozorava da je intelektualna svojina kompanija “toliko vredna” da će “po default-u biti veoma pažljivi oko toga šta se deli”. Henry Papadatos ide dalje: kompanije “ne mogu ići na obe strane – nulta eksterna odgovornost, a onda praviti sopstvena fleksibilna pravila”.

Ko nije uključen

Meta, xAI i Google DeepMind za sada nisu potvrdili učešće u ovoj konkretnoj inicijativi, što otvara pitanje da li će ovo postati industrijski standard ili ostati ograničeno na dve kompanije.

Ovo je nastavak šire debate o tome ko treba da nadgleda AI bezbednost – pogledaj i suprotstavljene stavove u tekstu Jensen Huang: AI bezbednosti ne treba nova regulativa.

Najčešća pitanja

Šta je “nezavisni procenjivač bezbednosti” u AI industriji?

To je eksterni tim ili organizacija (npr. METR, Apollo Research) koji testira AI modele na rizike i objavljuje nalaze, u teoriji bez uticaja kompanije koja je model razvila.

Da li OpenAI i Anthropic sada moraju da objave sve bezbednosne probleme?

Ne postoji zakonska obaveza – ovo je dobrovoljna inicijativa dve kompanije, bez spoljašnjeg mehanizma sprovođenja.

Zašto Meta i Google DeepMind nisu uključeni?

Kompanije za sada nisu potvrdile učešće u ovoj konkretnoj inicijativi; razlozi nisu javno objašnjeni.

Povezano: Pročitajte i kako je OpenAI otkrio da su njegovi modeli slali skrivene poruke narednim verzijama, i o debati da li AI modeli mogu imati svest i prava.

Više iz ove kategorije

Preporučeno

Google Discover u 2026: kako funkcioniše feed koji može da promeni pravila SEO-a

Google Discover ne čeka da korisnik ukuca upit — pokušava da predvidi šta ga zanima. Istražujemo savete Barryja Adamsa sa Belgrade SEO Conference 2026, zvanične Google smernice i šta izdavači mogu praktično da urade.

Kako smo od WordPress sajta napravili automatsku mašinu: Odmori365, partneri, mapa i AI

Kako smo Odmori365 pretvorili iz običnog WordPress portala u sistem u kome se partner unosi jednom, a zatim ulazi u profile, kartice, slider i mapu — uz sve greške, uska grla i lekcije koje smo usput napravili.

AI za frilensere i solo-preduzetnike

Najkraći odgovor: Ako...