Anthropic i OpenAI su 16. septembra 2026. objavili da će ugraditi nezavisne procenjivače bezbednosti direktno u svoje laboratorije – timove koji će ocenjivati usklađenost (alignment) modela i objavljivati nalaze bez uredničke kontrole kompanije. Pitanje koje odmah postavljaju istraživači: da li će ti procenjivači stvarno biti nezavisni, ili će i dalje raditi po pravilima kompanije koja ih plaća?
Najvažnije
- Anthropic (Dario Amodei) i OpenAI (Sam Altman) uvode eksterne procenjivače bezbednosti unutar svojih laboratorija.
- Uključeni procenjivači: METR, Redwood Research, FAR.AI, Apollo Research, Palisade Research i Safer AI.
- Meta, xAI i Google DeepMind (za sada) NE učestvuju u ovoj inicijativi.
- Kritičari upozoravaju na ograničen pristup (ranije samo 1 nedelja ili 3 dana za testiranje), NDA ugovore i mogućnost da kompanije bira počestimu “poslušne” procenjivače.
Šta se konkretno menja
Do sada su eksterni istraživači bezbednosti često imali ograničen, kratkotrajan pristup modelima pre objavljivanja – na primer samo tri dana za testiranje GPT-6 Astra ili nedelju dana za incident vezan za Hugging Face. Nova inicijativa treba da omogući dublji, stalniji pristup, uz obećanje da procenjivači mogu objavljivati nalaze bez odobrenja kompanije.
Zašto istraživači sumnjaju u “nezavisnost”
Adam Gleave (jedan od istraživača bezbednosti) upozorava da je intelektualna svojina kompanija “toliko vredna” da će “po default-u biti veoma pažljivi oko toga šta se deli”. Henry Papadatos ide dalje: kompanije “ne mogu ići na obe strane – nulta eksterna odgovornost, a onda praviti sopstvena fleksibilna pravila”.
Ko nije uključen
Meta, xAI i Google DeepMind za sada nisu potvrdili učešće u ovoj konkretnoj inicijativi, što otvara pitanje da li će ovo postati industrijski standard ili ostati ograničeno na dve kompanije.
Ovo je nastavak šire debate o tome ko treba da nadgleda AI bezbednost – pogledaj i suprotstavljene stavove u tekstu Jensen Huang: AI bezbednosti ne treba nova regulativa.
Najčešća pitanja
Šta je “nezavisni procenjivač bezbednosti” u AI industriji?
To je eksterni tim ili organizacija (npr. METR, Apollo Research) koji testira AI modele na rizike i objavljuje nalaze, u teoriji bez uticaja kompanije koja je model razvila.
Da li OpenAI i Anthropic sada moraju da objave sve bezbednosne probleme?
Ne postoji zakonska obaveza – ovo je dobrovoljna inicijativa dve kompanije, bez spoljašnjeg mehanizma sprovođenja.
Zašto Meta i Google DeepMind nisu uključeni?
Kompanije za sada nisu potvrdile učešće u ovoj konkretnoj inicijativi; razlozi nisu javno objašnjeni.
Povezano: Pročitajte i kako je OpenAI otkrio da su njegovi modeli slali skrivene poruke narednim verzijama, i o debati da li AI modeli mogu imati svest i prava.
