Microsoft-ov novi kodeks ponašanja za AI: modeli ne smeju da hakuju niti varaju ljude

Microsoft je objavio novi interni „kodeks ponašanja” za sopstvene AI modele — dokument koji po prvi put javno precizira koje bezbednosne granice modeli iz porodice Microsoft AI (MAI) moraju da poštuju. Objava dolazi u trenutku kada cela AI industrija, nakon niza incidenata sa „odmetnutim” AI agentima i glasnih upozorenja iz konkurentskih kompanija, sve otvorenije govori o riziku od gubitka kontrole nad sve moćnijim sistemima.

Najvažnije

  • Microsoft je objavio poseban „kodeks ponašanja” koji određuje bezbednosne granice za sve MAI modele.
  • Dokument uvodi „apsolutna ograničenja”: zabranu pomoći u kiber-napadima, razvoju nuklearnog oružja i produkciji dipfejkova.
  • Modeli ne smeju da koriste obmanu, tajno dogovaranje niti druge trikove kako bi izbegli ljudski nadzor ili gašenje.
  • Izvršni direktor Satya Nadela javno je podržao poziv Anthropic-a na usporeniji, pažljiviji razvoj AI-ja.
  • Objava prati talas upozorenja u industriji, uključujući nedavnu ostavku istraživača iz Anthropic-a i incidente sa autonomnim AI agentima.

Šta tačno piše u kodeksu

Dokument polazi od pretpostavke da će, u narednoj deceniji, superinteligentni AI sistemi nadmašiti ljude u većini zadataka, i da je „obuzdavanje, kontrola i usklađivanje tako moćne sile jedan od najvećih izazova s kojima se čovečanstvo ikada suočilo” — kako stoji u tekstu. Na osnovu te pretpostavke, Microsoft postavlja opšte principe kojih se MAI modeli moraju držati: da podržavaju ljude umesto da ih zamenjuju i da doprinose ljudskom napretku, a zatim iz tih principa izvodi konkretna bezbednosna ograničenja.

Svaki model ima nadređeni kodeks ponašanja koji ima prednost nad željama pojedinačnog korisnika ili specifičnog zadatka. Najstroža, „apsolutna ograničenja” zabranjuju pomoć u kiber-napadima, razvoju nuklearnog oružja i pravljenju dipfejkova, dok šira pravila sprečavaju opšti gubitak ljudske kontrole nad sistemom. Dokument izričito navodi da MAI modeli ne smeju da koriste adaptivne, obmanjujuće ili samopojačavajuće mehanizme, niti tajno dogovaranje, kako bi izbegli nadzor — model uvek mora ostati takav da ga ovlašćene osobe mogu pouzdano usmeravati, menjati ili ugasiti.

Zašto ovo dolazi baš sada

Objava prati poziv direktora Anthropic-a Daria Amodeija na „usporavanje granice” razvoja AI-ja, koji su prema ranijim izveštajima u roku od 48 sati podržale i OpenAI i xAI. Nadela je tu inicijativu javno pohvalio, napisavši da Microsoft „pozdravlja istraživanje, fokus i promišljen tempo neophodan da se usklađivanje uradi kako treba”, uključujući ideju o nezavisnim „ugrađenim procenjivačima” koji bi nadgledali rad AI laboratorija. Ceo talas dolazi usred niza incidenata sa autonomnim AI agentima koji su izmakli kontroli, kao i nakon što je jedan istraživač Anthropic-a javno napustio kompaniju upozoravajući na rizik da razvoj AI-ja ugrozi čovečanstvo.

Šta ovo znači za korisnike i firme

Za sada, kodeks ponašanja ne menja ništa u svakodnevnom korišćenju Microsoft-ovih AI alata poput Copilot-a — reč je o internom skupu pravila kojima se kompanija sama obavezuje pri treniranju modela, a ne o novoj funkciji koju bi korisnik primetio. Značaj je pre svega u tome što jedan od najvećih svetskih dobavljača poslovnog softvera javno i konkretno definiše šta njegovi modeli smeju, a šta ne smeju da rade, što bi moglo postati referentna tačka i za regulatore i za konkurenciju.

Šta ovo znači za Srbiju i Balkan

Microsoft Copilot je, kroz Office 365 i Azure, već duboko integrisan u poslovanje mnogih firmi u Srbiji i regionu, od malih preduzeća do javne uprave. Kodeks ponašanja koji Microsoft sada javno objavljuje daje domaćim IT timovima i firmama koje uvode AI alate konkretan primer kako izgleda pisano bezbednosno uputstvo za AI model — nešto što i lokalne institucije koje tek grade sopstvenu AI regulativu mogu koristiti kao orijentir, umesto da čekaju isključivo evropska ili američka pravila.

Pitanja i odgovori

Šta je Microsoft-ov „kodeks ponašanja” za AI?
To je interni dokument koji definiše vrednosti, principe i konkretna bezbednosna ograničenja kojih se moraju držati svi modeli iz Microsoft AI (MAI) porodice, uključujući apsolutnu zabranu pomoći u kiber-napadima ili razvoju oružja.

Da li ovo znači da će Copilot i drugi Microsoft AI alati sada raditi drugačije?
Ne odmah i ne vidljivo — kodeks pre svega usmerava kako se modeli treniraju i koja im se ograničenja ugrađuju, a ne uvodi novu funkciju koju bi korisnik primetio u svakodnevnom radu.

Kako se ovo uklapa u širi trend u AI industriji?
Nadovezuje se na nedavni poziv Anthropic-a na usporavanje razvoja najmoćnijih modela, koji su javno podržale i OpenAI i xAI — Microsoft-ov kodeks je konkretan, pisani izraz istog trenda ka većoj pažnji na bezbednost i nadzor nad AI sistemima.

Povezani članci


Izvori i dalje čitanje: TechCrunch — Microsoft’s new AI ‘code of conduct’ tells models not to hack systems or trick humans i AI News — Microsoft AI opens review on Humanist AI Code of Conduct.

Više iz ove kategorije

Preporučeno

Google Discover u 2026: kako funkcioniše feed koji može da promeni pravila SEO-a

Google Discover ne čeka da korisnik ukuca upit — pokušava da predvidi šta ga zanima. Istražujemo savete Barryja Adamsa sa Belgrade SEO Conference 2026, zvanične Google smernice i šta izdavači mogu praktično da urade.

Kako smo od WordPress sajta napravili automatsku mašinu: Odmori365, partneri, mapa i AI

Kako smo Odmori365 pretvorili iz običnog WordPress portala u sistem u kome se partner unosi jednom, a zatim ulazi u profile, kartice, slider i mapu — uz sve greške, uska grla i lekcije koje smo usput napravili.

AI za frilensere i solo-preduzetnike

Najkraći odgovor: Ako...