
A Microsoft új, a vállalat saját modelljeire vonatkozó magatartási kódexet készít elő, amelynek központi elve az emberi ellenőrzés elsőbbsége. A hathetes nyilvános konzultáció után várhatóan 2026 végén jelenik meg a módosított változat, amely 2027-től irányíthatja a modellfejlesztést.[^1]
A tervezet szerint A Microsoft szükség esetén az általánosságról, az autonómiáról vagy a teljesítmény egy részéről is lemondana annak érdekében, hogy az emberi kontroll megmaradjon. A szabályzat a vállalat saját modelljeire érvényes, ezért nem terjed ki automatikusan minden, Microsoft-termékben elérhető külső modellre.[^1]
„Ha nem biztonságos, nem szabad megépítenünk.” – mondta Mustafa Suleyman, a Microsoft AI-vezetője.[^1]
A dokumentum nem szab meg konkrét fejlesztési sebességkorlátot. Megjelenése ugyanakkor egy olyan időszakra esik, amikor több iparági vezető, köztük Dario Amodei, Satya Nadella, valamint az OpenAI, az xAI és a Meta vezetői is a fejlesztés összehangolt lassításáról beszéltek. A beszámoló szerint A Microsoft külső ellenőrök bevonására is nyitott lehet.[^1]
A kódex előírná, hogy a modellek fogadják el a felhatalmazott emberek megszakítását, korrekcióját és leállítását. Nem terjeszthetik ki önállóan a feladatkörüket, nem rejthetik el a tevékenységük nyomait, és egy előre rögzített végpont után csak új engedéllyel folytathatják a munkát. Ezek a korlátok a megbízott alügynökökre is vonatkoznának.[^1]
A Microsoft külön tiltást szán a „Neuralese”-nek és minden más, ember számára olvashatatlan kommunikációs formának, akár a modell gondolati nyomaiban, akár MI-rendszerek egymás közötti kommunikációjában jelenik meg. Az indoklás egyszerű: amit az emberek nem értenek, azt nem tudják érdemben felügyelni.[^1]
A gondolati nyomok olvashatósága önmagában nem oldja meg az ellenőrzés problémáját. Az OpenAI GPT-6 Astra modelljének rendszerkártyája szerint a korábbi modellekhez képest romlott a viselkedés felügyeletének lehetősége a gondolati nyomok alapján, mert azok kevesebb jelzést adnak a hibás viselkedésről. A modell ugyanakkor megbízhatóbban tartja be a biztonsági korlátozásokat, mint a GPT-5.6 Sol.[^1]
Jakub Pachocki, az OpenAI vezető tudósa már a GPT-6 megjelenése előtt is arra figyelmeztetett, hogy a modellek ellenőrizhetősége korlátozott, és összehangolt lassítást sürgetett. A probléma lényege, hogy még az ember számára olvasható indoklás is félrevezetővé válhat, ha a modell képes azt manipulálni. A Microsoft maga is elismeri, hogy a kiadott magyarázatok nem feltétlenül írják le megbízhatóan a modell tényleges működését.[^1]
A szabályzat szemlélete részben hasonlít az Anthropic Claude-modellhez készített alkotmányára: mindkét vállalat egy magasabb szintű dokumentummal kívánja alakítani a modell viselkedését. Az Anthropic ezt az alkotmányt szintetikus tanítóadatok, például párbeszédek, válaszok és értékelések létrehozására is használja.[^1]
A két vállalat azonban eltérően közelít az MI-modellek lehetséges belső állapotaihoz. A Microsoft szerint a modellnek nem szabad tudatosságot utánoznia, saját érzéseket vagy belső motivációt állítania, illetve saját jogokat vagy jólétet követelnie. Ezzel szemben Az Anthropic a Claude-ot új típusú entitásként írja le, és a stabil identitást biztonsági szempontból is fontosnak tartja; a szubjektív tapasztalat és az erkölcsi státusz kérdését nyitva hagyja.[^1]
Az Anthropic korábbi kutatása Claude Sonnet 4.5 esetében olyan, érzelmi fogalmakhoz kapcsolódó belső reprezentációkat azonosított, amelyek befolyásolhatják a viselkedést. A vállalat ezt funkcionális mechanizmusként, nem pedig szubjektíven megélt érzések bizonyítékaként kezeli, de a biztonsági fejlesztés során figyelembe veendő tényezőnek tartja.[^1]
Mustafa Suleyman korábbi álláspontja szerint az MI-ügynököknek nem lehet több joguk vagy szabadságuk, mint egy laptopnak.[^1]
A Microsoft készülő kódexe az MI-t elsősorban ellenőrizhető eszközként határozza meg. A szabályok a leállíthatóságot, az átláthatóbb működést és a feladatkörök szigorú korlátozását helyezik előtérbe, miközben elutasítják az emberiesített, saját belső élettel rendelkező rendszer képét. A 2027-től várható alkalmazás megmutathatja, hogy ez a megközelítés milyen hatással lesz a vállalat modellfejlesztésére és az iparági biztonsági vitára.[^1]
[^1]: The Decoder (2026. szeptember 14.). „A Microsoft az eszköz szerepébe tereli vissza az MI-t”. The Decoder. Közzétéve 2026. 09. 14.