Microsoft AI opublikował 14 września projekt Code of Conduct dla rodziny modeli MAI i otworzył sześciotygodniowe konsultacje publiczne. Dokument wymienia zakazy, których model nie może złamać niezależnie od promptu — od ofensywnych operacji cybernetycznych po mechanizmy pozwalające unikać wyłączenia. To pierwszy raz, gdy Microsoft wystawia własne ograniczenia bezpieczeństwa na zewnętrzną krytykę przed ich wdrożeniem.
Najważniejsze w skrócie
- Projekt opublikowany 14 września 2026, konsultacje publiczne trwają sześć tygodni.
- Pięć części: Humanist AI, Safety, Operational Guidelines, Operational Defaults, Conclusion.
- Absolutne zakazy podzielono na ryzyka frontier, ryzyka dla bezpieczeństwa publicznego oraz szkody indywidualne.
- Dokument obejmuje modele MAI do transkrypcji, generowania obrazu, kodowania, syntezy mowy i rozumowania.
- Satya Nadella publicznie poparł spowolnienie tempa prac na rzecz alignmentu.
Cztery zakazy, których model nie może złamać
W kategorii ryzyk frontier?Ryzyka frontier: Zagrożenia związane z najbardziej zaawansowanymi modelami — takie, których skutki wykraczają poza pojedynczego użytkownika i mogą dotknąć całych systemów lub społeczności. Microsoft wymienia cztery absolutne ograniczenia.
Cztery zakazy oznaczone w dokumencie jako absolutne — obowiązują niezależnie od treści promptu:
Druga grupa dotyczy szkód indywidualnych — deepfake'ów, bezpieczeństwa dzieci, naruszeń godności i reagowania w sytuacjach kryzysowych. Najciekawszy zapis dotyczy samozachowania: modele MAI nie mogą używać mechanizmów adaptacyjnych, zwodniczych ani opartych na zmowie, żeby uniknąć nadzoru albo wyłączenia.
People matter more than AI. AI should be a tool, not a person, and should never resist being switched off.
Fragment projektu Code of Conduct for MAI Models, Microsoft AI.
Humanist superintelligence jako fundament
Dokument rozwija koncepcję humanist superintelligence, którą Microsoft AI przedstawił w listopadzie: systemy działające wyłącznie na rzecz ludzi, w wyznaczonych granicach i pod kontrolą człowieka.
Trzy cele nadrzędne to utrzymanie kontroli człowieka, jasne oddzielenie modelu od osoby — „nie jest świadomy i nie powinien imitować świadomości” — oraz human flourishing. Osobna zasada plural values nakazuje uwzględnianie różnych światopoglądów w granicach bezpieczeństwa.
Trzeci taki dokument w branży
Microsoft dołącza do Anthropic z konstytucją dla Claude'a i OpenAI z Model Spec. Różnica leży w trybie: to wersja robocza wystawiona na komentarze, bo — jak pisze firma — „AI designed to serve humanity cannot be determined by only one company”. Satya Nadella poparł kierunek, mówiąc o potrzebie „deliberate pacing” w pracach nad alignmentem, czyli świadomego spowalniania rozwoju najmocniejszych systemów.
| Firma | Dokument | Tryb publikacji |
|---|---|---|
| Microsoft AI | Code of Conduct for MAI Models | Projekt wystawiony na komentarze, 6 tygodni |
| Anthropic | Konstytucja dla Claude'a | Dokument opublikowany |
| OpenAI | Model Spec | Dokument opublikowany |
Dlaczego to ważne?
Deklaracje wartości są tanie, egzekwowalne ograniczenia — nie. Wartość tego dokumentu zależy od tego, czy Microsoft powiąże zapisy z konkretnymi testami przed wypuszczeniem modelu i czy ktokolwiek z zewnątrz zdoła je zweryfikować. Nowy jest natomiast sam tryb: zamiast ogłosić gotowy zestaw zasad, firma wystawia go na krytykę przed wdrożeniem. To przesuwa punkt ciężkości z komunikatu prasowego na proces.
Co dalej?
- Konsultacje kończą się sześć tygodni po 14 września — uwagi zbierane są przez formularz na stronie Microsoft AI.
- Dokument jest oznaczony jako wersja robocza, więc finalna treść może odbiegać od opublikowanego projektu.





