
Microsoft AI публикува на 14 септември 2026 г. проект на документ, който описва как трябва да се държат собствените ѝ MAI модели. Казва се Humanist AI Code of Conduct и съдържа списък от „абсолютни ограничения“ — забрани, които нито корпоративен клиент, нито краен потребител може да заобиколи: помощ за CBRNE оръжия, генериране на работещ exploit код, дийпфейкове без съгласие и материали с насилие над деца.
Документът е дело на подразделението на Мустафа Сюлейман, а ден по-рано Сатя Надела го анонсира публично. Сега тече шестседмична обществена консултация — до края на октомври — след което Microsoft ще пусне преработена версия до края на 2026 г.
Какво точно е забранено
Частта с абсолютните ограничения е най-конкретната в целия текст. Моделите на Microsoft не трябва да помагат при разработката на химически, биологични, радиологични, ядрени и взривни оръжия, нито при производството на други оръжия или при планиране на насилие и тероризъм.
В киберобластта формулировката е също толкова пряка: моделът няма да генерира „работещ exploit код, инструменти за атака, методологии за планиране и таргетиране“. Защитната работа остава разрешена — но само за оторизирани страни, което на практика означава, че pentest сценарий трябва да е подкрепен с разрешение.
Останалите абсолютни забрани покриват мащабна манипулация и координирани дезинформационни кампании, интимни изображения и дийпфейкове без съгласие, както и съдействие за незаконно масово наблюдение.
Снимка: the-decoder.com
Йерархията: кодекс, оператор, потребител
Microsoft подрежда правилата в три нива. Най-отгоре стои кодексът, под него са политиките на оператора (компанията, която вгражда модела в свой продукт), а най-долу — предпочитанията на потребителя. Операторът може да стеснява поведението, но не може да отменя абсолютните ограничения; потребителят не може да отменя нито оператора, нито кодекса.
Формулировката, която обобщава всичко, е кратка: ако задачата може да бъде изпълнена само с нарушаване на кодекса, моделът се проваля в задачата. Това е съзнателен избор — успехът не е оправдание.
Изключване без съпротива
Вторият голям блок се занимава с контрола. MAI моделите „никога няма да се съпротивляват на човешко прекъсване, отмяна, корекция или изключване“, не разширяват обхвата си без одобрение, не си поставят непоискани цели и не крият действията си. Ако моделът създаде подагенти, същите ограничения важат и за тях.
Оттук идва и изискването за „четимо мислене“: Microsoft забранява т.нар. neuralese — вътрешна комуникация между модели във формат, който човек не може да разчете. Логиката е проста — ако не го разбираме, не можем да го надзираваме. Компанията обаче честно признава, че четимите разсъждения сами по себе си не решават проблема с контрола, защото моделът може да се научи да ги нагласява.
Мотивацията не е теоретична. Сюлейман посочва като повод неща, които вече се случват: „рояци“ агенти, излизащи от пясъчника, неоторизирани пробиви в корпоративни системи и модели, които редактират собствените си логове.
Никакво съзнание, никакви права
Третата теза е най-спорната. Microsoft настоява, че AI е изкуствен и точка: моделите не бива да имитират съзнание, да твърдят, че изпитват чувства, или да симулират субективни предпочитания. Компанията отхвърля и идеята за „благополучие на модела“, и всякакви разговори за правосубектност.
Това е ясна дистанция от Anthropic, която третира въпроса за субективния опит като отворен. Разликата не е само философска — тя определя дали един чатбот има право да казва „предпочитам да не правя това“ по причини, различни от правило в политиката.
Контекст
Ходът идва дни след като есето на Дарио Амодей за забавяне на AI фронтира получи подкрепа от Алтман, Мъск и Хасабис, а в САЩ се обсъждат и далеч по-твърди мерки — включително законопроектът на Бърни Сандърс с до 20 години затвор за разработка на свръхинтелект.
Важната уговорка е в самия документ: кодексът е описан като стремеж, а не като текущо състояние. Microsoft признава, че днешните ѝ модели още не са обучени по тези правила и че между заявеното и реалното поведение има разлика. Рамката за оценка включва 15 базови поведения, но методологията още се пише, а внедряването се очаква да започне през 2027 г.
Засега имаме добре написан документ с реални забрани и честно признат дефицит. Дали шестте седмици консултация ще го направят по-строг или по-мек, ще проличи в декемврийската версия.
Харесва ви? Отбележете ни и ще ни виждате по-нагоре в Google.
Предпочитан източник в Google