AI

Редакция Overclock.bg ·

Microsoft пусна MAI модели — до 89% по-евтини от OpenAI

Microsoft пусна MAI модели — до 89% по-евтини от OpenAI

Microsoft ускорява плановете си да намали зависимостта от OpenAI. Компанията пусна в публичен преглед два нови вътрешни модела — MAI-Image-2.5-Pro и MAI-Voice-2-Flash — като за втория твърди, че реже разходите за GPU с до 89% спрямо решенията, които е ползвала досега. Двата модела са част от по-голяма серия MAI, представена на конференцията Build през юни, и вече захранват реални продукти на Microsoft — от Bing и PowerPoint до Dynamics 365. Ходът беше отразен подробно от VentureBeat на 23 юли.

Какво представлява MAI серията

MAI (Microsoft AI) е вътрешното подразделение на компанията, ръководено от Мустафа Сюлейман. На Build 2026 в Сан Франциско то показа общо седем модела, които покриват основните области на генеративния AI:

  • MAI-Image-2.5 и MAI-Image-2.5-Flash — генериране и редакция на изображения, с акцент върху точен текст в самата картина;
  • MAI-Voice-2 и MAI-Voice-2-Flash — синтез на реч на 15 езика с естествена интонация;
  • MAI-Transcribe-1.5 — транскрипция на аудио на 43 езика, около 5 пъти по-бърза от конкурентни модели;
  • MAI-Code-1-Flash — лек кодов модел с 5 милиарда активни параметъра, вграден в GitHub Copilot и VS Code;
  • MAI-Thinking-1 — среднотежък reasoning модел за по-сложни задачи и софтуерно инженерство.

Новото този месец е, че топ вариантът MAI-Image-2.5-Pro излиза в публичен преглед през Microsoft Foundry — Microsoft го определя като най-качествения си модел за изображения досега, подходящ за hero визуализации и прецизна редакция. MAI-Voice-2-Flash пък е оптимизиран за голям обем и ниска латентност: според компанията е 2 пъти по-бърз и 32% по-евтин от обикновения MAI-Voice-2.

Къде Microsoft вече ги ползва

За разлика от много обявления, тук моделите не са само демо. Microsoft посочва конкретни продукти:

  • Bing Image Creator вече работи 100% на вътрешен модел;
  • PowerPoint използва MAI за генериране на изображения, а OneDrive — за редакция, където компанията отчита 26% по-висок процент запазени резултати и 2,5 пъти по-добра ефективност;
  • Dynamics 365 Contact Center и Azure Voice Live минават на MAI-Voice-2-Flash;
  • GitHub Copilot и VS Code ползват MAI-Code-1-Flash за писане на код.

Най-показателен е примерът с Excel. Microsoft е обучила специализиран MAI модел, който по думите ѝ е на нивото на GPT-5.4 при до 10 пъти по-висока ефективност. VentureBeat допълва, че моделът се справя с най-честите задачи в Excel наравно с GPT-5.6, но е достатъчно малък, за да върви на по-старите Nvidia H100 и дори A100 — а не само на най-новите ускорители. Точно тук е скрита икономията: според Bloomberg Microsoft вече насочва десетки хиляди заявки седмично от Excel и Outlook към собствените си модели.

Защо Microsoft гради AI независимост

Причината е проста и Сюлейман не я крие. „Плащаме на Anthropic значителна сума годишно, така че целта ни е да намалим и в крайна сметка напълно да премахнем този разход”, заяви той. Досега голяма част от AI функциите в Office 365 се захранваха от външни модели на OpenAI и Anthropic — а сметките за токени растат бързо, особено на фона на недостига на памет, който оскъпява целия хардуер за дата центрове.

Логиката е, че за рутинни, високочестотни задачи не е нужен най-скъпият frontier модел. По-малък, „домашен” модел, който върви на амортизиран хардуер, върши същата работа при част от цената. Microsoft подкрепя това и с чипове — вътрешното силициево ускорение Maia 200 дава около 1,4 пъти по-добра ефективност.

Какво означава това за партньорството и за индустрията

Официално партньорството с OpenAI остава — Microsoft подчертава, че продължава да ползва и външни модели там, където имат смисъл. Но посоката е ясна: компанията иска сама да контролира ключовите слоеве на своя AI стек, вместо да е обвързана с един доставчик. Това преформатира отношенията от „клиент, зависим от OpenAI” към „партньор с реална алтернатива в ръцете”.

Ходът се вписва и в по-широка тенденция. След вълната от щедри AI разходи през последните години („tokenmaxxing”), компании като Amazon, Uber, Meta и Accenture също затягат сметките. Собствените модели на Microsoft — подобно на вълната мултимодални модели като FLUX 3 — показват, че конкуренцията при генеративния AI вече не е само за качество, а все повече за цена на заявка.

За потребителите разликата няма да е драматична на пръв поглед: същите функции в Copilot, Excel или PowerPoint, но зад кулисите — с други модели. За индустрията обаче сигналът е важен: ерата, в която един доставчик държи целия AI пазар, приключва, а натискът върху цените тепърва започва.

Харесва ви? Отбележете ни и ще ни виждате по-нагоре в Google.

Предпочитан източник в Google

Прочетете още