AI

Редакция Overclock.bg ·

Alibaba: 10 трилиона параметъра и най-мощният чип в Китай

Alibaba: 10 трилиона параметъра и най-мощният чип в Китай

Изпълнителният директор на Alibaba Еди У показа на 22 септември в Ханджоу AI ускорителя Zhenwu V900 и обяви, че следващите поколения модели Qwen ще стигнат мащаб от пет до десет трилиона параметъра. Обявите бяха направени на откриването на Apsara Conference, която приключва днес, 24 септември. Акциите на компанията в Хонконг поскъпнаха с около 3% след новината.

Чипът: три пъти по-бърз, но чак догодина

Zhenwu V900 идва от чиповото поделение T-Head и по думите на У е „най-мощният AI чип в Китай днес“. Публикуваните спецификации са 216 GB памет на ускорител, 1200 GB/s честотна лента за връзка между чиповете и native поддръжка на FP8 и FP4. Производителността е три пъти по-висока от тази на предшественика Zhenwu M890, а един клъстер може да обедини до 500 000 карти.

Ключовата подробност е графикът: масово производство и търговска наличност се очакват през първото тримесечие на 2027 г. Дотогава числата остават презентация. Повече за хардуерната част и за плана за 20 GW дата центрове до 2032 г. четете в отделния ни материал за Zhenwu V900.

Моделите: Qwen 4 на четири нива

Заедно с чипа Qwen екипът показа следващото семейство модели в четири нива — Qwen 4 Max, Qwen 4 Flash, Qwen 4 Plus и Qwen 4 27B. Важното уточнение: това засега е слайд, а не продукт. Към момента нито един от четирите няма дата на излизане, цена, отворени тегла, идентификатор за API или публикувани benchmark резултати. Qwen 4 се тренира, а останалото предстои.

Числото „10 трилиона“ също се отнася за бъдещето, не за показаното сега. Според South China Morning Post целта от пет до десет трилиона параметъра е заявена за Qwen 4.5 и Qwen 5. За сравнение, текущият флагман Qwen3.8-Max е с 2,4 трилиона параметъра — тоест говорим за двукратно до четирикратно увеличение на мащаба.

У определи моделите, чиповете и облака като трите стълба на „ерата на машинния интелект“, а председателят Джо Цай заяви, че Alibaba инвестира в изграждането на full-stack AI, за да премине технологията „от технологичен пробив към създаване на стойност“.

Qwen Intelligence и агентите

Извън чипа и моделите Alibaba показа и Qwen Intelligence — платформа, с която производителите на смартфони могат да правят собствени AI асистенти за задачи през няколко приложения. Първият партньор е Honor. Компанията съобщи и че корпоративният ѝ асистент QwenWork е достигнал 30 милиона потребители за първия си месец.

Според Constellation Research екипът работи и по рекурсивно самоусъвършенстване на моделите, като докладва „осезаем напредък“. Каквото и да означава това на практика, конкретни резултати не са показани.

Qwen-Image-2.1: 7 милиарда параметъра срещу затворените модели

Ден преди конференцията Qwen пусна и Qwen-Image-2.1 — модел за генериране и редактиране на изображения с 7 милиарда параметъра във визуалната част, native 2K резолюция и поддръжка до 10 референтни изображения. Теглата са публично достъпни в Hugging Face под Qwen Research License.

Класация на моделите за изображения по Qwen-Image-Bench с брой параметри Снимка: Qwen / Alibaba

Резултатите, които Alibaba публикува, са 60,28 точки за Qwen-Image-2.1 срещу 59,82 за Google Nano Banana 2.0 и 59,65 за GPT Image 1.5. Оттам идва и заглавието в Tom’s Hardware, че модел със 7 милиарда параметъра бие затворени конкуренти.

Струва си обаче да погледнете цялата класация. Начело в нея са GPT Image 2.5 Sunburst с 67,01 и GPT Image 2 с 64,69, следвани от Grok Imagine 2.0 и Muse Image — тоест Qwen-Image-2.1 е първи сред моделите с отворени тегла, а не първи изобщо. Освен това Qwen-Image-Bench е собствен benchmark на Qwen, с 1000 двуезични промпта и AI съдия, а не независимо измерване. В ранни резултати от AI Arena подредбата е обратна: 1228 точки за Qwen-Image-2.1 срещу 1260 за Nano Banana 2.

Какво значи всичко това

Картината е логична: американските експортни ограничения отрязаха достъпа на китайските компании до върховите чипове на Nvidia, а отговорът е вертикална интеграция — собствен ускорител, собствен сървър, собствен облак и модели, оразмерени спрямо тях. Alibaba не е сама в това; същата седмица и Anthropic, и OpenAI пуснаха нови модели, а конкуренцията при отворените тегла се движи най-бързо.

За читателя има две практични заключения. Първото: от обявеното днес реално можете да ползвате само Qwen-Image-2.1 — останалото са планове с хоризонт 2027 г. Второто: когато видите заглавие за модел, който „бие“ друг, проверете чий е benchmark-ът. В случая разликата между 60,28 и 59,82 точки идва от таблица, съставена от самия победител.

Харесва ви? Отбележете ни и ще ни виждате по-нагоре в Google.

Предпочитан източник в Google

Прочетете още