AI

Редакция Overclock.bg ·

Perplexity пуска локален AI агент върху DGX Spark

Perplexity пуска локален AI агент върху DGX Spark

Perplexity пусна на 25 август Portable Computer — версия на агентската си платформа Computer, която работи изцяло върху хардуера на потребителя. Продуктът е разработен в тясно партньорство с Nvidia и стартира първо за Linux, като задачите, изпълнени локално, не се таксуват на токен. Windows версията идва през септември 2026 г., а macOS не е в плановете.

Какво точно се сваля на машината

За разлика от повечето „локални” AI приложения, тук на устройството слиза целият стек: агентският harness, оркестраторът, планировчикът, routerът за инструменти, inference машината, sandboxът и конекторите към приложенията се доставят като един пакет. VentureBeat цитира Nate, VP Engineering за инфраструктура и enterprise в компанията, който казва: „Ние на практика пренесохме точно същия интерфейс в напълно локално приложение.”

Всяка задача започва на устройството по подразбиране. Агентът може да преглежда документи, да анализира данни и да прави отчети в няколко стъпки, като се свързва с Google Drive, Gmail, GitHub и Slack.

Изпълнението е зад sandbox на ниво операционна система, който ограничава процесите, пътищата във файловата система и мрежовия достъп. Когато дадена стъпка е твърде тежка и системата иска да я прати в облака — например към Claude Opus 5 — тя първо пуска PII класификатор и показва точно какви данни ще напуснат машината. Отдалеченият модел няма пряк достъп до локалните файлове, инструменти или историята на разговора.

Хардуерът: DGX Spark или RTX с 24 GB VRAM

Минималните изисквания са GPU от клас GB10 (тоест DGX Spark) или RTX карта с поне 24 GB VRAM — на практика GeForce RTX 3090 или по-нова. За инсталация върху DGX Spark се искат 128 GB памет и 1 TB свободно място.

Самият DGX Spark е настолна машина с чип GB10 Grace Blackwell, 20-ядрен Arm процесор (10 ядра Cortex-X925 и 10 Cortex-A725), до 1 PFLOP FP4 производителност, 128 GB унифицирана LPDDR5x памет и 4 TB NVMe SSD в кутия от 150 × 150 × 50,5 мм и 1,2 кг.

Моделите също са с ясни цифри: Qwen 3.8 27B в 3-битова квантизация тежи 17,4 GB при сваляне и иска 32 GB RAM. До него стои PPLX 27B — вариант, дообучен от Perplexity специално за нейния агентски harness. Nemotron 3.5 Lightning на Nvidia (4-битов, 19 GB, 36 GB RAM) предстои.

На старта се поддържа един DGX Spark; свързването на няколко машини за по-големи модели е в пътната карта.

Числата от бенчмарковете

Perplexity публикува собствени измервания. На вътрешния Local Knowledge Work Bench от 53 задачи локалният Qwen 27B дава 82,6%, а PPLX 27B — 85,4%. На Terminal Bench 2.1 чисто локалното изпълнение стига 59,6%; с ескалация към облака се качва на 73,0% при около 0,415 долара на rollout, докато само облачният Claude Opus 5 прави 82,4% при около 0,65 долара. На BrowseComp резултатът е 66,7%.

Компанията твърди още, че системата ѝ е с 51% по-малко wall time от конкурентните harness-и и че „съвпада или надминава” Hermes и Pi по точност.

Скептицизмът

The Register отбелязва две неудобни неща. Първо, Hermes и Pi са безплатни, а Portable Computer върви само с абонамент Pro, Max, Enterprise Pro или Enterprise Max. Второ, Nvidia се споменава шест пъти в едно съобщение — в момент, в който според съобщения производителят обмисля инвестиция в Perplexity при оценка над 30 млрд. долара.

Има и трето: сметката за „нулеви такси за токени” се прави след покупката на хардуера. По оплаквания в форумите на Nvidia DGX Spark поскъпна в края на февруари 2026 г. заради недостига на памет и в европейския магазин на Nvidia върви около 4 800 евро. При такава начална инвестиция спестените API такси се изплащат бавно — освен ако причината да сте локално не е цената, а поверителността.

Заключение

Portable Computer е поредният сигнал, че тежката AI работа бавно слиза от облака на бюрото. Същата логика видяхме и при новите Mac mini с M6 и Mac Studio с M5 Ultra, а от страна на паметта — при LPDDR5X-PIM на Samsung. Ако имате DGX Spark или RTX 3090 нагоре и вече плащате Pro абонамент, си струва да пробвате. Ако нямате — изчакайте Windows версията през септември и вижте дали 24 GB VRAM ще ви стигнат.

Харесва ви? Отбележете ни и ще ни виждате по-нагоре в Google.

Предпочитан източник в Google

Прочетете още