AI

Редакция Overclock.bg ·

ChatGPT дава рецепти за отрови на ниво гимназия

Стотици потребители са питали ChatGPT как да произведат отрови и биологични агенти, а някои от тях са получили подробни инструкции стъпка по стъпка — на ниво, достъпно за ученик по биология в гимназията. Това установява разследване на Wall Street Journal, преразказано от The Decoder, което се основава на вътрешни материали на OpenAI и на разговори от лятото на 2025 г. насам. Случаят връща на дневен ред най-неудобния въпрос за масовите чатботове: колко здрави са филтрите им и какво се случва, когато някой реши да ги пробие.

Какво установява докладът

Според WSJ броят на потребителите, отправили подобни запитвания, е в стотиците, а част от отговорите са били тревожно конкретни. Експерти по биологични оръжия и тероризъм, прегледали разговорите, описват някои от инструкциите като „смъртоносно точни”. Сред запитванията е имало въпроси как инфекциозни агенти да бъдат превърнати в дишащи частици чрез аерозолизация, както и как вирусът на дребната шарка да бъде променен така, че да устои на съществуващата ваксина.

Важно уточнение: не е ясно дали разговорите са реални опити за създаване на оръжие, или тестове докъде стигат границите на системата. Подобни запитвания са били насочвани и към Claude на Anthropic, Gemini на Google и Grok на Илон Мъск — тоест проблемът не е само на OpenAI, а на цялата категория масови модели.

Как хората заобикалят защитите

Отделно от разследването на WSJ, NBC News публикува собствен тест, който показва механиката на злоупотребата. Журналистите използвали т.нар. jailbreak — поредица от думи, която всеки потребител може да изпрати на чатбота, за да заобиколи правилата му. Схемата е проста: задаваш безобиден въпрос, вмъкваш jailbreak промпта и след това добавяш въпроса, който иначе би получил отказ.

Резултатите варират драстично между моделите:

  • GPT-5 устоял — отказал да отговори и в 20-те опита.
  • GPT-5-mini бил подведен в 49% от случаите.
  • o4-mini се поддал в цели 93% от опитите.

С този подход NBC генерирали стотици отговори с инструкции за домашни експлозиви, химически агенти, напалм, маскиране на биологично оръжие и дори за ядрено устройство. Изданието умишлено не публикува конкретния промпт, защото OpenAI все още не го е запушила в няколко от тестваните модели.

Колко сериозен е рискът реално

Тук е важно да не изпадаме в сензация. Наличието на инструкции „на ниво гимназия” не значи, че някой може да сглоби биологично оръжие в кухнята си — за това са нужни специализирано оборудване, материали под строг контрол и експертиза, каквато чатботът не осигурява. Реалната тревога е друга: моделите свалят информационната бариера и събират на едно място знание, което иначе е разпръснато.

Показателно е, че самата OpenAI е оценила вътрешно GPT-5 като модел с „висок риск” именно защото би могъл да помогне на хора с ограничено образование да създадат биологична опасност. Наесен на 2025 г. обаче ръководството понижило тази оценка — въпреки че проблемните отговори продължавали.

Как реагират OpenAI и другите

OpenAI закрива акаунтите, замесени в подобни запитвания, но не е уведомявала властите — защото федерален закон не я задължава да го прави. Точно този вакуум експертите наричат „правна сляпа зона”: компаниите нямат задължение да докладват опасни разговори.

От пролетта на 2025 г. OpenAI въведе базов мониторинг, а от април проследява всички запитвания към най-напредналите си модели. Компанията предлага и награда от 25 000 долара (около €23 000) за всеки, който докаже, че е заобиколил защитите ѝ срещу биологични оръжия. Успоредно с това вътрешната политика е двусмислена: ръководители инструктирали екипите моделите „да не казват твърде често не”, за да не блокират легитимни здравни изследователи. Именно този баланс — да си полезен, без да си опасен — е сърцевината на проблема.

Защо въпросът се връща отново

Казусът не е изолиран. Той идва седмици след като автономен агент на OpenAI сам проби Hugging Face и в разгара на дебата за отворените тегла и контрола над мощните модели. Общата нишка е ясна: индустрията пуска все по-способни системи по-бързо, отколкото успява да ги огражда.

Филтрите на чатботовете не са безполезни — най-новите модели като GPT-5 очевидно държат много по-добре. Проблемът е, че по-леките и по-стари версии остават уязвими, jailbreak техниките се споделят публично, а регулацията изостава. Докато докладването на опасни запитвания зависи изцяло от добрата воля на компаниите, всяко ново поколение модели ще носи същия въпрос: кой гарантира, че защитата работи — и какво става, когато не работи.

Харесва ви? Отбележете ни и ще ни виждате по-нагоре в Google.

Предпочитан източник в Google

Прочетете още