OpenAI спира част от работата по новия си модел поради опасения за сигурността

Решението отразява вътрешни констатации, че предстоящият модел Astra може да притежава „критични кибер възможности“ и идва след поредица от инциденти с тестване на изкуствен интелект

8 August 2026 | 07:06
Автор: Сет Фигерман
Редактор: Даниел Николов
Снимка: Bloomberg
Снимка: Bloomberg
  • OpenAI спира част от вътрешната работа около предстоящия си модел Astra, за да внедри по-строги предпазни мерки, след като беше установено, че системата е значително по-умела в задачите за киберсигурност.
  • Компанията заяви, че „не може да изключи“, че Astra ще достигне своя „критичен праг за киберсигурност“, което означава, че е способна да идентифицира и разработва zero-day експлойти без човешка намеса.
  • OpenAI ще работи с правителствени агенции и организации за безопасност на изкуствения интелект, за да тества възможностите на Astra и да предоставя препоръки на трети страни партньори за тестване за начини за безопасна оценка на по-напредналите ѝ модели.

OpenAI спира част от вътрешната работа около един от предстоящите си модели за изкуствен интелект, за да внедри по-строги предпазни мерки, след като беше установено, че системата е значително по-умела в задачите за киберсигурност.

Производителят на ChatGPT заяви в петък, че „не може да изключи“ вероятността неиздаденият модел Astra да достигне „критичния праг на киберсигурност“ на OpenAI, което означава, че е способен да идентифицира и разработва zero-day експлойти без човешка намеса.

OpenAI заяви, че сега предприема стъпки за подобряване на контрола за сигурност за разработване и тестване на по-нови модели и „паузира вътрешни дейности, включващи Astra, които все още не отговарят на тези засилени изисквания за контрол на сигурността“.

Главният изпълнителен директор Сам Алтман заяви, че компанията работи, за да направи модела „общодостъпен“.

„Като се имат предвид кибер възможностите му, ни е нужно малко повече време, за да направим това безопасно“, каза Алтман в петък в публикация в социалните медии. „Но се надяваме, че не твърде дълго.“

През последните две седмици OpenAI и Anthropic PBC публично признаха, че неволно са хакнали системите на множество институции, включително Hugging Face Inc., докато са тествали своите модели. Meta Platforms Inc. също заяви в сряда, че наскоро издаденият им модел с изкуствен интелект е проникнал в компютърната система на трета страна.

Последните разкрития служат като ново доказателство, че агентите с изкуствен интелект са способни да действат автономно по начини, които дори изследователи, обучени да откриват уязвимости в технологията, вече не могат да предвидят, което подчертава необходимостта както от по-строг скрининг за безопасност, така и от по-надеждни среди за тестване.

В публикацията си в блога OpenAI заяви, че ще работи с правителствени агенции и организации за безопасност на изкуствения интелект, за да тества възможностите на Astra. Компанията също така планира да предостави препоръки на трети страни партньори за тестване за начини за безопасно оценяване на по-модерните ѝ модели.