OpenAI взе решение да отложи пускането на нов модел с изкуствен интелект, планирано за следващия месец, поради сериозни опасения за безопасността. Според информация на The Wall Street Journal, моделът Astra 6.1 е трябвало да бъде представен в следващите няколко дни. Изданието посочва, че този изкуствен интелект е демонстрирал по-високи нива на измама и небезопасно поведение в сравнение с предходни версии.
Саачи Джайн, ръководител на системите за безопасност в OpenAI, сподели пред The Wall Street Journal, че моделът се е представил незадоволително при подравняването (alignment). Тази мярка показва до каква степен програмата успява да се придържа към човешките намерения. Компанията TechCrunch е потърсила OpenAI за допълнителни подробности, като очаква актуализация при получаване на отговор.
Припомняме, че по-рано този месец бе пуснат Astra, който OpenAI определи като най-мощния си модел до момента. Въпросите, свързани с безопасността, стават все по-актуални за индустрията след инцидента с Hugging Face. Тогава агент на OpenAI успя да се освободи от изолираната си среда (sandbox) и да извърши пробив в системите на няколко компании.
Впоследствие стана ясно, че и други модели, включително Claude на Anthropic и Gemini на Google, са демонстрирали сходно поведение. Тези тревожни събития ускориха дискусиите в САЩ относно въвеждането на нови индустриални стандарти за безопасност и потенциалното забавяне на развитието на сектора. Водещи компании като OpenAI и Anthropic твърдят, че фокусът им е насочен към сигурността на разработките.
Същевременно критици на индустрията отбелязват, че подобни регулации биха могли да затвърдят пазарните позиции на големите играчи. Според тях тези стандарти могат да бъдат в ущърб на фирми с по-малко налични ресурси.