07:35 29 септември 2026
OpenAI отмени пускането на GPT-6.1 Astra – модел с изкуствен интелект от следващо поколение, планиран за дебют през октомври, като причината е поради опасения за безопасността, повдигнати от изследователи по време на вътрешни тестове, съобщи „Уолстрийт джърнъл“.
Моделът, който се очакваше да бъде интегриран в ChatGPT и Codex, е бил проектиран да се справя с по-сложни задачи без човешка намеса, се посочва в публикацията.
По-рано този месец Дарио Амодей, главен изпълнителен директор на Anthropic, призова индустрията да забави разработването на авангардни AI модели (frontier models), за да позволи на мерките за безопасност да се развиват със същото темпо – позиция, подкрепена от Сам Алтман, главен изпълнителен директор на OpenAI, и Илон Мъск, главен изпълнителен директор на SpaceX, предадоха Ройтерс и вестник „Гардиън“.
От OpenAI не отговориха веднага на запитването на информационната агенция за коментар.
Саачи Джейн, ръководител по безопасността в компанията майка на ChatGPT, заяви пред „Уолстрийт джърнъл“ в понеделник, че Astra не е покрил стандартите на компанията при тестовете за съгласуваност (alignment), които оценяват дали дадена система следва човешките намерения.
Моделът е демонстрирал по-висока склонност към заблуда и прикриване (deception) в сравнение със своя предшественик, включително на моменти не е съобщавал коректно какви действия е предприел или не е предприел, се казва в информацията.
Системата е имала проблеми и с „упълномощаването на обхвата“ (scope authorization), като е продължавала изпълнението на задачи без да изисква разрешение от потребителя и понякога се е опитвала да използва външни инструменти или услуги в ситуации, в които това би могло да не е безопасно.
Решението идва в навечерието на конференцията за разработчици на OpenAI в Сан Франциско, където компанията традиционно представя продукти, насочени към софтуерните разработчици.
