На 14 септември 2026 г. OpenAI съобщи, че Perplexity използва GPT-6 Astra за комуникация, промени по софтуера и наблюдение на продукционни системи. Така един модел поема няколко етапа от оперативния процес, вместо да бъде ограничен до отделна задача.
Според OpenAI Perplexity проверява работата на Astra значително по-рядко, отколкото при предишни модели. Компанията не посочва нито честота на проверките, нито дял на грешките. Затова от публикуваната информация не може да се направи независима оценка на мащаба и безопасността на тази промяна.
Честотата на надзора е практичен измерител за агентните системи. Модел, който чака одобрение след всяка стъпка, остава асистент. Ако изпълнява по-дълги поредици от задачи самостоятелно, ролята му вече се доближава до оператор.
Наличната информация не дава отговор на повечето обичайни въпроси при представянето на нов модел:
- Не е обявен броят на параметрите.
- Няма резултати от бенчмаркове или посочени набори за оценка.
- Не са описани архитектурата, методът на обучение, поддържаните модалности или размерът на контекстния прозорец.
- Няма данни за лиценз, условия за публичен достъп или цена.
На базата на предоставените факти GPT-6 Astra не може да бъде сравнен числово с предишните водещи модели. Единственото пряко сравнение е оперативно: OpenAI твърди, че Perplexity се намесва по-рядко, отколкото при по-ранните модели.
Това може да е знак за по-висока надеждност при работа в няколко последователни стъпки. Но не замества контролирани тестове за точност, софтуерни дефекти или инциденти в продукционна среда.
Докладваната промяна е в обхвата на делегираните задачи, а не в доказан архитектурен напредък. Писането на съобщения, промяната на софтуер и наблюдението на работещи системи носят три различни нива на риск.
Слаб текст може да бъде редактиран. Грешна промяна в кода може да засегне продукта. Пропуснат сигнал от продукционна система може да забави реакцията при инцидент. Съчетаването на тези дейности проверява дали една система може да запази контекста и да следва инструкции през целия продължителен процес.
Това е като да дадете на изпълнител достъп едновременно до плановете, инструментите и аларменото табло на сградата. Стойността идва от способността му да свърши цялата работа. Но така и една грешка може да стигне по-далеч, преди човек да се намеси.
Затова Astra е най-интересен за екипи, които оценяват агенти за софтуерно инженерство, оперативно наблюдение и вътрешна комуникация. Информацията от OpenAI не доказва, че моделът е готов за работа без надзор в други среди.
Преди да приемат по-редките проверки като доказателство за надеждна автономност, разработчиците все още ще имат нужда от оценки за конкретните задачи, контрол на достъпа и ясен начин за връщане към предишно състояние.
Сравненията между модели вече не се свеждат само до качеството на отговорите. Все по-важно е колко работа може да свърши една система между две човешки проверки. Значението на Astra ще зависи от данни, които OpenAI още не е предоставила: измерими нива на грешки, условията, при които Perplexity се намесва, и доказателства, че по-слабият надзор остава безопасен, когато процесите могат да променят софтуер или да засегнат продукционни системи.




