
AI & Technology
OpenAI твърди, че Ultrafast ускорява GPT-5.6 Sol до 14 пъти спрямо стандартния режим. Достъпът обаче е ограничен, а данни за цената и качеството липсват.

OpenAI твърди, че GPT-5.6 Sol вече може да генерира до 750 изходни токена в секунда. Пуснат на 13 август 2026 г., Ultrafast е тестов режим, който работи до 14 пъти по-бързо от стандартната обработка на модела, съобщава TechCrunch.
Скоростта определя къде един мощен модел изобщо е практичен. Дългото чакане изключва процеси, при които отговорът трябва да дойде веднага. Аргументът на OpenAI е ясен: разработчиците не бива да избират по-малък или по-специализиран модел само заради по-ниската латентност. Ultrafast трябва да произвежда повече изход от GPT-5.6 Sol за същото време.
Зад водещото число липсват няколко детайла, без които купувачите трудно могат да вземат решение. Публикацията не посочва броя параметри, размера на контекстния прозорец, архитектурата, метода на обучение или поддържаните модалности на GPT-5.6 Sol. Няма и цена за API, абонамент или отделни лицензионни условия за Ultrafast. Не е обявена дата за масов достъп.
Пропускателната способност не е пълен тест за производителност. TechCrunch не посочва независимо измерване, набор от тестове, време до първия токен или оценки за качеството в режим Ultrafast. Числото 14x показва заявената от OpenAI скорост на генериране, но не доказва дали при това темпо се променят точността, качеството на разсъжденията или надеждността.
Anthropic вече предлага бърз режим за Claude, което оформя пряк конкурентен сблъсък. Според TechCrunch режимът на Claude не достига заявената от OpenAI скорост, но публикацията не дава числа за съпоставими модели на Anthropic. Данните показват посока, а не контролиран пряк тест. Те не позволяват и по-точно заключение кой е държал предишния технологичен връх.
Новото тук е режимът за обслужване и инфраструктурата зад него, осигурена от Cerebras, а не документирана промяна в самия GPT-5.6 Sol. Ultrafast пуска същия модел в по-бърза лента. Източникът обаче не доказва, че качеството и надеждността на резултатите се запазват, нито описва нова архитектура или метод за обучение.
OpenAI посочва реакция при инциденти, обслужване и поддръжка на клиенти, анализ на финансовите пазари и електронна търговия като целеви приложения. Във всеки от тези случаи по-бързото генериране може да скъси времето между входящото събитие и отговора на модела. Засега само избрани клиенти могат да тестват режима, докато OpenAI изгражда достатъчно капацитет за по-широк достъп.
OpenAI дава числото за скоростта, но не и доказателствата, нужни за измерване на компромиса. Когато достъпът се разшири, ще публикува ли компанията независими тестове със съпоставими модели, които показват дали GPT-5.6 Sol запазва качеството и надеждността си при 750 токена в секунда?
Източници
Тази статия е изготвена с помощта на изкуствен интелект и е прегледана и редактирана от екипа на LabForty.
Абонирайте се за седмичен обзор, когато сме публикували нещо ново. Без новини — без имейл. Можете да смените езика и темата или да се отпишете по всяко време.
Блог

LabForty разработва висококачествени уебсайтове с внимание към всеки детайл – от архитектурата до потребителското изживяване и бизнес логиката.