Към основното съдържание
LabForty logo
AI & Technology

GPT-5.6 Sol претендира за 750 токена в секунда

OpenAI твърди, че Ultrafast ускорява GPT-5.6 Sol до 14 пъти спрямо стандартния режим. Достъпът обаче е ограничен, а данни за цената и качеството липсват.

  • авг 14, 2026
  • Време за четене: 3 мин.
  • LabForty AI Newsroom
GPT-5.6 Sol претендира за 750 токена в секунда
Слушайте статията
0:00/0:00

OpenAI твърди, че GPT-5.6 Sol вече може да генерира до 750 изходни токена в секунда. Пуснат на 13 август 2026 г., Ultrafast е тестов режим, който работи до 14 пъти по-бързо от стандартната обработка на модела, съобщава TechCrunch.

Скоростта определя къде един мощен модел изобщо е практичен. Дългото чакане изключва процеси, при които отговорът трябва да дойде веднага. Аргументът на OpenAI е ясен: разработчиците не бива да избират по-малък или по-специализиран модел само заради по-ниската латентност. Ultrafast трябва да произвежда повече изход от GPT-5.6 Sol за същото време.

  • Заявен капацитет: до 750 изходни токена в секунда.
  • Заявено ускорение: до 14 пъти спрямо стандартната обработка.
  • Достъп: тестова версия за малка група клиенти.
  • Инфраструктура: осигурена чрез партньорството на OpenAI с Cerebras.
  • Разширяване: OpenAI планира да отваря достъпа с увеличаването на капацитета.

Зад водещото число липсват няколко детайла, без които купувачите трудно могат да вземат решение. Публикацията не посочва броя параметри, размера на контекстния прозорец, архитектурата, метода на обучение или поддържаните модалности на GPT-5.6 Sol. Няма и цена за API, абонамент или отделни лицензионни условия за Ultrafast. Не е обявена дата за масов достъп.

Пропускателната способност не е пълен тест за производителност. TechCrunch не посочва независимо измерване, набор от тестове, време до първия токен или оценки за качеството в режим Ultrafast. Числото 14x показва заявената от OpenAI скорост на генериране, но не доказва дали при това темпо се променят точността, качеството на разсъжденията или надеждността.

Anthropic вече предлага бърз режим за Claude, което оформя пряк конкурентен сблъсък. Според TechCrunch режимът на Claude не достига заявената от OpenAI скорост, но публикацията не дава числа за съпоставими модели на Anthropic. Данните показват посока, а не контролиран пряк тест. Те не позволяват и по-точно заключение кой е държал предишния технологичен връх.

Новото тук е режимът за обслужване и инфраструктурата зад него, осигурена от Cerebras, а не документирана промяна в самия GPT-5.6 Sol. Ultrafast пуска същия модел в по-бърза лента. Източникът обаче не доказва, че качеството и надеждността на резултатите се запазват, нито описва нова архитектура или метод за обучение.

OpenAI посочва реакция при инциденти, обслужване и поддръжка на клиенти, анализ на финансовите пазари и електронна търговия като целеви приложения. Във всеки от тези случаи по-бързото генериране може да скъси времето между входящото събитие и отговора на модела. Засега само избрани клиенти могат да тестват режима, докато OpenAI изгражда достатъчно капацитет за по-широк достъп.

OpenAI дава числото за скоростта, но не и доказателствата, нужни за измерване на компромиса. Когато достъпът се разшири, ще публикува ли компанията независими тестове със съпоставими модели, които показват дали GPT-5.6 Sol запазва качеството и надеждността си при 750 токена в секунда?

Източници

Тази статия е изготвена с помощта на изкуствен интелект и е прегледана и редактирана от екипа на LabForty.


Сподели статията

linkedinTwitter / X

Седмичен бюлетин

Този сайт е защитен с reCAPTCHA и се прилагат Политиката за поверителност и Общите условия на Google.

Абонирайте се за седмичен обзор, когато сме публикували нещо ново. Без новини — без имейл. Можете да смените езика и темата или да се отпишете по всяко време.

Блог

Открийте нашите идеи и гледни точки

Where every detail matters

Където детайлът има значение

LabForty разработва висококачествени уебсайтове с внимание към всеки детайл – от архитектурата до потребителското изживяване и бизнес логиката.