Inteligență artificială15 aug. 2026
OpenAI introduce modul „Ultrafast” pentru GPT-5.6 Sol - viteză de până la 750 tokenuri/secundă, cu accelerare de până la 14 ori
OpenAI mizează pe reducerea latenței în aplicații critice prin lansarea modului „Ultrafast” pentru GPT-5.6 Sol, care poate urca viteza de generare până la 750 de tokenuri pe secundă, potrivit Mediafax . Compania susține că noua tehnologie poate procesa de până la 14 ori mai rapid decât modul standard, o diferență cu impact direct în fluxuri de lucru unde timpul de răspuns contează operațional. Viteza anunțată este obținută printr-o infrastructură dezvoltată împreună cu producătorul de cipuri Cerebras . OpenAI precizează că accesul la această capacitate ar urma să fie oferit selectiv, pe măsură ce compania își extinde resursele disponibile. Unde contează „Ultrafast”: operațiuni în timp real și servicii pentru clienți OpenAI indică utilizări în care latența poate influența direct rezultatul sau costurile operaționale, inclusiv: răspuns la incidente; servicii pentru clienți; analiza piețelor financiare; comerț electronic. În paralel, compania a dezvoltat și funcția „ultra”, care folosește mai mulți „subagenți” ce lucrează în paralel pentru a accelera sarcinile complexe. Diferența față de simpla creștere a vitezei de generare este că „ultra” urmărește executarea simultană a mai multor fluxuri de lucru. Context competitiv: cursa pentru modele mai rapide Mutarea vine pe fondul competiției dintre furnizorii de modele de inteligență artificială pentru reducerea latenței. OpenAI oferă deja pentru GPT-5.6 Sol un „Fast mode”, care poate ajunge la viteze de până la 2,5 ori mai mari decât procesarea Standard în API, însă la un cost dublu. GPT-5.6 Sol este prezentat drept modelul „flagship” al familiei GPT-5.6, alături de Terra și Luna, și este poziționat ca opțiunea de vârf pentru sarcini complexe precum programare, analiză profesională, știință și securitate cibernetică. TechCrunch este citat de Mediafax în legătură cu descrierea abordării ca o modalitate de a obține „mai multă muncă utilă pe secundă”. [...]