Inteligență artificială14 aug. 2026
OpenAI testează un nivel de serviciu „Ultrafast” pentru GPT-5.6 Sol - promite până la 14 ori mai multă viteză și 750 de tokeni/s prin API, pe infrastructură Cerebras
OpenAI testează un nivel de serviciu care poate accelera GPT-5.6 Sol de până la 14 ori , o schimbare cu impact direct asupra costurilor operaționale și a modului în care companiile pot folosi modele avansate în aplicații unde latența (timpul de răspuns) este critică, potrivit 9to5Mac . Noul nivel, numit „Ultrafast”, ar rula GPT-5.6 Sol „de până la 14 ori mai repede” decât procesarea standard, iar OpenAI indică o viteză de generare de până la 750 de tokeni de ieșire pe secundă (tokenii sunt unități de text folosite de modele pentru a „măsura” inputul și outputul). Ce se schimbă operațional: viteză mare, disponibilitate limitată „ Ultrafast mode ” pornește inițial prin OpenAI API și este alimentat de Cerebras, conform detaliilor publicate de companie pe pagina dedicată Ultrafast mode . Accentul este pe reducerea latenței, ceea ce poate face fezabile fluxuri de lucru care până acum erau încetinite de timpii de răspuns ai modelului, chiar dacă „inteligența” modelului era suficientă. Accesul rămâne, însă, limitat la un grup select de clienți, în timp ce OpenAI evaluează cum se traduce creșterea de viteză în produse reale și cum își poate extinde capacitatea. Unde mizează OpenAI: sarcini „live” și utilizări cu presiune pe timp OpenAI vede acest mod ca suport pentru activități „live” sau aproape de producție, inclusiv: voce; suport clienți; comerț; agenți pentru dezvoltatori; cercetare financiară; răspuns la incidente de securitate. Compania spune că propriii dezvoltatori l-au folosit pentru analizarea de loguri și urme tehnice în timpul incidentelor și pentru a comprima cicluri de cercetare care anterior rulau peste noapte în mai multe iterații în timpul zilei de lucru. Context: GPT-5.6 Sol și familia de modele OpenAI a introdus GPT-5.6 Sol în iunie, alături de Terra (orientat pe echilibru) și Luna (orientat pe viteză), iar familia a devenit disponibilă pe scară mai largă în iulie, inclusiv prin ChatGPT, Codex și API, potrivit materialelor anterioare ale publicației: iunie și iulie . Ce urmează pentru companii Companiile interesate pot intra pe lista de așteptare pentru Ultrafast prin formularul OpenAI de înscriere , unde trebuie să furnizeze detalii despre tipul de sarcină, cerințele de latență, utilizarea estimată și alte informații. În acest stadiu, OpenAI nu indică în materialul citat un calendar de extindere generală sau condiții comerciale detaliate pentru noul nivel. [...]