Știri
Tag: gpt-5.6 sol

OpenAI reduce cu peste 20% costurile de utilizare pentru GPT-5.6 Sol , o mișcare care poate coborî semnificativ factura companiilor ce rulează volume mari de cereri prin API, potrivit IT之家 . Reducerile se aplică atât tarifelor API, cât și costurilor în credite, pe o perioadă de trei luni, iar funcționalitatea este deja disponibilă în API și se distribuie treptat către planurile cu credite ChatGPT Work și Codex. Noile tarife: scăderi mai mari la ieșire și la „long context” Anterior, GPT-5.6 Sol costa 5 dolari (aprox. 23 lei) pentru 1 milion de tokeni la intrare și 30 de dolari (aprox. 138 lei) pentru 1 milion de tokeni la ieșire. Conform noii grile: Intrare (input): 4 dolari / 1 milion tokeni (aprox. 18 lei), -20% Ieșire (output): 20 dolari / 1 milion tokeni (aprox. 92 lei), -33% Pentru componentele legate de cache (stocare temporară pentru reutilizarea rezultatelor), OpenAI reduce: cache input: de la 0,5 dolari la 0,4 dolari cache write: de la 6,25 dolari la 5 dolari Și segmentul de „long context” (ferestre de context mai mari, utile pentru documente lungi) este ieftinit: intrare: de la 10 dolari la 8 dolari ieșire: de la 45 dolari la 30 dolari Ce se schimbă pentru utilizatori și ce rămâne la fel OpenAI spune că modificările sunt active în API și sunt livrate gradual către planurile bazate pe credite pentru ChatGPT Work și Codex. În același timp, abonamentele Pro, Plus și Business nu își schimbă regulile de utilizare și beneficiile , conform informațiilor din aceeași sursă. În context, publicația trimite și la un material anterior despre o reducere separată pentru GPT-5.6 Luna, fără a indica aici detalii suplimentare despre impactul comparativ. [...]

OpenAI mizează pe reducerea latenței în aplicații critice prin lansarea modului „Ultrafast” pentru GPT-5.6 Sol, care poate urca viteza de generare până la 750 de tokenuri pe secundă, potrivit Mediafax . Compania susține că noua tehnologie poate procesa de până la 14 ori mai rapid decât modul standard, o diferență cu impact direct în fluxuri de lucru unde timpul de răspuns contează operațional. Viteza anunțată este obținută printr-o infrastructură dezvoltată împreună cu producătorul de cipuri Cerebras . OpenAI precizează că accesul la această capacitate ar urma să fie oferit selectiv, pe măsură ce compania își extinde resursele disponibile. Unde contează „Ultrafast”: operațiuni în timp real și servicii pentru clienți OpenAI indică utilizări în care latența poate influența direct rezultatul sau costurile operaționale, inclusiv: răspuns la incidente; servicii pentru clienți; analiza piețelor financiare; comerț electronic. În paralel, compania a dezvoltat și funcția „ultra”, care folosește mai mulți „subagenți” ce lucrează în paralel pentru a accelera sarcinile complexe. Diferența față de simpla creștere a vitezei de generare este că „ultra” urmărește executarea simultană a mai multor fluxuri de lucru. Context competitiv: cursa pentru modele mai rapide Mutarea vine pe fondul competiției dintre furnizorii de modele de inteligență artificială pentru reducerea latenței. OpenAI oferă deja pentru GPT-5.6 Sol un „Fast mode”, care poate ajunge la viteze de până la 2,5 ori mai mari decât procesarea Standard în API, însă la un cost dublu. GPT-5.6 Sol este prezentat drept modelul „flagship” al familiei GPT-5.6, alături de Terra și Luna, și este poziționat ca opțiunea de vârf pentru sarcini complexe precum programare, analiză profesională, știință și securitate cibernetică. TechCrunch este citat de Mediafax în legătură cu descrierea abordării ca o modalitate de a obține „mai multă muncă utilă pe secundă”. [...]