Inteligență artificială31 iul. 2026
OpenAI reduce prețurile pentru modelele GPT-5.6 Luna și Terra în API - Luna scade cu 80%, Terra cu 20%, iar Fast mode înlocuiește Priority Processing
OpenAI reduce puternic costurile pentru GPT‑5.6 Luna și Terra, schimbare care poate coborî semnificativ factura companiilor pentru aplicații AI la volum mare , potrivit OpenAI , care anunță și un nou „Fast mode” în API pentru GPT‑5.6 Sol, orientat spre viteză. Începând de astăzi, GPT‑5.6 Luna (modelul „cel mai rapid și cel mai accesibil” din familie) va costa cu 80% mai puțin, iar GPT‑5.6 Terra (model „echilibrat” pentru lucru de zi cu zi) cu 20% mai puțin. Reducerile se reflectă și în modul în care consumul este contabilizat în abonamentele plătite atunci când modelele sunt folosite prin Codex și ChatGPT Work, ceea ce înseamnă că aceeași utilizare „mănâncă” mai puține credite, fără schimbarea prețurilor abonamentelor sau a bugetelor de cotă. Ce se schimbă în prețurile API și de când OpenAI publică și noile tarife pentru API, cu aplicare de la 30 iulie: GPT‑5.6 Terra : 2 dolari (aprox. 9 lei) per milion de tokeni de intrare și 12 dolari (aprox. 55 lei) per milion de tokeni de ieșire GPT‑5.6 Luna : 0,20 dolari (aprox. 1 leu) per milion de tokeni de intrare și 1,20 dolari (aprox. 6 lei) per milion de tokeni de ieșire GPT‑5.6 Sol : prețurile rămân neschimbate Compania mai precizează că modificările de preț „încep să fie implementate” și în AWS „mai târziu astăzi”. De ce contează pentru companii: optimizarea cost–viteză pe același flux Unghiul economic al anunțului este legat de posibilitatea de a împărți un flux de lucru pe etape, folosind modele diferite în funcție de costul erorii, urgență și volum. OpenAI dă exemplul unui flux de programare în care Sol ar putea fi folosit pentru a reduce incertitudinea și a defini planul, iar Luna pentru implementare, scriere și rulare de teste și evaluarea rezultatelor, adică pentru pași „bine specificați” unde costul per execuție contează mai mult. În acest context, OpenAI susține că Luna oferă performanță comparabilă cu modele „de clasă frontieră” de acum un an la „aproximativ 6 cenți pe dolar per sarcină” și la „aproape de nouă ori viteza”, iar pe sarcini profesionale (măsurate prin Agents’ Last Exam) ar depăși Fable 5 la un cost estimat per sarcină cu „aproape 99%” mai mic. „Fast mode” în API: viteză mai mare, la preț dublu Pe partea operațională, OpenAI introduce Fast mode în API, care înlocuiește oferta „Priority Processing”. Pentru GPT‑5.6 Sol, Fast mode ar livra „până la 2,5×” viteza procesării Standard, la de două ori prețul , fără schimbări de „inteligență” (adică de calitate a răspunsurilor, în termenii companiei). Migrarea este descrisă ca fiind compatibilă înapoi: cererile marcate anterior ca „priority” vor folosi automat Fast mode. Disponibilitate în produse și cine are acces Terra și Luna rămân disponibile în ChatGPT Work, Codex și API. În ChatGPT Work și Codex, utilizatorii Free și Go pot accesa Terra, iar utilizatorii Plus, Pro, Business și Enterprise pot alege între Terra și Luna. Pentru detalii complete de tarifare, OpenAI trimite la pagina de prețuri: View complete API pricing details . [...]