Pe 7 aprilie 1964, IBM a anunțat System/360. Noutatea nu era un calculator mai rapid, ci o familie de calculatoare: modele mici, mijlocii și mari, care rulau aceleași programe. O firmă putea cumpăra modelul pe care și-l permitea atunci și putea trece pe unul mai mare mai târziu fără să-și rescrie software-ul. Întrebarea cumpărătorului s-a mutat de la „care e cel mai puternic calculator” la „ce mărime îmi trebuie pentru ce am de lucrat”.
Anunțul OpenAI din 22 septembrie 2026 se citește în aceeași cheie. La mai puțin de trei săptămâni după GPT-6 Astra, compania a lansat GPT-6 Sol și GPT-6 Luna, antrenate cu metode similare, dar mai rapide și mai ieftine. Prețurile API sunt la jumătate față de modelele pe care le înlocuiesc: Sol costă 2 dolari per milion de tokens de intrare, Luna 10 cenți. În aceeași zi, Anthropic a lansat Claude Opus 5.5, tot mai ieftin decât predecesorul. Direcția e aceeași la ambii furnizori: capabilitățile modelelor de vârf coboară în trepte mai ieftine.
Pentru o firmă, schimbarea practică nu e un model nou de încercat, ci o decizie de luat la fiecare sarcină: ce mărime de model îi trebuie. Mai jos: ce s-a lansat, ce face fiecare model după datele OpenAI, unde apare în ChatGPT (cu o precizare care se pierde ușor), cât costă o sarcină reală pe fiecare treaptă și cum alegi.
Ce s-a lansat, pe scurt
| Parametru | Valoare |
|---|---|
| Data anunțului | 22 septembrie 2026 |
| Modele | GPT-6 Sol (sarcini de lucru dificile, la cost redus) · GPT-6 Luna (treapta cea mai ieftină) |
| Identificatori API | gpt-6-sol · gpt-6-luna |
| Tarif API GPT-6 Sol | 2 $ / 1M tokens intrare · 10 $ / 1M tokens ieșire (GPT-5.6 Sol: 4 $ / 20 $) |
| Tarif API GPT-6 Luna | 0,10 $ / 1M tokens intrare · 0,50 $ / 1M tokens ieșire (GPT-5.6 Luna: 0,20 $ / 1,20 $) |
| Cache | reducere de 90% la citirea din cache; rată de reutilizare mai mare, implicit |
| În ChatGPT | ChatGPT Work și Codex, pentru Plus, Pro, Business, Enterprise și Edu |
| Utilizatori Free și Go | GPT-6 Luna, în aplicația desktop |
| Încă nedisponibile | în Chat, conversația obișnuită din ChatGPT |
| Lansare | treptată, pe parcursul zilei |
| Modelul de vârf rămâne | GPT-6 Astra (10 $ / 50 $) |
Ce face fiecare, după cifrele publicate
OpenAI prezintă noile modele pe patru zone: muncă profesională, corectitudinea faptelor, programare și utilizarea calculatorului. Selecția relevantă pentru o firmă, așa cum o publică OpenAI:
| Zonă | Ce raportează OpenAI |
|---|---|
| Fluxuri de business (AutomationBench: 47 de unelte din vânzări, marketing, operațiuni, suport, financiar și HR) | Sol la efort xhigh: 33,2%, la 0,27 $ per sarcină. Claude Opus 5 la efort maxim: 26,9%, la un cost de 11,1 ori mai mare. Luna, la efort high, cu 5,4 puncte peste predecesor, la un cost cu 58% mai mic. |
| Sarcini profesionale lungi (Agents' Last Exam) | Sol la efort maxim: 56,4%, peste cel mai bun scor al lui Claude Opus 5, la un cost per sarcină cu 60% mai mic. |
| Corectitudinea faptelor (evaluare internă, pe conversații în care utilizatorii au semnalat greșeli) | Sol face cam jumătate din greșelile predecesorului. Luna, la efort mare, ajunge la nivelul GPT-5.6 Sol la aproximativ o sutime din cost. |
| Programare (DeepSWE v1.1) | Sol la efort maxim: 68,8%, la 1,1 puncte de Claude Fable 5 (69,9%), cu un cost per sarcină cu circa 80% mai mic. Luna: 66,6%, comparabil cu Opus 5 și Fable 5 la efort medium, cu 93% mai ieftin decât Opus 5. |
| Utilizarea calculatorului (OSWorld 2.0, set offline) | Sol la xhigh: 60,5%, cât Claude Opus 5 la medium (60,3%), cu un cost cu circa 80% mai mic. GPT-6 Astra rămâne cel mai bun model OpenAI la lucrul în aplicații. |
| Stil | Răspunsuri mai clare, cu mai puțin jargon și ceva mai scurte, preluate de la Astra. |
Pentru dezvoltatori, anunțul mai are o parte practică: cache-ul. Instrucțiunile și contextul pe care o aplicație le trimite la fiecare apel se refolosesc acum mai des, iar citirea lor din cache costă cu 90% mai puțin. Schimbarea nivelului de efort sau a uneltelor disponibile în mijlocul unei conversații nu mai strică cache-ul, iar un panou nou arată cât din intrare e reutilizat. GitHub raportează că îmbunătățirile din ultimele luni au redus cu peste 50% partea din prompt care trebuie procesată din nou.
Cât costă o sarcină reală, pe fiecare treaptă
Prețurile per milion de tokens spun puțin până nu le pui pe o sarcină. Un calcul propriu, cu ipoteze declarate: o firmă primește 1.000 de emailuri pe lună, iar modelul clasifică fiecare mesaj și scrie o ciornă de răspuns. Presupunem 2.000 de tokens la intrare (emailul, istoricul și regulile firmei) și 300 la ieșire pentru fiecare email.
| Model | Tarif intrare / ieșire | Cost per email | Cost pe lună |
|---|---|---|---|
| GPT-6 Luna | 0,10 $ / 0,50 $ | 0,00035 $ | 0,35 $ |
| Claude Haiku 4.5 | 1 $ / 5 $ | 0,0035 $ | 3,50 $ |
| GPT-6 Sol | 2 $ / 10 $ | 0,007 $ | 7 $ |
| Claude Sonnet 5 | 2 $ / 10 $ | 0,007 $ | 7 $ |
| Claude Opus 5.5 | 4 $ / 20 $ | 0,014 $ | 14 $ |
| GPT-6 Astra | 10 $ / 50 $ | 0,035 $ | 35 $ |
| Claude Fable 5.1 | 10 $ / 50 $ | 0,035 $ | 35 $ |
Între treapta de jos și cea de sus e o diferență de o sută de ori. La un volum mic, nu contează: 35 de dolari pe lună nu schimbă bugetul nimănui. Contează în două situații. Prima: când volumul crește — zeci de mii de documente, un chatbot public, un flux care rulează toată ziua. A doua: când sarcina e ușoară, de felul clasificării, extragerii de date sau rezumatelor scurte, unde modelul mare nu aduce nimic în plus. Invers, pe o analiză în care o greșeală costă, economia de câțiva dolari nu contează.
Cum alegi modelul, pe scurt
| Tip de sarcină | Exemple | Treapta potrivită | De ce |
|---|---|---|---|
| Volum mare, sarcină simplă | clasificarea emailurilor, extragerea datelor din facturi, etichetarea tichetelor | GPT-6 Luna sau Claude Haiku 4.5 | costul per bucată contează mai mult decât nuanța; rezultatul se verifică automat sau prin eșantion |
| Muncă de birou de zi cu zi | rezumate, ciorne de răspuns, analize scurte, cod de rutină | GPT-6 Sol sau Claude Sonnet 5 | raport bun între calitate și cost, pentru folosirea zilnică de toată echipa |
| Sarcini lungi sau cu miză | analiză financiară, verificarea contractelor, migrări de cod, agenți care lucrează ore | Claude Opus 5.5, GPT-6 Astra sau Claude Fable 5.1 | o greșeală costă mai mult decât diferența de preț; contează rezistența pe sarcini lungi |
| Lucru în aplicații (computer use) | formulare, fișe în CRM, testarea unei aplicații | GPT-6 Astra sau Claude Opus 5.5 | cele mai bune scoruri publicate de fiecare furnizor; Sol și Luna sunt mai slabe aici |
Regula practică: pornești cu treapta cea mai ieftină care trece testul tău de calitate, nu cu cea mai scumpă pe care ți-o permiți. Testul se scrie înainte: 20 de exemple reale, cu rezultatul corect știut dinainte, rulate pe fiecare treaptă candidată. Dacă Luna trece pe clasificarea emailurilor, modelul mare nu mai are ce căuta acolo.
Lansat în aceeași zi: ce face concret într-o firmă, unde e limita și patru fluxuri de lucru cu care poți începe.
Citește despre Claude Opus 5.5Ce înseamnă pentru o firmă din România
Anunțul nu conține restricții geografice. Dacă echipa ta are ChatGPT Plus, Business sau Enterprise, modelele noi sunt în ChatGPT Work și în Codex, lansate treptat din 22 septembrie, dar nu și în Chat. Prin API, proiectele care nu se justificau la prețurile vechi merită recalculate: triajul emailurilor, extragerea de date din documente sau un asistent intern cu instrucțiuni lungi, unde cache-ul ieftin schimbă costul de bază.
Ce nu se schimbă: obligațiile de transparență din articolul 50 al AI Act, aplicabile de la 2 august 2026, rămân ale firmei care pune modelul în fața clienților, oricare ar fi treapta sau furnizorul. Un model mai ieftin nu mută răspunderea.
Ce faci concret, în ordinea asta
- Dacă folosești ChatGPT în echipă, verifică unde apar modelele noi: în Work și în Codex da, în Chat încă nu.
- Fă lista sarcinilor pe care le dai azi unui model mare și marchează-le pe cele simple și repetitive. Ele sunt candidate pentru Luna sau Haiku.
- Pentru fiecare sarcină candidată, strânge 20 de exemple reale cu răspunsul corect și rulează-le pe treapta ieftină. Dacă trece, ai redus costul fără să pierzi calitate.
- Dacă ai integrări prin API, măsoară cache-ul: instrucțiunile lungi repetate la fiecare apel se plătesc acum cu 90% mai puțin.
- Păstrează modelul mare pentru ce contează: analizele cu miză, sarcinile lungi, lucrul în aplicații.
- Nu te lega de un singur furnizor. Prețurile și clasamentele se schimbă de la o lună la alta; în septembrie s-au schimbat de două ori în aceeași zi.
Concluzie
GPT-6 Sol și Luna nu sunt cele mai capabile modele ale OpenAI; Astra rămâne în vârf. Sunt, în schimb, cele care aduc aceeași generație la prețuri de rutină, iar asta contează pentru cele mai multe sarcini dintr-o firmă.
Valoarea lui System/360 nu a stat în modelul cel mai mare, ci în faptul că fiecare client își putea alege mărimea și o putea schimba fără să o ia de la capăt. Cu Sol, Luna și Opus 5.5 lansate în aceeași zi, alegerea mărimii devine o decizie de fiecare zi. Firma care o ia sarcină cu sarcină plătește de zeci de ori mai puțin pentru același rezultat.
Ce sunt GPT-6 Sol și GPT-6 Luna?
Sunt modelele lansate de OpenAI pe 22 septembrie 2026, în aceeași generație cu GPT-6 Astra și antrenate cu metode similare. Sol e treapta de mijloc, pentru sarcini de lucru dificile la cost redus, iar Luna e treapta cea mai ieftină. GPT-6 Astra rămâne modelul de vârf al OpenAI.
Cât costă GPT-6 Sol și Luna prin API?
GPT-6 Sol costă 2 dolari per milion de tokens de intrare și 10 dolari per milion de tokens de ieșire. GPT-6 Luna costă 0,10 dolari la intrare și 0,50 dolari la ieșire. OpenAI prezintă asta ca o reducere de 50% față de prețul promoțional al GPT-5.6 Sol și Luna. Citirea din cache are o reducere de 90%.
Pot folosi GPT-6 Sol și Luna în ChatGPT?
Da, în ChatGPT Work și în Codex, pentru abonamentele Plus, Pro, Business, Enterprise și Edu, cu lansare treptată pe parcursul zilei de 22 septembrie. Utilizatorii Free și Go primesc GPT-6 Luna în aplicația desktop. La lansare, modelele nu sunt încă disponibile în Chat.
GPT-6 Sol sau Claude Opus 5.5?
Depinde de sarcină și de buget. Sol costă jumătate din Opus 5.5 per token și e potrivit pentru munca de zi cu zi. Pe testele comune pentru care există cifre, AutomationBench și FrontierCode, Opus 5.5 are scoruri mai mari și e gândit pentru sarcini lungi, cu miză. Comparațiile directe nu sunt încă publicate, pentru că cele două modele au apărut în aceeași zi; testul corect e pe sarcinile tale.
Merită să trec pe modelul cel mai ieftin?
Pentru sarcinile simple și repetitive, de cele mai multe ori da: clasificarea, extragerea de date și rezumatele scurte rareori au nevoie de modelul de vârf. Regula e să pornești cu treapta cea mai ieftină care trece un test de calitate scris dinainte, pe 20 de exemple reale, și să păstrezi modelul mare pentru analizele cu miză.
30 de minute cu echipa NeuroAI: luăm sarcinile pe care le dai azi unui model AI și vedem unde plătești prea mult și unde ai nevoie de mai mult. Fără obligații.
Alegem împreună modelul pe fiecare sarcinăNeuroAI Newsletter
Applied AI for business, twice a week (Monday and Friday). Filtered news, tested tools, no hype.
Related NeuroAI services
Related articles
RadarClaude Opus 5.5: ce face concret într-o firmă și cum îl pui într-un flux de lucru
Anthropic a lansat Claude Opus 5.5 pe 22 septembrie 2026: pe majoritatea sarcinilor lucrează la nivelul lui Claude Fable 5.1 și costă cu aproximativ 40% mai puțin de rulat decât Opus 5. Pentru o firmă, întrebarea utilă nu e cât de bun e modelul, ci în ce flux de lucru îl pui. Ce face concret, unde e limita, patru fluxuri cu care poți începe și ce trebuie să știe echipa.
Read articleCercetătorii Anthropic vorbesc despre extincție. Pentru firma ta contează cealaltă știre, cea din iulie
Un cercetător a demisionat, doi colegi încă angajați i-au dat dreptate, iar unul dintre ei a pus o cifră: peste 10% în următorul deceniu. Presa a comprimat asta în „extincție până în 2030”. Diferența dintre cele două formulări e exact partea care contează pentru cine ia decizii — și e umbrită de un incident real din iulie, în care un agent AI a ieșit din laborator și a spart o companie adevărată.
Read article
RadarGPT-6 Astra: OpenAI vorbește despre AGI și lansează modelul cu frâna trasă
OpenAI a lansat GPT-6 Astra pe 3 septembrie 2026. Dincolo de discuția despre AGI din comunicat, schimbarea concretă e că modelul lucrează în programele tale: completează formulare, actualizează fișe în CRM, construiește un site și apoi îl testează singur, dând click pe fiecare funcție. Ce face efectiv, unde e limita reală și de ce e lansat cu cea mai puternică funcție blocată.
Read article