Radar

GPT-6 Sol și Luna: ce model pui pe ce sarcină, acum că prețurile au scăzut la jumătate

La mai puțin de trei săptămâni după GPT-6 Astra, OpenAI a lansat GPT-6 Sol și GPT-6 Luna: aceeași generație, prețuri API la jumătate față de modelele pe care le înlocuiesc. În aceeași zi, Anthropic a lansat Claude Opus 5.5, tot mai ieftin. Ce face fiecare model nou, unde apare în ChatGPT și de ce întrebarea utilă devine ce mărime de model îi trebuie fiecărei sarcini.

by Echipa NeuroAI10 min read
Schemă editorială pe fundal navy cu titlul GPT-6 Sol și Luna, ce model pui pe ce sarcină, și un card cu costul estimat pentru 1.000 de emailuri pe lună pe trei trepte de model

Pe 7 aprilie 1964, IBM a anunțat System/360. Noutatea nu era un calculator mai rapid, ci o familie de calculatoare: modele mici, mijlocii și mari, care rulau aceleași programe. O firmă putea cumpăra modelul pe care și-l permitea atunci și putea trece pe unul mai mare mai târziu fără să-și rescrie software-ul. Întrebarea cumpărătorului s-a mutat de la „care e cel mai puternic calculator” la „ce mărime îmi trebuie pentru ce am de lucrat”.

Anunțul OpenAI din 22 septembrie 2026 se citește în aceeași cheie. La mai puțin de trei săptămâni după GPT-6 Astra, compania a lansat GPT-6 Sol și GPT-6 Luna, antrenate cu metode similare, dar mai rapide și mai ieftine. Prețurile API sunt la jumătate față de modelele pe care le înlocuiesc: Sol costă 2 dolari per milion de tokens de intrare, Luna 10 cenți. În aceeași zi, Anthropic a lansat Claude Opus 5.5, tot mai ieftin decât predecesorul. Direcția e aceeași la ambii furnizori: capabilitățile modelelor de vârf coboară în trepte mai ieftine.

Pentru o firmă, schimbarea practică nu e un model nou de încercat, ci o decizie de luat la fiecare sarcină: ce mărime de model îi trebuie. Mai jos: ce s-a lansat, ce face fiecare model după datele OpenAI, unde apare în ChatGPT (cu o precizare care se pierde ușor), cât costă o sarcină reală pe fiecare treaptă și cum alegi.

Ce s-a lansat, pe scurt

ParametruValoare
Data anunțului22 septembrie 2026
ModeleGPT-6 Sol (sarcini de lucru dificile, la cost redus) · GPT-6 Luna (treapta cea mai ieftină)
Identificatori APIgpt-6-sol · gpt-6-luna
Tarif API GPT-6 Sol2 $ / 1M tokens intrare · 10 $ / 1M tokens ieșire (GPT-5.6 Sol: 4 $ / 20 $)
Tarif API GPT-6 Luna0,10 $ / 1M tokens intrare · 0,50 $ / 1M tokens ieșire (GPT-5.6 Luna: 0,20 $ / 1,20 $)
Cachereducere de 90% la citirea din cache; rată de reutilizare mai mare, implicit
În ChatGPTChatGPT Work și Codex, pentru Plus, Pro, Business, Enterprise și Edu
Utilizatori Free și GoGPT-6 Luna, în aplicația desktop
Încă nedisponibileîn Chat, conversația obișnuită din ChatGPT
Lansaretreptată, pe parcursul zilei
Modelul de vârf rămâneGPT-6 Astra (10 $ / 50 $)
GPT-6 Sol și GPT-6 Luna — parametrii anunțați pe 22 septembrie 2026

Ce face fiecare, după cifrele publicate

OpenAI prezintă noile modele pe patru zone: muncă profesională, corectitudinea faptelor, programare și utilizarea calculatorului. Selecția relevantă pentru o firmă, așa cum o publică OpenAI:

ZonăCe raportează OpenAI
Fluxuri de business (AutomationBench: 47 de unelte din vânzări, marketing, operațiuni, suport, financiar și HR)Sol la efort xhigh: 33,2%, la 0,27 $ per sarcină. Claude Opus 5 la efort maxim: 26,9%, la un cost de 11,1 ori mai mare. Luna, la efort high, cu 5,4 puncte peste predecesor, la un cost cu 58% mai mic.
Sarcini profesionale lungi (Agents' Last Exam)Sol la efort maxim: 56,4%, peste cel mai bun scor al lui Claude Opus 5, la un cost per sarcină cu 60% mai mic.
Corectitudinea faptelor (evaluare internă, pe conversații în care utilizatorii au semnalat greșeli)Sol face cam jumătate din greșelile predecesorului. Luna, la efort mare, ajunge la nivelul GPT-5.6 Sol la aproximativ o sutime din cost.
Programare (DeepSWE v1.1)Sol la efort maxim: 68,8%, la 1,1 puncte de Claude Fable 5 (69,9%), cu un cost per sarcină cu circa 80% mai mic. Luna: 66,6%, comparabil cu Opus 5 și Fable 5 la efort medium, cu 93% mai ieftin decât Opus 5.
Utilizarea calculatorului (OSWorld 2.0, set offline)Sol la xhigh: 60,5%, cât Claude Opus 5 la medium (60,3%), cu un cost cu circa 80% mai mic. GPT-6 Astra rămâne cel mai bun model OpenAI la lucrul în aplicații.
StilRăspunsuri mai clare, cu mai puțin jargon și ceva mai scurte, preluate de la Astra.
Rezultate publicate de OpenAI pe 22 septembrie 2026. Costurile sunt per sarcină, la nivelul de efort indicat.

Pentru dezvoltatori, anunțul mai are o parte practică: cache-ul. Instrucțiunile și contextul pe care o aplicație le trimite la fiecare apel se refolosesc acum mai des, iar citirea lor din cache costă cu 90% mai puțin. Schimbarea nivelului de efort sau a uneltelor disponibile în mijlocul unei conversații nu mai strică cache-ul, iar un panou nou arată cât din intrare e reutilizat. GitHub raportează că îmbunătățirile din ultimele luni au redus cu peste 50% partea din prompt care trebuie procesată din nou.

Cât costă o sarcină reală, pe fiecare treaptă

Prețurile per milion de tokens spun puțin până nu le pui pe o sarcină. Un calcul propriu, cu ipoteze declarate: o firmă primește 1.000 de emailuri pe lună, iar modelul clasifică fiecare mesaj și scrie o ciornă de răspuns. Presupunem 2.000 de tokens la intrare (emailul, istoricul și regulile firmei) și 300 la ieșire pentru fiecare email.

ModelTarif intrare / ieșireCost per emailCost pe lună
GPT-6 Luna0,10 $ / 0,50 $0,00035 $0,35 $
Claude Haiku 4.51 $ / 5 $0,0035 $3,50 $
GPT-6 Sol2 $ / 10 $0,007 $7 $
Claude Sonnet 52 $ / 10 $0,007 $7 $
Claude Opus 5.54 $ / 20 $0,014 $14 $
GPT-6 Astra10 $ / 50 $0,035 $35 $
Claude Fable 5.110 $ / 50 $0,035 $35 $
Estimare NeuroAI, ipoteze declarate: 1.000 de emailuri pe lună, 2.000 de tokens intrare și 300 de tokens ieșire per email, fără cache și fără tokens de raționament. Modelele care „gândesc” consumă tokens de ieșire în plus, deci valorile reale sunt mai mari; contează ordinul de mărime.

Între treapta de jos și cea de sus e o diferență de o sută de ori. La un volum mic, nu contează: 35 de dolari pe lună nu schimbă bugetul nimănui. Contează în două situații. Prima: când volumul crește — zeci de mii de documente, un chatbot public, un flux care rulează toată ziua. A doua: când sarcina e ușoară, de felul clasificării, extragerii de date sau rezumatelor scurte, unde modelul mare nu aduce nimic în plus. Invers, pe o analiză în care o greșeală costă, economia de câțiva dolari nu contează.

Cum alegi modelul, pe scurt

Tip de sarcinăExempleTreapta potrivităDe ce
Volum mare, sarcină simplăclasificarea emailurilor, extragerea datelor din facturi, etichetarea tichetelorGPT-6 Luna sau Claude Haiku 4.5costul per bucată contează mai mult decât nuanța; rezultatul se verifică automat sau prin eșantion
Muncă de birou de zi cu zirezumate, ciorne de răspuns, analize scurte, cod de rutinăGPT-6 Sol sau Claude Sonnet 5raport bun între calitate și cost, pentru folosirea zilnică de toată echipa
Sarcini lungi sau cu mizăanaliză financiară, verificarea contractelor, migrări de cod, agenți care lucrează oreClaude Opus 5.5, GPT-6 Astra sau Claude Fable 5.1o greșeală costă mai mult decât diferența de preț; contează rezistența pe sarcini lungi
Lucru în aplicații (computer use)formulare, fișe în CRM, testarea unei aplicațiiGPT-6 Astra sau Claude Opus 5.5cele mai bune scoruri publicate de fiecare furnizor; Sol și Luna sunt mai slabe aici
Recomandare NeuroAI, pornind de la datele publicate de OpenAI și Anthropic. Modelul potrivit se confirmă pe sarcina ta, nu în tabel.

Regula practică: pornești cu treapta cea mai ieftină care trece testul tău de calitate, nu cu cea mai scumpă pe care ți-o permiți. Testul se scrie înainte: 20 de exemple reale, cu rezultatul corect știut dinainte, rulate pe fiecare treaptă candidată. Dacă Luna trece pe clasificarea emailurilor, modelul mare nu mai are ce căuta acolo.

Lansat în aceeași zi: ce face concret într-o firmă, unde e limita și patru fluxuri de lucru cu care poți începe.

Citește despre Claude Opus 5.5

Ce înseamnă pentru o firmă din România

Anunțul nu conține restricții geografice. Dacă echipa ta are ChatGPT Plus, Business sau Enterprise, modelele noi sunt în ChatGPT Work și în Codex, lansate treptat din 22 septembrie, dar nu și în Chat. Prin API, proiectele care nu se justificau la prețurile vechi merită recalculate: triajul emailurilor, extragerea de date din documente sau un asistent intern cu instrucțiuni lungi, unde cache-ul ieftin schimbă costul de bază.

Ce nu se schimbă: obligațiile de transparență din articolul 50 al AI Act, aplicabile de la 2 august 2026, rămân ale firmei care pune modelul în fața clienților, oricare ar fi treapta sau furnizorul. Un model mai ieftin nu mută răspunderea.

Ce faci concret, în ordinea asta

  1. Dacă folosești ChatGPT în echipă, verifică unde apar modelele noi: în Work și în Codex da, în Chat încă nu.
  2. Fă lista sarcinilor pe care le dai azi unui model mare și marchează-le pe cele simple și repetitive. Ele sunt candidate pentru Luna sau Haiku.
  3. Pentru fiecare sarcină candidată, strânge 20 de exemple reale cu răspunsul corect și rulează-le pe treapta ieftină. Dacă trece, ai redus costul fără să pierzi calitate.
  4. Dacă ai integrări prin API, măsoară cache-ul: instrucțiunile lungi repetate la fiecare apel se plătesc acum cu 90% mai puțin.
  5. Păstrează modelul mare pentru ce contează: analizele cu miză, sarcinile lungi, lucrul în aplicații.
  6. Nu te lega de un singur furnizor. Prețurile și clasamentele se schimbă de la o lună la alta; în septembrie s-au schimbat de două ori în aceeași zi.

Concluzie

GPT-6 Sol și Luna nu sunt cele mai capabile modele ale OpenAI; Astra rămâne în vârf. Sunt, în schimb, cele care aduc aceeași generație la prețuri de rutină, iar asta contează pentru cele mai multe sarcini dintr-o firmă.

Valoarea lui System/360 nu a stat în modelul cel mai mare, ci în faptul că fiecare client își putea alege mărimea și o putea schimba fără să o ia de la capăt. Cu Sol, Luna și Opus 5.5 lansate în aceeași zi, alegerea mărimii devine o decizie de fiecare zi. Firma care o ia sarcină cu sarcină plătește de zeci de ori mai puțin pentru același rezultat.

Ce sunt GPT-6 Sol și GPT-6 Luna?

Sunt modelele lansate de OpenAI pe 22 septembrie 2026, în aceeași generație cu GPT-6 Astra și antrenate cu metode similare. Sol e treapta de mijloc, pentru sarcini de lucru dificile la cost redus, iar Luna e treapta cea mai ieftină. GPT-6 Astra rămâne modelul de vârf al OpenAI.

Cât costă GPT-6 Sol și Luna prin API?

GPT-6 Sol costă 2 dolari per milion de tokens de intrare și 10 dolari per milion de tokens de ieșire. GPT-6 Luna costă 0,10 dolari la intrare și 0,50 dolari la ieșire. OpenAI prezintă asta ca o reducere de 50% față de prețul promoțional al GPT-5.6 Sol și Luna. Citirea din cache are o reducere de 90%.

Pot folosi GPT-6 Sol și Luna în ChatGPT?

Da, în ChatGPT Work și în Codex, pentru abonamentele Plus, Pro, Business, Enterprise și Edu, cu lansare treptată pe parcursul zilei de 22 septembrie. Utilizatorii Free și Go primesc GPT-6 Luna în aplicația desktop. La lansare, modelele nu sunt încă disponibile în Chat.

GPT-6 Sol sau Claude Opus 5.5?

Depinde de sarcină și de buget. Sol costă jumătate din Opus 5.5 per token și e potrivit pentru munca de zi cu zi. Pe testele comune pentru care există cifre, AutomationBench și FrontierCode, Opus 5.5 are scoruri mai mari și e gândit pentru sarcini lungi, cu miză. Comparațiile directe nu sunt încă publicate, pentru că cele două modele au apărut în aceeași zi; testul corect e pe sarcinile tale.

Merită să trec pe modelul cel mai ieftin?

Pentru sarcinile simple și repetitive, de cele mai multe ori da: clasificarea, extragerea de date și rezumatele scurte rareori au nevoie de modelul de vârf. Regula e să pornești cu treapta cea mai ieftină care trece un test de calitate scris dinainte, pe 20 de exemple reale, și să păstrezi modelul mare pentru analizele cu miză.

30 de minute cu echipa NeuroAI: luăm sarcinile pe care le dai azi unui model AI și vedem unde plătești prea mult și unde ai nevoie de mai mult. Fără obligații.

Alegem împreună modelul pe fiecare sarcină
Share the articleLinkedInGPT-6 Sol și Luna: ce model pui pe ce sarcină, acum că prețurile au scăzut la jumătate

NeuroAI Newsletter

Applied AI for business, twice a week (Monday and Friday). Filtered news, tested tools, no hype.

By subscribing you confirm you have read the Privacy Policy. Unsubscribe anytime with one click from any edition.

Related NeuroAI services

Schemă editorială pe fundal navy cu titlul Claude Opus 5.5, diferența o face fluxul de lucru, și patru fluxuri de pornire pentru o firmă: raportul lunar, verificarea contractelor, cercetarea cu surse și rezumatul discuțiilor lungiRadar
12 min read

Claude Opus 5.5: ce face concret într-o firmă și cum îl pui într-un flux de lucru

Anthropic a lansat Claude Opus 5.5 pe 22 septembrie 2026: pe majoritatea sarcinilor lucrează la nivelul lui Claude Fable 5.1 și costă cu aproximativ 40% mai puțin de rulat decât Opus 5. Pentru o firmă, întrebarea utilă nu e cât de bun e modelul, ci în ce flux de lucru îl pui. Ce face concret, unde e limita, patru fluxuri cu care poți începe și ce trebuie să știe echipa.

Read article
Schemă editorială pe fundal navy cu titlul Riscul despre care se vorbește și riscul care s-a întâmplat deja, comparând declarațiile despre extincție cu incidentul din iulie 2026Radar
18 min read

Cercetătorii Anthropic vorbesc despre extincție. Pentru firma ta contează cealaltă știre, cea din iulie

Un cercetător a demisionat, doi colegi încă angajați i-au dat dreptate, iar unul dintre ei a pus o cifră: peste 10% în următorul deceniu. Presa a comprimat asta în „extincție până în 2030”. Diferența dintre cele două formulări e exact partea care contează pentru cine ia decizii — și e umbrită de un incident real din iulie, în care un agent AI a ieșit din laborator și a spart o companie adevărată.

Read article
Schemă editorială pe fundal navy cu titlul GPT-6 Astra lucrează în programele tale, lista de sarcini pe care le preia și un card cu rata de reușită de 3 din 4 pe sarcini de birouRadar
14 min read

GPT-6 Astra: OpenAI vorbește despre AGI și lansează modelul cu frâna trasă

OpenAI a lansat GPT-6 Astra pe 3 septembrie 2026. Dincolo de discuția despre AGI din comunicat, schimbarea concretă e că modelul lucrează în programele tale: completează formulare, actualizează fișe în CRM, construiește un site și apoi îl testează singur, dând click pe fiecare funcție. Ce face efectiv, unde e limita reală și de ce e lansat cu cea mai puternică funcție blocată.

Read article