OpenAI langetas GPT-5.6 Luna hinna 80 protsenti
OpenAI langetas GPT-5.6 Luna API-hinda 80 protsenti. Odavam token võib vähendada kulusid, kuid agendi tegelik hind sõltub kogu töövoost ja kvaliteedist.
Lühidalt
- OpenAI langetas 30. juulil GPT-5.6 Luna standardse API-hinna 0,20 dollarile sisendi ja 1,20 dollarile väljundi miljoni tokeni kohta, mis tähendab ettevõtte teatel 80-protsendilist hinnalangust.
- GPT-5.6 Terra sisend maksab nüüd kaks ja väljund 12 dollarit miljoni tokeni kohta ehk 20 protsenti varasemast vähem, GPT-5.6 Soli tavahind ei muutunud.
- Soli Fast-režiim maksab standardrežiimist kaks korda rohkem ja annab OpenAI dokumentatsiooni järgi kuni 2,5 korda kiirema töötlemise.
- Odavam token ei taga odavamat agenti, sest kogukulu sõltub väljundi pikkusest, korduvatest tööriistakutsetest, vahemälust ja ülesande lahendamiseks kulunud tsüklite arvust.
OpenAI langetas kolm nädalat pärast GPT-5.6 mudelipere avaldamist kahe väiksema mudeli API-hindu. Suurim muutus puudutab GPT-5.6 Lunat: lühikese konteksti standardrežiimis maksab miljon sisendtokenit nüüd 0,20 dollarit ja miljon väljundtokenit 1,20 dollarit. OpenAI sõnul on mõlemad hinnad varasemast 80 protsenti madalamad.
GPT-5.6 Terra sisendi hind langes 20 protsenti kahe dollarini ja väljundi hind 12 dollarini miljoni tokeni kohta. Lipulaeva GPT-5.6 Soli standardhind jäi viie dollari suurusele sisendi- ja 30 dollari suurusele väljundhinnale. Reuters kinnitas hinnamuudatust 30. juulil avaldatud kajastuses.
Hinnalangus on arendajale märkimisväärne, kuid hinnakirja kõige väiksem number ei kirjelda tervikliku automatiseerimisülesande maksumust. Agent võib sama konteksti kümneid kordi uuesti lugeda, kutsuda väliseid tööriistu, parandada ebaõnnestunud katseid ja toota pika vastuse. Seetõttu tasub mudelit valida ülesande hinna, mitte üksnes tokenihinna järgi.
GPT-5.6 Luna muutus viis korda odavamaks
OpenAI ametliku hinnakirja järgi maksab GPT-5.6 Luna standardrežiimis lühikese kontekstiga miljon sisendtokenit 0,20 dollarit, vahemälust loetud sisend 0,02 dollarit, vahemällu kirjutamine 0,25 dollarit ja väljund 1,20 dollarit. Batch- ja Flex-režiimis on sisendi hind 0,10 ning väljundi hind 0,60 dollarit.
Terra vastavad standardhinnad on kaks dollarit sisendi ja 12 dollarit väljundi eest. Sol maksab viis dollarit sisendi ja 30 dollarit väljundi eest. Mudelite hinnavahe on seega 25-kordne, kuid see ei näita, mitu tokenit või katset iga mudel sama ülesande lahendamiseks vajab.
Lihtne näide toob erinevuse esile. Kui üks töövoog kasutab 20 miljonit Luna sisendtokenit ja kaks miljonit väljundtokenit, on mudelikulu standardhinnaga 6,40 dollarit. Sama tokenimahu hind oleks Terra puhul 64 ja Soli puhul 160 dollarit. Arvutus ei sisalda tööriistade, otsingu, salvestuse ega teiste teenuste tasusid.
Luna sobib hinnastuse järgi suure mahu ja madalama ühikukuluga tööks, näiteks klassifitseerimiseks, andmete korrastamiseks, lihtsamateks agentseteks sammudeks ja mahukaks mustandiloomeks. Kas see on konkreetses töövoos Terra või Soliga võrreldes odavaim, selgub alles siis, kui mõõta õnnestunud ülesandeid, parandusringe ja inimese järelkontrolli aega.
Fast-režiim ostab kiirust, mitte uut mudelit
OpenAI nimetas senise Priority processing’u 30. juulil ümber Fast-režiimiks. GPT-5.6 Soli Fast-hind on kümme dollarit sisendi ja 60 dollarit väljundi miljoni tokeni kohta ehk kaks korda standardrežiimist kõrgem. Ettevõtte dokumentatsioon lubab kuni 2,5 korda kiiremat töötlemist.
Fast-režiim ei tähenda eraldi võimekamat Soli mudelit. Lisatasu käib teeninduskiiruse eest ning on mõistlik eelkõige kasutajaliidestele või protsessidele, kus vastuse viivitus mõjutab otseselt kasutajakogemust või tulu. Taustal töötava analüüsi, öise andmetöötluse või ajakriitikata agentide puhul võivad Batch ja Flex olla kulutõhusamad.
Kiiruse väide pärineb OpenAI-lt ning tegelik viivitus sõltub päringu pikkusest, piirkonnast, tööriistadest ja koormusest. Ettevõte peaks mõõtma enda p50 ja p95 latentsust, mitte eeldama, et maksimaalne 2,5-kordne kiirendus kehtib kõigis päringutes.
Miks odavam token ei pruugi tähendada odavamat agenti
Agentse süsteemi kulu kujuneb sammudest. Mudel loeb juhiseid ja töömälu, otsustab järgmise tegevuse, kutsub tööriista, loeb tulemuse ning kordab tsüklit. Kui kontekst kasvab iga sammuga, võib odav mudel töödelda sama teavet korduvalt ja tarbida kokku rohkem tokeneid kui kallim mudel, mis jõuab lahenduseni vähemate katsetega.
Vahemälu võib korduvate süsteemijuhiste ja muutumatu konteksti hinda oluliselt vähendada. Luna vahemälust loetud sisend maksab kümnendiku tavalisest sisendist. Kasu tekib siiski ainult siis, kui rakenduse päringustruktuur võimaldab korduvat osa päriselt vahemällu võtta.
Teine kuluallikas on ebaõnnestumine. Kui Luna vajab keeruka kodeerimisülesande lahendamiseks rohkem parandusringe, teste ja inimese sekkumist kui Terra, võib 80-protsendiline tokenihinna langus ülesandepõhises arvestuses kahaneda või kaduda. Sama kehtib kvaliteedikontrolli kohta: odav mustand on kallis, kui inimene peab selle täielikult ümber tegema.
Hinnasurve tuleb nii klientidelt kui konkurentidelt
Reuters seostas OpenAI hinnalangust ettevõtete kasvava tähelepanuga tehisarukuludele. API-d kasutanud meeskonnad ei vaata enam ainult mudeli võimekust, vaid ka seda, kui palju maksab üks lõpetatud kliendijuhtum, koodimuudatus või dokumentide töötlemise töövoog.
Konkurentsi tugevdavad Anthropic, Google ja kiiresti odavnenud Hiina mudelid, millest osa on avaldatud avatud kaaludega. Avatud kaalud ei tee käitamist tasuta, kuid annavad suure kasutusmahu korral ettevõttele võimaluse võrrelda API-hinda oma taristu kuluga ja vähendada sõltuvust ühest pakkujast.
OpenAI põhjendab uut hinda mudeli, vahemälu, inferentsi ja GPU-töökoormuste optimeerimisega. Need on ettevõtte enda selgitused. Avalik hinnakiri kinnitab uue maksumuse, kuid ei näita, kui suur osa säästust tuleb mudeli arhitektuurist, riistvara paremast kasutusest või strateegilisest hinnasurvest.
Mida Eesti arendustiim peaks mõõtma
Kõige kasulikum võrdlusüksus on õnnestunud ülesanne. Kodeerimisagendi puhul võib see olla testid läbinud muudatus, klienditeeninduses lahendatud juhtum ja andmetöötluses valideeritud väljund. Iga tulemuse juurde tuleks koguda sisend- ja väljundtokenid, vahemälu kasutus, tööriistakutsed, kestus, ebaõnnestunud katsed ning inimese kontrolliaeg.
Praktilises katses tasub anda Lunale, Terrale ja Solile sama esinduslik ülesannete valim ning seada ühesugused kvaliteedikriteeriumid. Alles seejärel saab arvutada, kas Luna viis korda madalam hind jõuab ka päris töövoo eelarvesse või kulub osa vahest pikematele tsüklitele.
Hinnalangus muudab Luna atraktiivseks suure mahuga automatiseerimisel, kuid mudeli vahetamine ilma mõõtmiseta on risk. Järgmisena tasub jälgida ülesandepõhiseid sõltumatuid võrdlusi ning seda, kas Anthropic, Google ja teised pakkujad vastavad uue hinnakirjaga.
Praktiline mudelivõrdlus vajab püsivat testikomplekti
Ühekordne demonstratsioon ei näita mudeli tegelikku kuluprofiili. Meeskond peaks hoidma väikest, kuid esinduslikku testikomplekti korduvatest ülesannetest ja jooksutama seda uuesti iga mudeli-, prompti- või hinnamuudatuse järel. Nii saab võrrelda mitte ainult keskmist hinda, vaid ka ebaõnnestumiste ja kõige kallimate erandjuhtude osakaalu.
Kvaliteedikriteerium tuleb enne testi kirja panna. Kodeerimisel võib see tähendada läbitud teste ja ülevaatusel leitud vigade arvu, klienditoes korrektset lahendust ilma eskalatsioonita ning andmetöötluses skeemile vastavat ja kontrollitud väljundit. Ilma ühise tulemusmõõdikuta soosib hinnavõrdlus mudelit, mis kirjutab vähem, kuid jätab töö pooleli.
Kulupiirangud tasub lisada ka rakenduse tasemele. Maksimaalne agentsete sammude arv, konteksti kärpimine, tööriistakutsete eelarve ja kallimale mudelile eskaleerimise reegel aitavad vältida olukorda, kus harv lõputu tsükkel sööb ära odavama Luna tavapärase säästu.
Korduma kippuvad küsimused
Kui palju GPT-5.6 Luna nüüd maksab?
GPT-5.6 Luna standardhind on lühikese konteksti puhul 0,20 dollarit miljoni sisendtokeni ja 1,20 dollarit miljoni väljundtokeni kohta. OpenAI teatel on mõlemad hinnad varasemast 80 protsenti madalamad.
Kui palju GPT-5.6 Terra maksab?
GPT-5.6 Terra standardhind on kaks dollarit miljoni sisendtokeni ja 12 dollarit miljoni väljundtokeni kohta. OpenAI langetas Terra hinda 20 protsenti.
Kas GPT-5.6 Sol muutus odavamaks?
GPT-5.6 Soli standardhind ei muutunud ning on viis dollarit sisendi ja 30 dollarit väljundi miljoni tokeni kohta. Uus Fast-režiim maksab kümme dollarit sisendi ja 60 dollarit väljundi eest.
Mis on GPT-5.6 Soli Fast-režiim?
Fast-režiim on kõrgema prioriteediga töötlemine, mis annab OpenAI dokumentatsiooni järgi kuni 2,5 korda kiirema vastuse. Teenus maksab standardrežiimist kaks korda rohkem ega muuda mudelit ennast võimekamaks.
Miks ei piisa mudelite võrdlemisel tokenihinnast?
Tokenihind ei näita, mitu sammu, tööriistakutset ja parandusringi mudel ülesande lõpetamiseks vajab. Õige võrdlus mõõdab edukalt lõpetatud ülesande kogukulu ja inimese järelkontrolli aega.
Kuidas saab vahemälu API-kulu vähendada?
Vahemälu vähendab korduvalt kasutatava muutumatu sisendi hinda. GPT-5.6 Luna vahemälust loetud sisend maksab 0,02 dollarit miljoni tokeni kohta, kuid sääst eeldab vahemällu sobivalt üles ehitatud päringuid.
Mida peaks Eesti ettevõte enne Lunale üleminekut testima?
Eesti ettevõte peaks võrdlema Lunat teiste mudelitega oma tegelikel ülesannetel ning mõõtma kvaliteeti, tokenikulu, viivitust, tööriistakutseid ja inimese kontrolliaega. Mudeli vahetamine on põhjendatud siis, kui langeb ühe valideeritud tulemuse kogukulu.
Allikad
- OpenAI, "Advancing the price-performance frontier with GPT-5.6", 30. juuli 2026. https://openai.com/index/advancing-the-price-performance-frontier-with-gpt-5-6/
- OpenAI, "Pricing", uuendatud 30. juulil 2026. https://platform.openai.com/docs/pricing
- OpenAI, "Introducing GPT-5.6", 9. juuli 2026. https://openai.com/index/gpt-5-6/
- Reuters, "OpenAI cuts prices for smaller models as businesses scrutinize AI spend", 30. juuli 2026. https://www.reuters.com/business/retail-consumer/openai-cuts-prices-smaller-models-businesses-scrutinize-ai-spend-2026-07-30/
Saa järgmine AI-RADAR postkasti
Kui järgmine praktiline AI-signaal või tööriistamuutus avaldatakse, saad selle otse e-postile.
Arutelu
0 kommentaari
Seotud teemad AI-RADARis

AI-tokenid toovad ettevõtetele ootamatuid arveid
Ettevõtted kasutavad tehisintellekti üha rohkem, kuid tokenipõhine hinnastamine toob kaasa ootamatuid kulusid. Artikkel selgitab, mis on AI-tokenid, miks arved kasvavad ja kuidas ettevõtted saavad AI-kulusid juhtida.
Ettevõtted piiravad tehisaru kasutust: tokenikulu muutub finantsjuhtide probleemiks
Ettevõtted avastavad, et juhitamatu tehisaru kasutus võib kiiresti kasvatada tokenikulu. Accenture’i näide näitab uut kulukontrolli faasi.

OpenAI GPT-5.6 jõuab turule pärast USA julgeolekukontrolli
OpenAI GPT-5.6 tuleb turule pärast USA valitsuse lisateste ja heakskiitu. Uudis näitab, et kõige võimekamate mudelite väljalase sõltub üha enam julgeoleku- ja küberriskide hinnangust.