GPT-6 Astra – cena, limity i plany. Ile realnie zapłacisz
W API GPT-6 Astra kosztuje 10 USD za milion tokenów wejścia i 50 USD za milion wyjścia w trybie Standard, a powyżej 272 000 tokenów wejścia stawki rosną do 20 i 75 USD – dla całego zapytania, nie dla nadwyżki. W ChatGPT Astra jest w planach od Plusa wzwyż, ale Plus dostaje ją wyłącznie w Work i Codeksie, nie w oknie Chatu.
Stan na 13 września 2026. Stawki API pochodzą z cennika w dokumentacji OpenAI, limity wiadomości z Centrum pomocy OpenAI, ceny planów z cennika ChatGPT. Kwoty w złotych to przeliczenie po kursie NBP podanym przy tabeli – OpenAI nie publikuje cennika w złotych.
Trzy porządki rozliczeń, których nie wolno mieszać
Za Astrę płaci się na trzy różne sposoby i to jest główne źródło nieporozumień w tekstach o jej cenie.
| Porządek | Za co płacisz | Jednostka |
|---|---|---|
| Abonament ChatGPT | dostęp do modelu w oknie Chatu | stała opłata miesięczna + limit wiadomości |
| Work i Codex | zadania agentowe w aplikacji | wspólny przydział planu + dokupowane kredyty |
| API | każde wywołanie modelu w kodzie | stawka za milion tokenów |
Porównywanie „10 dolarów za milion tokenów” z „20 dolarów miesięcznie za Plusa” nie ma sensu – to dwa niezależne cenniki. Rachunek z Codeksa też nie przelicza się wprost na koszt wywołania API, bo Work i Codex rozliczają się przydziałem planu, a nie stawką tokenową.
Ile kosztuje sam dostęp do ChatGPT niezależnie od Astry, rozpisaliśmy w tekście o tym, ile kosztuje ChatGPT, a punkt startowy – limity darmowego planu.
Ile kosztuje GPT-6 Astra w API – pełna tabela
Astra ma cztery tryby przetwarzania i każdy ma własną stawkę; różnica między najtańszym a najdroższym to czterokrotność. Ceny w USD za milion tokenów.
| Tryb | Wejście | Cache – odczyt | Cache – zapis | Wyjście |
|---|---|---|---|---|
| Standard | 10,00 | 1,00 | 12,50 | 50,00 |
| Standard, wejście > 272 000 tokenów | 20,00 | 2,00 | 25,00 | 75,00 |
| Batch | 5,00 | 0,50 | 6,25 | 25,00 |
| Flex | 5,00 | 0,50 | 6,25 | 25,00 |
| Fast mode | 20,00 | 2,00 | 25,00 | 100,00 |
Co znaczy każdy tryb:
- Standard – domyślne przetwarzanie, punkt odniesienia dla wszystkich pozostałych stawek.
- Batch – przetwarzanie wsadowe zadań, które mogą poczekać. Połowa ceny Standard.
- Flex – przetwarzanie o niższym priorytecie. Również połowa ceny Standard.
- Fast mode – do dwukrotnie szybsze przetwarzanie za dwukrotną cenę. Tryb nazywał się Priority do 30 lipca 2026; parametr
service_tierprzyjmuje obie nazwy.
W trybach Batch i Flex próg długiego kontekstu podnosi stawki do 10 / 1 / 12,50 / 37,50 USD, a w trybie Fast do 40 / 4 / 50 / 150 USD.
Kolumny cache’u dotyczą pamięci podręcznej kontekstu – mechanizmu, który pozwala nie płacić pełnej stawki za tę samą, powtarzaną część zapytania. Przy pracy agentowej na dużym repozytorium to jest pozycja, która decyduje o rachunku.
Próg 272 000 tokenów – najdroższa pułapka tego cennika
Przekroczenie 272 000 tokenów wejścia podwaja stawkę wejścia i podnosi stawkę wyjścia o połowę – dla całego zapytania, a nie dla nadwyżki ponad próg.
To rozróżnienie kosztuje realne pieniądze. Dwa zapytania różniące się o 10 000 tokenów wejścia, oba z 10 000 tokenów wyjścia, w trybie Standard bez cache’u:
| Zapytanie | Wejście | Wyjście | Razem |
|---|---|---|---|
| 270 000 tokenów wejścia | 270 000 × 10 USD / mln = 2,70 USD | 10 000 × 50 USD / mln = 0,50 USD | 3,20 USD |
| 280 000 tokenów wejścia | 280 000 × 20 USD / mln = 5,60 USD | 10 000 × 75 USD / mln = 0,75 USD | 6,35 USD |
Dziesięć tysięcy tokenów więcej podnosi rachunek o 3,15 USD, czyli o 98%. Przy tysiącu takich zapytań dziennie różnica wynosi 3 150 USD.
Praktyczny wniosek jest prosty: jeśli twoje zapytania oscylują wokół progu, warto wiedzieć, po której stronie wypadają. Milion tokenów kontekstu w karcie modelu nie oznacza, że każdy token w tym oknie kosztuje tyle samo. Czym w ogóle jest token i dlaczego ten sam tekst liczy się różnie w różnych modelach, tłumaczy materiał o tokenizacji.
Astra kontra tańsze modele OpenAI
Astra jest dwa i pół raza droższa od GPT-5.6 Sol – identycznie za wejście, jak i za wyjście – oraz pięćdziesiąt razy droższa od GPT-5.6 Luna za wejście, a za wyjście różnica wynosi około czterdziestu dwóch razy. Stawki Standard w USD za milion tokenów:
| Model | Wejście | Cache – odczyt | Cache – zapis | Wyjście |
|---|---|---|---|---|
gpt-6-astra | 10,00 | 1,00 | 12,50 | 50,00 |
gpt-5.6-sol | 4,00 | 0,40 | 5,00 | 20,00 |
gpt-5.6-terra | 2,00 | 0,20 | 2,50 | 12,00 |
gpt-5.6-luna | 0,20 | 0,02 | 0,25 | 1,20 |
gpt-5.6-cyber | 12,50 | 1,25 | 15,63 | 75,00 |
Dwie rzeczy, które trzeba wiedzieć o tej tabeli:
Cena Sola jest promocyjna. OpenAI podaje, że obowiązuje co najmniej do 21 listopada 2026. Po tej dacie różnica między Solem a Astrą może się zmniejszyć – i wtedy część kalkulacji opłacalności trzeba będzie zrobić od nowa.
gpt-5.6-cyber to model z programu Daybreak. Aliasy gpt-daybreak-blue-latest i gpt-daybreak-red-latest wskazują obecnie odpowiednio na gpt-5.6-sol i gpt-5.6-cyber. W miarę wypuszczania nowych modeli w tym programie aliasy będą przestawiane, a ceny dopasowywane do modelu, na który wskazują.
Fast mode: dwukrotna cena i wykluczenie dla Unii Europejskiej
Fast mode jest niedostępny dla GPT-6 Astra przy rezydencji danych w Unii Europejskiej – dla takich żądań pozostaje wyłącznie tryb Standard. To zapis z dokumentacji OpenAI, którego nie znajdziesz w żadnym polskim omówieniu premiery.
Ma to znaczenie praktyczne dla firm, które z powodów prawnych albo kontraktowych trzymają przetwarzanie w europejskiej strefie danych. Taki podmiot nie może kupić szybszego przetwarzania Astry za dopłatą – może jedynie zejść na model, dla którego Fast mode w tej konfiguracji działa, albo zaakceptować standardową szybkość.
Dla pozostałych Fast mode oznacza do dwukrotnie szybsze przetwarzanie za dwukrotną stawkę: 20 USD za milion tokenów wejścia i 100 USD za milion wyjścia.
Astra w ChatGPT – który plan co dostaje
Komunikat prasowy mówi o „wszystkich użytkownikach Plus, Pro, Business i Enterprise”, ale Centrum pomocy OpenAI rozpisuje to na powierzchnie – i w tym rozpisaniu Plus nie ma Astry w oknie Chatu.
| Plan | Astra w Chacie (jako GPT-6 Pro) | Astra w Work i Codeksie |
|---|---|---|
| Free | nie | nie |
| Go | nie | nie |
| Plus | nie | tak, ograniczone użycie, dalej kredyty |
| Pro 100 USD | tak | tak, pełny przydział planu |
| Pro 200 USD | tak | tak, pełny przydział planu |
| Business Standard | tak | ograniczone, dalej kredyty |
| Business Premium | tak | tak, pełny przydział planu |
| Enterprise | tak, zależnie od uprawnień workspace’u | tak |
W oknie Chatu model nosi nazwę GPT-6 Pro. To ta sama Astra, tylko pod inną etykietą interfejsu. Czym jest sam model i co realnie potrafi, opisuje przewodnik GPT-6 Astra – co to jest i co potrafi.
Osobna informacja z Centrum pomocy: od 10 września 2026 zapisy i przejścia na plan Pro za 200 USD są tymczasowo wstrzymane. Pauza obejmuje przejścia z planów Free, Go, Plus i Pro za 100 USD. Istniejące subskrypcje Pro 200 USD odnawiają się normalnie, a plan Pro za 100 USD działa bez zmian. Zejście z Pro 200 USD na Pro 100 USD jest w czasie pauzy jednokierunkowe – po wejściu w życie obniżki nie da się wrócić, dopóki pauza nie zostanie zdjęta.
Oba progi Pro mają ten sam zestaw funkcji. Różni je wyłącznie przydział użycia: Pro za 100 USD daje pięciokrotność limitów planu Plus, a Pro za 200 USD dwudziestokrotność.
Limity GPT-6 Pro w Chacie – oficjalne liczby
Subskrypcja Pro nie oznacza nieograniczonego dostępu do Astry. OpenAI publikuje konkretne przydziały i zasady, według których dzielą się one z drugim modelem Pro.
| Plan | Przydział GPT-6 Pro w Chacie | Jak dzieli się z GPT-5.6 Sol Pro |
|---|---|---|
| Pro 200 USD | 200 wiadomości tygodniowo | osobne 170 wiadomości dziennie dla Sol Pro; oba modele razem maksymalnie 200 dziennie |
| Pro 100 USD | 50 wiadomości tygodniowo | jeden wspólny przydział 50 tygodniowo dla obu modeli |
| Business Standard | 15 wiadomości miesięcznie | jeden wspólny przydział dla obu modeli |
| Business Premium | 50 wiadomości tygodniowo | jeden wspólny przydział dla obu modeli |
Trzy konsekwencje, które wynikają z tej tabeli:
- Na planie Pro 100 USD przełączanie modeli niczego nie daje. Pula jest wspólna. Pięćdziesiąt wiadomości tygodniowo to około siedmiu dziennie – przy zadaniach wymagających kilku podejść to jest limit, który da się wyczerpać w jedno popołudnie.
- Na planie Pro 200 USD po wyczerpaniu limitu ChatGPT przełącza się automatycznie na GPT-5.6 Thinking w ustawieniu Medium. Żeby użyć GPT-5.6 Sol Pro, trzeba wybrać go ręcznie z menu modeli – i tylko dopóki zostaje zapas w jego dziennym przydziale oraz we wspólnym limicie dobowym.
- Business Standard dostaje 15 wiadomości miesięcznie. To przydział pozwalający sprawdzić model, nie pracować na nim.
Osiągnięcie limitu nie oznacza ograniczenia konta. ChatGPT pokazuje czas resetu, gdy taka informacja jest dostępna. Wsparcie OpenAI nie resetuje limitów na prośbę użytkownika.
Astra w Work i Codeksie – rozliczenie kredytowe
Work i Codex nie mają limitu liczonego w wiadomościach. Mają wspólny przydział planu i kredyty dokupowane po jego wyczerpaniu – a Astra zużywa ten przydział szybciej niż GPT-5.6 Sol.
Zasady według Centrum pomocy:
- Plany Pro 100 USD, Pro 200 USD i Business Premium mogą przeznaczyć na Astrę pełny istniejący przydział Work i Codeksa.
- Plany Plus i Business Standard mają ograniczone użycie Astry, a dalej opcjonalne kredyty.
- Tempo zużycia zależy od zadania, rozmiaru wejścia i wyjścia, ustawienia rozumowania oraz trybu Fast.
- Work rozlicza się według cennika Codeksa, choć jego przykłady dotyczą zadań programistycznych, a praca w Work bywa inna.
Kupienie kredytów nie daje wcześniejszego dostępu w trakcie wdrażania modelu – to osobna rzecz od kolejki udostępniania.
OpenAI nie publikuje tabeli „ile zadań Astry mieści się w przydziale planu Plus”. Przydział jest wspólny dla wszystkich modeli w Work i Codeksie, a zużycie zależy od charakteru zadania, więc taka liczba nie istnieje po stronie producenta. Jedynym wiarygodnym wskaźnikiem pozostaje licznik zużycia w samej aplikacji. Co dokładnie robi się na tych dwóch powierzchniach, opisuje tekst o obsłudze komputera przez Astrę.
Ile to kosztuje w złotych
OpenAI publikuje ceny wyłącznie w dolarach i netto. Poniższe kwoty to przeliczenie po kursie NBP – nie są cennikiem producenta.
Kurs: 1 USD = 3,7267 zł, tabela NBP nr 177/A/NBP/2026 z 11 września 2026. Kwoty brutto zawierają 23% VAT.
| Plan | USD netto | PLN netto | PLN brutto | Astra w Chacie |
|---|---|---|---|---|
| Free | 0 | 0 | 0 | nie |
| Go | 8 | 29,81 | 36,67 | nie |
| Plus | 20 | 74,53 | 91,68 | nie |
| Pro | 100 | 372,67 | 458,38 | tak, 50 wiad./tydz. |
| Pro | 200 | 745,34 | 916,77 | tak, 200 wiad./tydz. |
Dlaczego w ogóle trzeba przeliczać: Centrum pomocy OpenAI podaje wprost, że wszystkie zakupy są rozliczane w dolarach, a rozliczenie w walucie lokalnej jest dostępne tylko w ograniczonej liczbie krajów. Kwota widoczna przy zakupie zależy więc od kursu w dniu obciążenia karty, od sposobu zakupu subskrypcji i od stawki podatkowej stosowanej przez sprzedawcę.
OpenAI nie prowadzi też rozliczenia rocznego ani przedpłaty za kilka miesięcy z góry – dla planów Go, Plus i Pro dostępne jest wyłącznie rozliczenie miesięczne.
Trzy przykładowe rachunki w API
Wszystkie obliczenia poniżej to działania na cenniku, nie wyniki pomiarów jakości. Założenia: tryb Standard, brak cache’u, brak narzędzi płatnych osobno.
Rachunek pierwszy – krótkie zapytanie. 50 000 tokenów wejścia, 5 000 wyjścia. Wejście: 50 000 × 10 USD / mln = 0,50 USD. Wyjście: 5 000 × 50 USD / mln = 0,25 USD. Razem 0,75 USD, czyli około 2,80 zł netto.
Rachunek drugi – to samo zadanie na tańszym modelu. Te same 50 000 i 5 000 tokenów na gpt-5.6-sol. Wejście: 0,20 USD. Wyjście: 0,10 USD. Razem 0,30 USD. Astra kosztuje w tym zadaniu dwa i pół raza więcej. To jest dokładnie ta sama proporcja, która wynika z tabeli stawek – dopłata za Astrę nie rośnie ani nie maleje wraz z rozmiarem zwykłego zapytania.
Rachunek trzeci – praca agentowa z cache’em. Agent pracujący na kontekście 200 000 tokenów, wywoływany dwadzieścia razy w ciągu dnia, z tą samą powtarzalną częścią zapytania. Bez cache’u: 20 × 200 000 × 10 USD / mln = 40,00 USD za samo wejście. Z cache’em: jeden zapis 200 000 × 12,50 USD / mln = 2,50 USD, potem dziewiętnaście odczytów 19 × 200 000 × 1,00 USD / mln = 3,80 USD. Razem 6,30 USD. Różnica: 33,70 USD dziennie, czyli ponad sześciokrotnie taniej za tę samą pracę.
Ostatni przykład jest ważniejszy, niż wygląda. Przy pracy agentowej to nie stawka za wejście decyduje o rachunku, tylko to, czy powtarzalna część kontekstu trafia do pamięci podręcznej. Jak wypada ta arytmetyka w zestawieniu z konkurencją, rozkłada tekst GPT-6 Astra kontra Claude Fable 5.1 – u Anthropic odczyt z cache’u kosztuje czterokrotnie mniej, a plany Claude mają inną konstrukcję limitów.
Kiedy dopłata do Astry się zwraca, a kiedy nie
Reguła jest jedna: Astra zwraca się tam, gdzie liczy się ukończenie zadania w jednym podejściu, a nie tam, gdzie liczy się liczba odpowiedzi.
Zwraca się przy:
- zadaniach wieloetapowych na komputerze, gdzie Astra osiąga lepszy wynik w czasie krótszym o około 47% od czasu potrzebnego GPT-5.6 Sol,
- pracy na kontekście powyżej pół miliona tokenów, gdzie różnica w odnajdywaniu informacji wynosi 96,3% wobec 73,8%,
- zadaniach, w których poprawka kosztuje więcej niż wywołanie – przy trzykrotnym powtarzaniu zadania na tańszym modelu dopłata dwa i pół raza przestaje być dopłatą.
Nie zwraca się przy:
- krótkich zapytaniach o fakty i prostym przetwarzaniu tekstu, gdzie
gpt-5.6-terraza 2 i 12 USD albogpt-5.6-lunaza 0,20 i 1,20 USD dają ten sam efekt użytkowy, - zadaniach masowych, które mogą poczekać – tam tryb Batch na tańszym modelu bije Astrę w Standardzie o rząd wielkości,
- rozmowie w oknie Chatu na planie Plus, bo Astry tam po prostu nie ma.
Najwyższe poziomy wysiłku rozumowania nie są automatycznie lepsze. Każdy kolejny poziom zwiększa liczbę tokenów wyjścia, a więc rachunek, i nie na każdym zadaniu przekłada się na lepszą odpowiedź.
FAQ
W trybie Standard 10 USD za milion tokenów wejścia i 50 USD za milion wyjścia. Odczyt z pamięci podręcznej kosztuje 1 USD, zapis 12,50 USD. Powyżej 272 000 tokenów wejścia stawki rosną do 20, 75, 2 i 25 USD i obejmują całe zapytanie.
Tak, ale wyłącznie w ChatGPT Work i Codeksie, w ograniczonym zakresie, z możliwością dokupienia kredytów. W oknie Chatu Astra występuje jako GPT-6 Pro i jest dostępna dopiero od planu Pro za 100 USD.
Plan Pro za 100 USD daje 50 wiadomości tygodniowo, dzielonych wspólnie z GPT-5.6 Sol Pro. Plan Pro za 200 USD daje 200 wiadomości tygodniowo, a GPT-5.6 Sol Pro ma osobne 170 dziennie, przy łącznym limicie 200 dziennie dla obu modeli.
OpenAI podaje 20 USD miesięcznie netto. Po kursie NBP 1 USD = 3,7267 zł z 11 września 2026 to 74,53 zł netto i 91,68 zł brutto. Kwota przy zakupie zależy od kursu w dniu obciążenia i od stawki podatkowej.
Fast mode daje do dwukrotnie szybsze przetwarzanie za dwukrotną stawkę – 20 USD za wejście i 100 USD za wyjście. Nie jest dostępny dla GPT-6 Astra przy rezydencji danych w Unii Europejskiej; takie żądania idą trybem Standard.
Trzy dźwignie działają najmocniej: pamięć podręczna kontekstu przy powtarzalnych zapytaniach, tryb Batch lub Flex za połowę ceny przy zadaniach, które mogą poczekać, oraz utrzymanie wejścia poniżej progu 272 000 tokenów, który podwaja stawkę dla całego zapytania.
Źródła
- API Pricing, OpenAI API Docs – stawki modeli w trybach Standard, Batch, Flex i Fast, progi długiego kontekstu, dostęp 13.09.2026
- GPT-6 Astra Model, OpenAI API Docs – karta modelu: okno kontekstu, limity zapytań według poziomów, dostęp 13.09.2026
- GPT-5.6 and GPT-6 Pro in ChatGPT, OpenAI Help Center – limity GPT-6 Pro per plan i zasady współdzielenia przydziału, dostęp 13.09.2026
- ChatGPT Work and Codex, OpenAI Help Center – rozliczenie Astry w Work i Codeksie, kredyty, dostęp 13.09.2026
- ChatGPT Pricing, OpenAI – plany Free, Go, Plus i Pro oraz ich zakres, dostęp 13.09.2026
- GPT-6 Astra: A new generation of intelligence, OpenAI – komunikat premierowy, sekcja Availability, dostęp 13.09.2026
- About ChatGPT Pro tiers, OpenAI Help Center – wstrzymanie zapisów na Pro 200 USD od 10.09.2026 i jego zakres, różnica przydziałów między progami Pro (5x i 20x limitów planu Plus), dostęp 13.09.2026
- What is ChatGPT Go, OpenAI Help Center – rozliczenie w dolarach, waluta lokalna tylko w wybranych krajach, brak rozliczenia rocznego, dostęp 13.09.2026
- Kurs średni USD, tabela 177/A/NBP/2026, Narodowy Bank Polski – kurs z 11.09.2026, dostęp 13.09.2026
- Fast mode, OpenAI API Docs – zasady trybu Fast i jego zgodność z rezydencją danych, dostęp 13.09.2026

