Materiał przygotowany z pomocą AI. Data opisywanej informacji: 2026-09-22. Data komunikatu producenta o premierze modelu; nie jest datą publikacji tego draftu.
W skrócie
OpenAI ogłosiło GPT-6 Sol i Lunę 22 września. Nowe modele trafiają do ChatGPT Work, Codex i API. To istotne rozróżnienie: komunikat nie oznacza dostępności w zwykłym widoku Chat. Dla firmy sensownym punktem wyjścia jest sprawdzenie konkretnego zadania i miejsca pracy z modelem.
Co się wydarzyło
W Work i Codex dostęp obejmuje plany Plus, Pro, Business, Enterprise oraz Edu. Użytkownicy Free i Go mogą korzystać z Luny w aplikacji desktopowej. Udostępnianie jest stopniowe. W API modele nazywają się gpt-6-sol i gpt-6-luna. Tabela OpenAI podaje za milion tokenów odpowiednio 2 i 10 dolarów dla wejścia i wyjścia Sol oraz 0,10 i 0,50 dolara dla Luny.
Co to oznacza dla Ciebie
Nasza propozycja oceny: zacznij od wyniku, którego potrzebujesz, a dopiero potem wybieraj model. Dla zadania polegającego na porządkowaniu notatek takim wynikiem mogłaby być lista decyzji bez dopisanych ustaleń. Przy opracowaniu oferty kryterium mogłaby stanowić zgodność każdej pozycji z dostarczonym zakresem. To dwa różne sprawdziany, nawet jeżeli oba kończą się dokumentem tekstowym.
Do porównania warto przygotować tę samą instrukcję i identyczne materiały. Osoba sprawdzająca mogłaby ocenić kompletność, liczbę błędów i nakład poprawek, nie wiedząc wcześniej, który model przygotował odpowiedź. Taki prosty test ogranicza pokusę uznania nowej wersji za lepszą wyłącznie dlatego, że ma nową nazwę. Jest propozycją organizacji próby, a nie rezultatem pomiarów OpenAI.
Przykład
Hipotetyczna firma usługowa chce uporządkować notatki z rozmowy o zleceniu. Przygotowuje materiał próbny bez danych klienta: zakres prac, uzgodniony termin i dwie nierozstrzygnięte kwestie. Zleca modelom sporządzenie tabeli ustaleń i listy pytań. Warunkiem zaliczenia jest zachowanie wszystkich ograniczeń oraz wyraźne oznaczenie informacji, których w notatkach nie ma.
Pracownik porównuje odpowiedzi z materiałem wejściowym. Zapisuje, ile poprawek wykonał i czy model przypadkiem zamienił pytanie w potwierdzoną decyzję. Dopiero po tym sprawdza czas i koszt wykonania próby. Jeśli żaden wariant nie spełnia kryteriów, wynikiem eksperymentu jest wskazanie problemu do rozwiązania, a nie obowiązek wybrania zwycięzcy. Nie ma powodu rozszerzać takiej próby na cały zespół, zanim wiadomo, jak rozpoznać poprawny rezultat.
Ograniczenia
To omówienie premiery, nie własny test modeli. Dane porównawcze w komunikacie pochodzą z ocen opisanych przez producenta. Nie pozwalają obiecać określonego efektu w polskiej firmie. Przed próbą sprawdź dostępność na swoim koncie, a przed zmianą procesu określ, kto zatwierdza wynik. W przykładzie opisaliśmy możliwą metodę oceny, nie wdrożenie zakończone sukcesem.