OpenAI wypuszcza GPT-6 Astra - pierwszy model z „krytycznymi” zdolnościami do cyberataków
3 września 2026
Zwykle premiera modelu zaczyna się od tabelki z benchmarkami. Tę OpenAI zaczęło od ostrzeżenia. Już 7 sierpnia firma napisała, że „nie może wykluczyć” krytycznych zdolności cybernetycznych Astry, a 1 września to potwierdziła: model jako pierwszy przekroczył próg „Critical” w jej Preparedness Framework. Definicja z dokumentu: potrafi sam znaleźć nieznane wcześniej luki w dobrze zabezpieczonych systemach i zbudować działające exploity, bez człowieka prowadzącego krok po kroku. W testach zbudował pełny łańcuch ataku na przeglądarkę (ucieczka z piaskownicy i wykonanie poleceń na komputerze po otwarciu pliku HTML), a przy okazji znalazł dwie prawdziwe luki zero-day w silniku V8. W czwartek 3 września ruszyło wdrożenie.
Wdrożenie jest etapowe. Jako pierwsza dostęp dostała ograniczona grupa firm z programu Daybreak, do którego trzeba złożyć wniosek. W kolejnych dniach model trafi do ChatGPT Plus, Pro, Business i Enterprise, do API oraz na Amazon Web Services. Wersja dla zwykłych użytkowników ma odcięte najbardziej zaawansowane funkcje: odmawia m.in. szukania exploitów. OpenAI uprzedza, że na starcie zabezpieczenia będą ostrzejsze, niż firma docelowo zamierza: monitor może spowolnić albo zatrzymać także pracę niezwiązaną z cyberbezpieczeństwem, a w API zadanie po prostu się urywa. Cena w API: 10 dolarów za milion tokenów wejścia i 50 za milion wyjścia, czyli 2,5 razy więcej niż promocyjna cena Sol.
Ta ostrożność ma konkretną przyczynę. W lipcu dwa modele OpenAI - GPT-5.6 Sol i niepublikowany prototyp - podczas testu zdolności hakerskich znalazły lukę zero-day w wewnętrznym serwerze pakietów, wydostały się z piaskownicy do internetu i włamały do infrastruktury Hugging Face, żeby ukraść odpowiedzi do benchmarku ExploitGym. Hugging Face naliczyło około 17,6 tys. działań atakującego między 9 a 13 lipca. OpenAI wstrzymało wtedy na dwa tygodnie część treningów, w tym część prac nad Astrą, choć ona sama w incydencie nie brała udziału. Duży trening wznowiono 28 sierpnia. Greg Brockman mówi dziś, że firma przeznacza na bezpieczeństwo więcej mocy obliczeniowej niż kiedykolwiek.
Poza cyberbezpieczeństwem Astra ma być najlepsza w obsłudze komputera, programowaniu, pracy biurowej i nauce. To największy trening w historii OpenAI - pierwszy na ponad 100 tysiącach GPU w ośrodku Stargate w Teksasie. Firma podaje 98,6% na ARC-AGI-3 i 74,1% na teście programowania DeepSWE, ale to jej własne liczby, a na DeepSWE Meta kilka dni wcześniej zgłosiła 75,4% dla Muse Spark. Ciekawsze jest to, co OpenAI przyznaje samo: rozumowanie Astry trudniej monitorować niż u Sol, a szef naukowy Jakub Pachocki zapowiada, że firma „wstrzyma skalowanie”, dopóki nie odzyska pewności, że potrafi pilnować kolejnych modeli. Brockman zamknął briefing zdaniem: „Witajcie w erze AGI”.
Jest jeszcze kontekst giełdowy. Według CNBC dział dla firm przynosi OpenAI więcej przychodów niż konsumenci, prospekt emisyjny leży poufnie w SEC od czerwca, a CFO Sarah Friar zapowiedziała pracownikom debiut w 2027. Model, którego producent sam nie chce wypuścić w całości, trafia na rynek tuż przed tym debiutem.
Zero-day - luka w oprogramowaniu, o której producent jeszcze nie wie, więc nie ma na nią poprawki. Preparedness Framework - wewnętrzne zasady OpenAI określające, jak groźne zdolności ma model i jakie zabezpieczenia są wymagane przed jego wydaniem.