Nowiny
OpenAI wkrótce wypuści Astrę, ale z „przyciskiem paniki”, którego się nie spodziewaliśmy
To pierwszy model OpenAI z oceną Critical za autonomiczne wykorzystywanie luk

- 2 września 2026
- Zaktualizowany: 2 września 2026 09:51

OpenAI przygotowuje premierę Astry, swojego najbardziej zaawansowanego modelu, i tym razem mocy towarzyszy szczególnie rzucający się w oczy system bezpieczeństwa. Po incydencie, w którym model OpenAI zaatakował Hugging Face, firma znacząco wzmocniła mechanizmy kontroli i zabezpieczenia. Kiedy trafi do użytku publicznego, Astra będzie automatycznie przerywać określone działania, gdy podsystem bezpieczeństwa uzna to za stosowne. Coś w rodzaju przycisku paniki, by utrzymać pod kontrolą jej najbardziej zaawansowane możliwości.
Pierwszy model OpenAI z ryzykiem „Critical”
Jak podaje Axios, OpenAI uważa, że Astra jest pierwszym modelem, który osiąga poziom Critical w swoim systemie oceny gotowości. Potrafi znajdować nieznane podatności i opracowywać sposoby ich wykorzystywania w pełni autonomicznie. Podczas testów Astra zdołała wykryć i połączyć dwie podatności zero-day, co stanowi bardzo znaczący skok w ewolucji, którą widzieliśmy już przy premierze GPT-5.6, a także względem narzędzi cyberbezpieczeństwa OpenAI, które pomogły poprawić bezpieczeństwo Google Chrome.
Jeśli weźmiemy pod uwagę agentów takich jak ChatGPT Work, zdolnych wykonywać zadania przez wiele godzin, nowe podejście, bardziej skoncentrowane na trwałej kontroli, a nie na kontroli początkowego promptu czy wyników, jest interesujące. Im dłużej pracuje agent, tym więcej dróg może obrać i tym ważniejsze jest, by system mógł nadzorować każdy jego krok w ramach swojej pracy.
Przy takim podejściu OpenAI przygotowało zabezpieczenia zdolne spowalniać, wstrzymywać lub bezpośrednio zatrzymywać zadanie po wykryciu określonych sygnałów aktywności. W ChatGPT lub Codexie będziemy mogli poprosić o sprawdzenie wstrzymanego działania, podczas gdy w API zadanie zostanie automatycznie wstrzymane na tym etapie. W obu przypadkach jednak największe możliwości pozostaną początkowo w rękach ograniczonej grupy testerów, podczas gdy nowe zabezpieczenia będą dopracowywane.
Architekt | Założyciel hanaringo.com | Trener technologii Apple | Pisarz w Softonic i iDoo_tech, wcześniej w Applesfera
Najnowsze od David Bernal Raspall
- GPT-6 Astra już tu jest: OpenAI uważa, że to początek AGI
- Google uruchamia Gmail Live: głosowe funkcje Gemini trafiają do Gmaila, Docs i Keep
- Co Claude robi na naszym Macu, kiedy nie patrzymy? To jego ostatnia wielka nowość
- Czy ta wiadomość jest naprawdę od Amazona? Tak możemy użyć jego AI, by bronić się przed oszustwami
Również może Cię zainteresować
NowinyZapowiedziano kontynuację jednego z najbardziej szalonych Action RPG ostatnich lat
Czytaj więcej
NowinyNowy film Nicolasa Cage’a doczekał się zwiastuna z dołączoną kontrowersją: stoi za nim pozew na 105 milionów dolarów
Czytaj więcej
NowinyXbox potwierdza, że od listopada stracisz część korzyści swojego Game Passa
Czytaj więcej
NowinyPlayStation zapowiada nowe akcesorium inspirowane GTA 6
Czytaj więcej
NowinyEvan Rachel Wood ujawniła, że nie zagra w „Totalnej magii 2”: jest z tego wściekła… i słusznie
Czytaj więcej
NowinyAndrew Garfield znów o Marvelu: nie widział „Spider-man: Brand New Day”
Czytaj więcej