NA ŻYWO 
NASŁUCH: 11 ŹRÓDEŁ ZE ŚWIATA
Skip to content
PILNEPrzestaniesz blokować telefon przy instalowaniu apki spoza Sklepu. Google w końcu to naprawiaDZIŚ
NASŁUCHUJEMY ŚWIATA · przepisujemy po polsku z podaniem źródłaThe VergeArs TechnicaTechCrunchWiredEngadgetHacker NewsMIT Tech ReviewThe RegisterTom's Hardware404 MediaRest of World
AI

GPT-5.6 przeszedł przez Waszyngton. Pierwszy test rządowego nadzoru nad granicznym modelem AI

GPT-5.6 Sol, Terra i Luna wyszły publicznie po 12 dniach rządowego przeglądu. To pierwszy praktyczny test rozporządzenia wykonawczego Trumpa dotyczącego granicznych modeli AI i precedens dla całej branży.

8 min read
GPT-5.6 przeszedł przez Waszyngton. Pierwszy test rządowego nadzoru nad granicznym modelem AI

9 lipca 2026 roku OpenAI ogłosiło publiczną premierę rodziny GPT-5.6. Trzy modele - Sol, Terra i Luna - stały się dostępne w ChatGPT, API i Codexie. Komunikat brzmiał jak zwykłe wprowadzenie produktu na rynek. Nie był. Za kulisami przez poprzednie 12 dni rozgrywał się pierwszy praktyczny test rządowego systemu nadzoru nad modelami granicznymi w USA - systemu, który oficjalnie jest dobrowolny, a w praktyce działa jak coś znacznie bardziej wiążącego.

Sekwencja zdarzeń jest prosta: 26 czerwca OpenAI ogłosiło GPT-5.6 i niemal jednocześnie zgodziło się ograniczyć dostęp do modelu na prośbę Białego Domu. Przez 12 dni dostęp miało około 20 wstępnie zatwierdzonych organizacji. Departament Handlu przeprowadzał ocenę. OpenAI wysłało technicznych ekspertów do Waszyngtonu. 9 lipca ogłoszono szeroką premierę. Jak zauważył TechTimes, to był precedens, który - bez względu na etykietki prawne - de facto przypomina wstępną zgodę.

GPT-5.6 przeszedł przez Waszyngton. Pierwszy test rządowego nadzoru nad granicznym modelem AI

Sol, Terra, Luna - i dlaczego rząd USA się tym zainteresował

Sol to model flagowy dla złożonych zadań autonomicznych, Terra to opcja produkcyjna do codziennego użytku, Luna - najszybsza i najtańsza. Cennik jest klarowny: Sol kosztuje 5 dolarów za milion tokenów wejściowych i 30 dolarów za milion tokenów wyjściowych, Terra odpowiednio 2,50 i 15 dolarów, a Luna 1 i 6 dolarów.

Sol uzyskał wynik 96,7% w wewnętrznym teście oceniającym zdolności do cyberataków i osiągnął na teście porównawczym ExploitBench wyniki porównywalne z modelem Mythos Preview Anthropic przy około jednej trzeciej kosztu wnioskowania. Nie jest to cecha, którą rząd USA może zignorować. Wszystkie trzy modele GPT-5.6 - Sol, Terra i Luna - zostały sklasyfikowane na poziomie ryzyka „High” zarówno dla zdolności cybernetycznych, jak i biologiczno-chemicznych w ramach Preparedness Framework OpenAI.

OpenAI potwierdziło jednak, że żaden z modeli nie przekroczył progu „Critical” - w testach model znajdował błędy i budulce exploitów w przeglądarkach Chromium i Firefox, ale nie tworzył autonomicznie kompletnych działających exploitów. To rozróżnienie ma znaczenie prawne: rozporządzenie wykonawcze Trumpa skupia się właśnie na modelach, które mogłyby prowadzić autonomiczne ataki na systemy.

Na konferencji CNBC CEO Sam Altman powiedział, że Sol osiąga 54% wyższy poziom efektywności tokenowej na zadaniach autonomicznego kodowania. „Każde przedsiębiorstwo teraz myśli o wydatkach i wartości, którą dostaje w zamian za AI” - powiedział Altman. Na teście porównawczym Terminal-Bench 2.1 Sol uzyskał wynik 88,8%, a konfiguracja Sol Ultra osiągnęła 91,9%, wyprzedzając Claude Mythos 5 (84,3%) i GPT-5.5 (88,0%).

Rozporządzenie wykonawcze: dobrowolność z gwiazdką

2 czerwca 2026 roku prezydent Trump podpisał rozporządzenie wykonawcze zatytułowane „Promoting Advanced Artificial Intelligence Innovation and Security” - najbardziej znaczący krok administracji w kierunku federalnego nadzoru nad AI, zaprojektowany niemal wyłącznie wokół cyberbezpieczeństwa. Rozporządzenie ma charakter dobrowolny i nie tworzy systemu licencjonowania ani obowiązkowej wstępnej zgody dla modeli AI.

Ruch OpenAI wydaje się być pierwszą publiczną implementacją procesu przeglądu AI ustanowionego przez niedawne rozporządzenie wykonawcze Trumpa o modelach granicznych AI. Dobrowolne ramy pozwalają deweloperom udostępniać „modele graniczne” rządowi USA na do 30 dni przed wydaniem zaufanym partnerom. Pierwotnie proponowany okres przeglądu wynosił 90 dni, ale w finalnej wersji skrócono go do 30 dni.

Tu zaczyna się rozbieżność między teorią a praktyką. Rozporządzenie wprost zakazuje przekształcenia tego procesu w obowiązkowy wymóg licencjonowania lub wstępnej zgody; uczestnictwo jest sformułowane jako dobrowolne - choć przy tym, że rząd federalny jest znaczącym klientem wielu tych systemów, „dobrowolność” może mieć w praktyce znaczną wagę.

Uwaga ⚠️

Rozporządzenie wykonawcze nie zawiera żadnego mechanizmu egzekwowania dla firm, które zdecydują się nie uczestniczyć w przeglądzie. Brak udziału nie wiąże się z sankcjami prawnymi - tylko z konsekwencjami handlowymi i reputacyjnymi. W przypadku firm, które liczą na rządowe kontrakty, ta różnica jest czysto akademicka.

12 dni w Waszyngtonie - co naprawdę się wydarzyło

Przez 12 dni między 26 czerwca a 9 lipca GPT-5.6 był dostępny tylko przez API OpenAI i Codex dla około 20 zweryfikowanych organizacji, których tożsamość OpenAI przekazało bezpośrednio rządowi - po raz pierwszy w historii amerykańskie laboratorium AI ogrodziło model graniczny za listą klientów zatwierdzoną przez państwo.

Altman potwierdził w rozmowie z CNBC, że w procesie zatwierdzenia uczestniczyli Commerce Secretary Howard Lutnick, Treasury Secretary Scott Bessent i krajowy dyrektor ds. cyberbezpieczeństwa Sean Cairncross. Opisał współpracę OpenAI z rządem jako „wspólne negocjacje”, w których federalni recenzenci zgłaszali problemy do rozwiązania przez firmę.

Commerce Secretary Howard Lutnick szukał zapewnień od Sama Altmana, że wszystkie właściwe agencje federalne zakończyły przegląd przed jakimkolwiek szerszym uruchomieniem. Sytuację rozwiązało ukończenie oceny przez CAISI i wysłanie przez OpenAI ekspertów technicznych do Waszyngtonu, którzy pozostawali do dyspozycji i odpowiadali na pytania w miarę ich pojawiania się.

Ograniczone uruchomienie wykroczyło poza dobrowolne ramy wstępnego przeglądu, które prezydent Trump podpisał 2 czerwca. Tam, gdzie ta struktura opierała się na dobrowolnym uczestnictwie, sytuacja GPT-5.6 zaowocowała listą dostępu tworzoną przez rząd - układem, o którym Altman powiedział pracownikom, że OpenAI nie uważa go za zrównoważone podejście długoterminowe.

Oficjalny głos Białego Domu brzmiał inaczej. „Żadna taka zgoda nie jest wymagana ani udzielana” - powiedział urzędnik Białego Domu w oświadczeniu dla Axios, dodając, że decyzje o terminie i zakresie wydania modelu „spoczywają całkowicie na firmach”. Urzędnik wskazał też na rozporządzenie wykonawcze Trumpa z 2 czerwca, które zakazuje obowiązkowego federalnego licencjonowania lub wstępnej zgody wydań modeli AI. Teoretycznie. W praktyce OpenAI wysłało technicznych ekspertów do Waszyngtonu i czekało na sygnał do działania.

OpenAI mówi: to nie powinien być standard

OpenAI nie ukrywało swojej pozycji. „Nie sądzimy, aby ten rodzaj rządowego procesu dostępu powinien stać się długoterminowym standardem. Odcina najlepsze narzędzia od użytkowników, deweloperów, firm, obrońców cybernetycznych i globalnych partnerów, którzy ich potrzebują” - napisała firma. Spółka przedstawiła ograniczone uruchomienie jako krok krótkoterminowy, a nie stałe rozwiązanie.

CEO Sam Altman poinformował pracowników, że rząd będzie „zatwierdzał dostęp klient po kliencie” w trakcie okresu podglądu. Biorąc pod uwagę publiczne stanowisko firmy, brzmiało to jak opis procesu, który OpenAI toleruje, ale nie popiera. Altman wyraził to bardziej dyplomatycznie: „Jeśli chcesz szerokiego dostępu - a chcemy - i masz potężne modele, naprawdę chcesz mieć pewność co do twoich twierdzeń dotyczących bezpieczeństwa, bo w przeciwnym razie świat bardzo szybko stanie się nieprzyjemny”.

Protip ✅

Dla deweloperów i firm, które budują na modelach granicznych: czas dodać do planów projektowych bufor na potencjalny okres rządowego przeglądu. Nie dlatego, że prawo tego wymaga, ale dlatego, że precedens GPT-5.6 pokazuje, jak wygląda rzeczywistość operacyjna.

Anthropic w tle - i następny termin: 1 sierpnia

GPT-5.6 nie był pierwszym zderzeniem branży AI z regulacyjną rzeczywistością w 2026 roku. Sytuacja wywołała porównania z niedawnym doświadczeniem Anthropic, gdy decyzja o kontroli eksportu zmusiła firmę do wycofania modeli Fable 5 i Mythos 5 z ogólnej dostępności. Fable 5 przywrócono, ale Mythos 5 pozostaje ograniczony do wąskiego zestawu organizacji w USA.

Dostępność GPT-5.6 po ocenie rządowej wpisuje się w cele nakreślone w rozporządzeniu wykonawczym AI Trumpa z czerwca, które prosiło głównych deweloperów AI o dobrowolne poddanie swoich czołowych modeli AI ocenom bezpieczeństwa przez regulatorów rządowych, w dużej mierze wynikając z opracowania i wydania przez Anthropic Mythos - potężnego modelu skoncentrowanego na cyberbezpieczeństwie, który wywołał powszechne obawy co do jego potencjalnego ofensywnego zastosowania.

Uwaga skupia się teraz na terminie 1 sierpnia 2026 roku. To 60 dni od podpisania rozporządzenia wykonawczego - termin, do którego NSA musi sfinalizować klasyfikowany proces testów porównawczych służący do wyznaczania „modeli granicznych” i do którego wieloagencyjna grupa musi opublikować formalny dobrowolny framework rządzący tym procesem przeglądu.

Jeśli framework z 1 sierpnia sformalizuje to, co wydarzyło się nieformalnie z Anthropic i OpenAI, wynikiem będzie ustandaryzowany proces ze znanymi harmonogramami i zdefiniowanymi rolami. Jeśli pozostanie tak doraźny jak to, co zastąpił, rzeczywistość operacyjna branży będzie nadal polegać na negocjacjach prowadzonych indywidualnie z tymi urzędnikami rządowymi, którzy zdecydują się angażować.

Według doniesień Financial Times z 3 lipca, rozmowy pięciu laboratoriów - Anthropic, OpenAI, Google, Microsoft i Amazon - zmierzają w kierunku wspólnego systemu oceniania poważności prób włamania. To jeszcze nie dobrowolny nadzór rządowy, ale pokazuje, że branża sama próbuje wypracować standardy - zanim standardy zostaną narzucone z zewnątrz.

Czy Waszyngton stał się nowym strażnikiem dla AI?

Premiera GPT-5.6 jest jednym z najwyraźniejszych sygnałów, że premiery modeli granicznych to już nie tylko wydarzenia produktowe. Stają się kwestiami przeglądu rządowego, polityki eksportowej, ryzyka cybernetycznego i rywalizacji geopolitycznej.

Różnica między tym, co rozporządzenie wykonawcze mówi, a tym, co wydarzyło się w praktyce, jest wyraźna. Choć framework jest wyraźnie dobrowolny i wyklucza obowiązkowy wymóg licencjonowania lub wstępnej zgody, uczestnictwo może okazać się w praktyce bliższe de facto obowiązkowi, biorąc pod uwagę ryzyko nadzoru bezpieczeństwa narodowego i koszt reputacyjny. OpenAI to wiedziało i zagrało ostrożnie.

Zwolennicy widzą w tym odpowiedzialny system działający prawidłowo, skoro modele, które potrafią znajdować luki w oprogramowaniu lub wspomagać projektowanie broni biologicznej, zasługują na dokładną analizę przed publicznym wydaniem. Współpraca w przeglądzie, w tym ujęciu, jest lepsza od nieodpowiedzialnych premier lub całkowitych zakazów. Krytycy widzą coś bardziej niepokojącego - władzę wykonawczą decydującą, kiedy prywatna firma może wypuścić produkt.

Odpowiedź na pytanie, czy ta precedensowa sytuacja z GPT-5.6 utrwali się jako model dla przyszłych modeli granicznych, przyjdzie 1 sierpnia. Do tego czasu branża działa w próżni prawnej - bez formalnych kryteriów, bez znanych harmonogramów i bez jasnych zasad tego, gdzie kończy się przegląd bezpieczeństwa, a zaczyna polityczne zarządzanie dostępem do technologii. Zamiast polegać na ogólnej polityce, rząd wydaje się oceniać zaawansowane systemy AI indywidualnie przed zezwoleniem na szeroką dostępność komercyjną lub publiczną - wzorzec, który może kształtować precedens dla przyszłych premier modeli w całej branży.

Avatar photo

futurystyk.pl

ADMINISTRATOR

FUTURYSTYK to technologiczny nasluch swiata. Codziennie wybieramy najwazniejsze newsy o sprzecie, komponentach, AI, oprogramowaniu, nauce i kosmosie, sprawdzamy je w zagranicznych zrodlach i przepisujemy po polsku - konkretnie, bez sciemy i z podaniem skad to mamy.