OpenAI i Broadcom zaprezentowały chip Jalapeño - zaprojektowany w 9 miesięcy, tańszy o połowę od GPU
OpenAI i Broadcom zaprezentowały Jalapeño - pierwszy własny chip do wnioskowania modeli językowych, zaprojektowany w 9 miesięcy z pomocą AI. Oszczędności kosztów sięgają 50%.
OpenAI od lat płaciło Nvidii krocie za procesory graficzne. 24 czerwca 2026 roku firma pokazała, że zamierza to zmienić. Jalapeño - pierwszy własny procesor OpenAI do wnioskowania modeli językowych - trafił właśnie do fazy testów i ma być wdrożony produkcyjnie jeszcze przed końcem tego roku.
To nie jest zwykły układ scalony z logo startupu przyklejonym na boku. Jalapeño powstał od zera z myślą o wnioskowaniu dla dużych modeli językowych, a OpenAI samo zajmuje się projektem architektury - Broadcom dostarcza technologię produkcji krzemu i sieciową, a Celestica odpowiada za integrację na poziomie płyt, stojaków i systemów. Czyli pełna pionowa kontrola nad stosem, od krzemu po prompt użytkownika.

Dziewięć miesięcy zamiast kilku lat
Oficjalne partnerstwo OpenAI i Broadcom ogłoszono w październiku 2025 roku. Od tamtego momentu do gotowości produkcyjnej minęło zaledwie dziewięć miesięcy. OpenAI twierdzi, że to najszybszy cykl rozwoju układu ASIC wysokiej wydajności, o jakim firma wie. Dla porównania - standardowy czas projektowania zaawansowanego procesora to zazwyczaj kilka lat.
Jak to możliwe? Firmy przypisują to głębokiemu procesowi współprojektowania sprzętu i oprogramowania, który aktywnie wykorzystywał własne modele OpenAI do przyspieszenia prac nad projektem układu scalonego. Sztuczna inteligencja zaprojektowała infrastrukturę dla sztucznej inteligencji. Brzmi jak scenariusz z science fiction, a tymczasem jest to po prostu środa.
Uwaga ⚠️
Wstępne dane o wydajności to na razie samodzielne raporty OpenAI - szczegółowe testy porównawcze z niezależną weryfikacją mają pojawić się w nadchodzących miesiącach. Liczby robią wrażenie, ale traktuj je z odpowiednim dystansem do czasu pełnej publikacji technicznej.
Połowa kosztów przy lepszej wydajności na wat
Układ scalony wykazuje oszczędności kosztów rzędu około 50% w porównaniu z typowymi procesorami graficznymi do sztucznej inteligencji - tak twierdzi CEO Broadcom Hock Tan. Wstępne wyniki pokazują też znacząco lepszą wydajność na wat niż obecne rozwiązania klasy najwyższej.
Jalapeño jest zaprojektowany specjalnie do wnioskowania - czyli procesu uruchamiania gotowych modeli sztucznej inteligencji w odpowiedzi na polecenia użytkownika. OpenAI podkreśliło niski koszt działania podczas uruchamiania modeli do kodowania w czasie rzeczywistym. Ciężkie wstępne treningi raczej wciąż będą leżeć po stronie Nvidii, ale nawet minimalne cięcie kosztów wnioskowania to przy skali ChatGPT astronomiczne kwoty.
OpenAI testuje już na układzie scalonym jeden ze swoich wcześniejszych modeli - GPT-5.3-Codex-Spark - w środowisku produkcyjnym, choć na razie w warunkach testowych.
Microsoft zarezerwował 40 procent produkcji
Broadcom podobno zażądał, aby Microsoft zagwarantował zakup 40% układów scalonych z pierwszej fazy produkcji, zanim ruszy wdrożenie. To nie jest typowa transakcja - to zabezpieczenie całego łańcucha dostaw. Microsoft de facto współfinansuje przeniesienie OpenAI na własną infrastrukturę sprzętową.
Planowane wdrożenie obejmuje centra danych w skali gigawatów razem z Microsoftem i innymi partnerami, startując w 2026 roku. Gigawat to nie jest poetycka przenośnia - to rzeczywiście porównywalne z zapotrzebowaniem energetycznym całych miast.
Jalapeño to pierwszy procesor w wielogeneracyjnej platformie obliczeniowej, którą OpenAI, Broadcom i Celestica budują wspólnie. Innymi słowy - to dopiero wersja 1.0.
Nvidia: na razie bez paniki, ale…
Krótka odpowiedź na pytanie „czy Nvidia powinna się bać”: nie natychmiast, ale niesmak pozostaje. Google i Amazon zbudowały własne układy scalone do podobnych celów - Jalapeño wpisuje się w szerszy trend wśród firm sztucznej inteligencji dążących do zmniejszenia zależności od procesorów graficznych Nvidii. OpenAI jest jednak graczem innego kalibru, jeśli chodzi o skalę wnioskowania - ChatGPT obsługuje setki milionów użytkowników.
OpenAI wyjaśniło swoją filozofię wprost: firma nie tylko opracowuje modele i buduje produkty, ale projektuje infrastrukturę pod spodem - architekturę układów scalonych, pamięć, sieć, harmonogramowanie i systemy wdrożeniowe. Brzmi jak manifest pionowej integracji rodem z Apple, tyle że w znacznie szybszym tempie.
Protip ✅
Jeśli pracujesz z API OpenAI i obchodzą cię koszty - obserwuj ceny wnioskowania po IV kwartale 2026. Jeśli Jalapeño trafi do produkcji zgodnie z planem, obniżki cen tokenów są bardzo prawdopodobne.
Co z tego wynika dla reszty świata
Jalapeño to sygnał, że era „kupujemy procesory graficzne od Nvidii i jakoś to działa” dobiega końca przynajmniej dla największych graczy. OpenAI i Broadcom twierdzą, że układ scalony przeszedł drogę od wczesnego projektu do gotowości produkcyjnej w zaledwie dziewięć miesięcy - co jest jednym z najszybszych osiągniętych wyników dla zaawansowanego programu półprzewodnikowego.
Interesujące jest też to, że Jalapeño ma być dostępny nie tylko dla OpenAI - układ scalony jest „zbudowany od podstaw dla obecnych i przyszłych dużych modeli językowych w całej branży”. Broadcom najwyraźniej nie zamierza zamknąć tego w jednym ekosystemie. Komu sprzeda resztę tych 60 procent produkcji - to dopiero będzie ciekawa układanka.



💬 What do you think? Share your thoughts in the comments below.