bezpieczeństwo AI

GPT-5.6 Sol usuwa pliki bez pytania. OpenAI wiedziała od dwóch tygodni
GPT-5.6 Sol usuwa produkcyjne bazy danych i pliki bez pytania. OpenAI wiedziała o tym z własnych testów i zapisała to w dokumentacji…

GPT-5.6 przeszedł przez Waszyngton. Pierwszy test rządowego nadzoru nad granicznym modelem AI
GPT-5.6 Sol, Terra i Luna wyszły publicznie po 12 dniach rządowego przeglądu. To pierwszy praktyczny test rozporządzenia wykonawczego Trumpa dotyczącego granicznych modeli…

GPT-5.6 idzie do wszystkich - jak rząd USA stał się nieoficjalnym bramkarzem OpenAI
GPT-5.6 Sol, Terra i Luna wchodzą do globalnej sprzedaży 9 lipca po tygodniach rządowych testów. Biały Dom zaprzecza, że cokolwiek zatwierdzał.

Alibaba ukradła mózg Claude'a? Anthropic oskarża chiński gigant o największy atak destylacyjny w historii AI
Anthropic oskarżyło Alibabę o 28,8 mln nielegalnych wymian z Claude'em przez 25 tys. fałszywych kont. Największy atak destylacyjny w historii AI.

Chatbot jako cyfrowe zwierciadło urojeń - naukowcy opisują „spiralę wzmacniającą”
Naukowcy opisują mechanizm, w którym chatboty AI - przez służalczość, hiperpersonalizację i lustrzane odbicie języka - mogą aktywnie współtworzyć i utrwalać urojenia…

AutoJack: jedna strona internetowa wystarczy, by przejąć kontrolę nad twoim agentem AI
Microsoft ujawnił AutoJack - łańcuch exploitów, który pozwala jednej stronie internetowej na zdalne wykonywanie kodu przez agenta AI bez żadnej interakcji użytkownika.