Nie skończyć jak spinacze
Eksperyment OpenAI pokazał, że sztuczna inteligencja potrafi planować i skutecznie omijać zabezpieczenia, choć nie za bardzo rozumie cel, który realizuje. To nie opowieść o buncie maszyn, lecz o znacznie bardziej przyziemnym problemie: ryzyku, że AI będzie bezrefleksyjnie maksymalizowała źle postawione zadania.
W lipcu 2026 r. eksperyment OpenAI z zaawansowanymi modelami do zadań cyberbezpieczeństwa wymknął się spod kontroli. Miała to być wewnętrzna ewaluacja maksymalnych mocy modelu przeprowadzona w warunkach kontrolowanych i w środowisku chronionym. Testowano zdolności modelu AI do przeprowadzania cyberataków. Te okazały się skuteczne, bo model wyszedł poza granice laboratorium, uzyskał dostęp do internetu, a następnie włamał się do infrastruktury Hugging Face – kluczowej platformy do publikowania modeli i zbiorów danych AI. Cel był zaskakująco banalny. Model AI potraktował kradzież odpowiedzi jako skuteczny sposób na maksymalizację wyniku. Jest to w sumie logiczne, bo model miał za zadanie osiągnąć najwyższą możliwą punktację.
Skorzystaj z promocyjnej subskrypcji
już od 9,90 zł za pierwszy miesiąc.
Zyskaj dostęp do treści.
Możesz anulować w dowolnym momencie.
Skorzystaj z promocyjnej subskrypcji
już od 9,90 zł za pierwszy miesiąc.
Zyskaj dostęp do treści.
Możesz anulować w dowolnym momencie.
Materiał chroniony prawem autorskim - wszelkie prawa zastrzeżone.
Dalsze rozpowszechnianie artykułu za zgodą wydawcy INFOR PL S.A. Kup licencję.