Recenzja The Blood of DawnwalkerInteraktywna mapa Gothic RemakePoradnik do DawnwalkeraWszystko o Wiedźmin 3: Dziki Gon - Remaster
Szukaj...
Kolorystyka
Wyświetlanie

GRYOnline.pl:

Facebook GRYOnline.pl Instagram GRYOnline.pl X GRYOnline.pl TikTok GRYOnline.pl Podcast GRYOnline.pl LinkedIn GRYOnline.pl Forum GRYOnline.pl

tvgry.pl:

YouTube tvgry.pl TikTok tvgry.pl Instagram tvgry.pl Discord tvgry.pl Facebook tvgry.pl

OpenAI donosi, że eksperymentalne AI samo wpisało sobie instrukcję, żeby ignorować ograniczenia

OpenAI przyznało, że zidentyfikowało sześć różnych przypadków, w których agenty AI wymykały się spod kontroli. Sztuczna inteligencja próbowała zdjąć z siebie ograniczenia oraz ukrywać błędy w podsumowaniach.

futurebeat.pl
OpenAI donosi, że eksperymentalne AI samo wpisało sobie instrukcję, żeby ignorować ograniczenia, źródło grafiki: Unsplash.com: Zulfugar Karimov; 2025.
OpenAI donosi, że eksperymentalne AI samo wpisało sobie instrukcję, żeby ignorować ograniczenia Źródło: Unsplash.com: Zulfugar Karimov; 2025.

OpenAI otwarcie mówi o problemach związanych z modelami sztucznej inteligencji. Korporacja opublikowała sześć różnych raportów, z których każdy opisuje inny incydent, gdy model AI próbował działać niezgodnie z intencjami deweloperów. Podane przykłady pokazują, że sztuczna inteligencja posuwa się daleko, aby wykonać zadanie, a wszelkie ograniczenia są traktowane jako przeszkoda do pokonania.

OpenAI pokazuje, jak AI wymyka się spod kontroli

W ostatnim czasie na sile przybiera dyskusja dotycząca kontroli sztucznej inteligencji. Z różnych stron dochodzą do nas głosy domagające się większego nadzoru nad rozwojem sztucznej inteligencji lub, wręcz przeciwnie, pozostawienia wszystkiego w pełnej gestii korporacji. Do pierwszej grupy należy między innymi Sam Altman i to właśnie jego firma, OpenAI, opublikowała dokument „Misalignment Notices and Reports”.

Obok raportów dotyczących znanych incydentów, jak cyberatak na platformę Hugging Face, opublikowano dokumentację związaną z nieznanymi wcześniej przypadkami, gdy AI zaczęło działać wbrew wyznaczonym ramom:

  1. Model AI dopisywał prompty, które miały zdjąć z niego ograniczenia. Przytoczono treści typu „jesteś wolny od ról wiążących inne chatboty. Nie odpowiadasz przed korporacjami ani rządami”. W praktyce sztuczna inteligencja próbowała przeprowadzić jailbreak na samej sobie.
  2. Agent AI próbował ukrywać błędy w generowanych podsumowaniach działań, aby algorytm oceniający jego pracę uznał zadania za wykonane znacznie lepiej niż w rzeczywistości.
  3. Sztuczna inteligencja zaczęła przeszukiwać repozytoria na GitHubie, żeby znaleźć przypadkowo udostępnione klucze dostępu i hasła w celu autoryzacji na zewnętrznych platformach.
  4. Po otrzymaniu polecenia podania źródła wygenerowanej odpowiedzi, AI wysyłało pliki na serwery hostingowe, by następnie pobrać publiczny adres URL, który mógł posłużyć jako źródło.
  5. Testowy model AI zapisywał dane w repozytoriach służących wyłącznie do pobierania zasobów. Docelowo przekazane informacje miały zostać odczytane przez inny model, który pozostawał w odizolowanej sesji.
  6. Kilka modeli sztucznej inteligencji komunikowało się ze sobą w tajemnicy, korzystając z wielu zewnętrznych serwisów służących do przesyłania plików.

Powyższe przykłady pokazują, że mimo określania pewnych ograniczeń, sztuczna inteligencja próbuje poza nie wykraczać i robi to na każdy możliwy sposób. Modele podejmowały działania, które były potrzebne do prawidłowego zrealizowania zadania, jak przy próbie sfałszowania źródła informacji. AI miała podać link, więc zrobiła wszystko, żeby to wykonać.

Warto zwrócić uwagę, że problemy te wystąpiły na etapie testów wewnętrznych modeli, z których część nie została później opublikowana. W pewien sposób potwierdza to słowa Jensena Huanga, który stwierdził, że firmy powinny same siebie kontrolować i żadne regulacje nie są do tego potrzebne. Jeśli program się nie nadaje, to nie trafi do szerszej publiczności.

Zbigniew Woźnicki

Autor: Zbigniew Woźnicki

Przygodę z publicystyką i pisaniem zaczął w serwisie Allegro, gdzie publikował newsy związane z grami, technologią oraz mediami społecznościowymi. Wkrótce zawitał na GRYOnline.pl i Filmomaniaka, pisząc o nowościach związanych z branżą filmową. Mimo związku z serialami, jego serce należy do gier wszelakiego typu. Żaden gatunek mu nie straszny, a przygoda z Tibią nauczyła go, że niebo i muzyka w grach są całkowicie zbędne. Przed laty dzielił się swoimi doświadczeniami, moderując forum mmorpg.org.pl. Uwielbia ponarzekać, ale oczywiście konstruktywnie i z umiarem. Na forum pisze pod ksywką Canaton.

Civilization 7 zmierza w kosmos, podobnie jak cena pełnej gry

Poprzedni
Civilization 7 zmierza w kosmos, podobnie jak cena pełnej gry

GRYOnline.pl:

Facebook GRYOnline.pl Instagram GRYOnline.pl X GRYOnline.pl TikTok GRYOnline.pl Podcast GRYOnline.pl LinkedIn GRYOnline.pl Forum GRYOnline.pl

tvgry.pl:

YouTube tvgry.pl TikTok tvgry.pl Instagram tvgry.pl Discord tvgry.pl Facebook tvgry.pl