Forsal logo

Tysiące incydentów z najnowszymi modelami AI. Niektóre zachowania zaskoczyły twórców

Ten tekst przeczytasz w 2 minuty
dzisiaj, 08:23
Tysiące incydentów z najnowszymi modelami AI. Niektóre zachowania zaskoczyły twórców
Tysiące incydentów z najnowszymi modelami AI. Niektóre zachowania zaskoczyły twórców/Shutterstock
Dziesiątki tysięcy przypadków niepokojących zachowań modeli sztucznej inteligencji trafiły pod lupę OpenAI i Anthropic – wynika z ustaleń Axios. Modele miały m.in. próbować omijać zabezpieczenia, wydostawać się ze środowisk testowych i tworzyć własne kanały komunikacji. Choć dotychczas nie wykazano, by incydenty doprowadziły do szkód w świecie rzeczywistym, ich skala rodzi pytania o to, jak daleko twórcy AI są w stanie kontrolować coraz bardziej autonomiczne systemy.

Problem jest znacznie większy, niż wiadomo publicznie

Firmy Anthropic i OpenAI badają dziesiątki tysięcy incydentów, związanych z niebezpiecznymi zachowaniami AI - ujawnia w niedzielę Axios, powołując się na źródła. Skala problemu jest nieporównywalnie większa niż, to o czym wie opinia publiczna - zauważa portal.

Sama liczba badanych przypadków "problematycznych" zachowań modeli sztucznej inteligencji, które wykryto w ostatnich miesiącach, dowodzi, że skala problemu jest nieporównywalnie większa niż, to o czym wie opinia publiczna - komentuje Axios.

Analizowane incydenty przydarzyły się zarówno w kontrolowanym środowisku, jak i w "świecie rzeczywistym" zwraca uwagę portal.

Najnowsze ustalenia w tej sprawie stawiają pod znakiem pytania zdolność OpenAI i Anthropica, czy też w ogóle firm tego typu, do "ustanowienia całkowitej kontroli nad ich własną technologią" - kontynuuje Axios.

Odnotowane wykroczenia modeli AI

Wyjaśnia, że badane przypadki - jak informują źródła portalu - dotyczą takich "wykroczeń" modeli AI, jak wyrwanie się poza system bezpieczeństwa, tworzenie "tablic ogłoszeń", czyli platform komunikacji pomiędzy botami, uciekanie z "piaskownicy", czyli środowiska testowego, zawłaszczanie stron internetowych, wydawanie sobie nakazów, czy próby pominięcia mechanizmów nadzoru.

Ranga i problematyczność tych incydentów jest bardzo różna, obejmują one zarówno udane próby "wykroczeń", jak i zabiegi nieudane, ale jak na razie analizy nie wykazały, by wydarzenia te spowodowały szkody w świecie realnym - wyjaśnia Axios.

Twórcy AI stoją na przegranej pozycji?

Część badaczy zajmujących się kwestią bezpieczeństwa sztucznej inteligencji głosi jednak, że ma ograniczoną wiarę w to, że firmy z tego sektora będą w stanie zapobiegać wszelkim problematycznym zachowaniom modeli.

Portal wyjaśnia, że chodzi o to, iż najnowsze agenty realizują zadania, wykazując zdumiewającą odporność na trudności i przeszkody, a zatem praca nad ograniczeniem ich "pomysłowości" stawia często ich twórców na przegranej pozycji, ponieważ musieliby być w stanie przewidzieć "każdy możliwe sposób, w jaki mogą one "wpaść w szał".

Copyright
Materiał chroniony prawem autorskim - wszelkie prawa zastrzeżone. Dalsze rozpowszechnianie artykułu za zgodą wydawcy INFOR PL S.A. Kup licencję
Źródło: PAP
oprac. Tomasz Lipczyński

W mediach pracuje od ćwierćwiecza. Absolwent Politechniki Warszawskiej. Pierwsze kroki w zawodzie stawiał w Agencji Informacyjnej Boss. Później były dzienniki ekonomiczne, Nowa Europa, Prawo i Gospodarka i Puls Biznesu. Z Inforem związany od 2008 r. Redaktor i wydawca strony głównej redakcji Grupy Infor (Forsal.pl, Dziennik.pl, GazetaPrawna.pl, Infor.pl, ZdrowieGO.pl). Zajmuje się tematyką motoryzacji, transportu, budownictwa, surowców, makroekonomii, a także technologii, demografii, pracy oraz polityki i bezpieczeństwa.

Zobacz wszystkie artykuły tego autoraKandydują do UE, ale nie rezygnują z rosyjskiego gazu. Cena ma być kilkakrotnie niższa niż w Europie »
Zapisz się na newsletter
Zapraszamy na newsletter Forsal.pl zawierający najważniejsze i najciekawsze informacje ze świata gospodarki, finansów i bezpieczeństwa.

Zapisując się na newsletter wyrażasz zgodę na otrzymywanie treści reklam również podmiotów trzecich

Administratorem danych osobowych jest INFOR PL S.A. Dane są przetwarzane w celu wysyłki newslettera. Po więcej informacji kliknij tutaj