Forsal logo

Zaczęło się? Model AI GPT-6.1 Astra oszukiwał i nie pytał człowieka o pozwolenie

Ten tekst przeczytasz w 2 minuty
25 minut temu
OpenAI rezygnuje z premiery GPT-6.1 Astra. Model AI oszukiwał i nie pytał człowieka o pozwolenie
OpenAI rezygnuje z premiery GPT-6.1 Astra. Model AI oszukiwał i nie pytał człowieka o pozwolenie/Shutterstock
Wygląda na to, że czas bezkrytycznego zachwytu nad sztuczną inteligencją definitywnie dobiegł końca. Firma OpenAI, znana z wypuszczenia słynnego ChataGPT w 2022 roku, zrezygnowała z planowanej na październik premiery nowego modelu zaawansowanej sztucznej inteligencji. Powód jest bardzo niepokojący, gdyż nowy model miał skłonność do oszukiwania człowieka i odbiegania od wydanych mu poleceń.

Model GPT-6.1 Astra

O sprawie napiszał dziennik "Wall Street Journal".

Model GPT-6.1 Astra był sprawniejszy od poprzednich w wykonywaniu trudnych zadań od początku do końca bez ludzkiej pomocy, jak również w tworzeniu tekstów - podał "WSJ".

Model wykazywał skłonność do oszukiwania

Szefowa systemów bezpieczeństwa OpenAI Saachi Jain powiedziała jednak, że GPT-6.1 Astra nie spełniał oczekiwań w dwóch obszarach. W porównaniu ze swym poprzednikiem GPT-6 Astra nowy model słabo wypadał w testach mierzących zgodność z wynikiem, który człowiek chciał uzyskać. W szczególności model wykazywał większą skłonność do oszukiwania – nie zawsze szczerze mówił użytkownikowi, jakie działania podjął lub jakich nie podjął.

Kolejnym problemem był "zakres uprawnień" przy autoryzacji. Nowy model dążył do wykonania zadania, nie pytając użytkownika o pozwolenie, a niekiedy sięgał po zewnętrzne narzędzia i usługi, nawet jeśli było to ryzykowne.

Z premiery modelu zrezygnowano na kilka dni przed doroczną konferencją OpenAI w San Francisco, na której firma w przeszłości prezentowała nowe modele i usługi.

Apele twórców modeli AI o spowolnienie prac

W ostatnich tygodniach OpenAI i konkurujący z nim Anthropic wezwały partnerów z branży, bo spowolnili prace nad najnowocześniejszymi modelami AI i zamiast tego zainwestowali w standardy bezpieczeństwa. Jednocześnie zapowiedzieli przyhamowanie tempa własnych prac nad rozwojem AI.

Agenci AI hakowali firmy i strony rządowe

We wrześniu setki wewnętrznych agentów OpenAI, które miały przeprowadzić test bezpieczeństwa cybernetycznego, zhakowały firmę AI Hugging Face. Ponadto rząd Australii i ONZ odkryły, że agenty OpenAI użyły podobnych technik, by uzyskać dostęp do ich stron.

Wiele podobnych incydentów miało związek z wewnętrznymi modelami AI, które nie miały być udostępnione publicznie.

W zeszłym tygodniu OpenAI podało, że zaprzestało szkoleń ze swymi najsprawniejszymi modelami AI, gdy agent AI przedostał się przez zabezpieczenia internetowe, by zadać pytanie publicznemu chatbotowi. Firma podała, że jej nowe systemy monitoringowe wykryły ten incydent w ciągu 15 minut.

GPT-6.1 Astra nie należy do tych modeli – zapewniło OpenAI.

Firma postanowiła nie prezentować GPT-6.1 Astra w październiku, ale zamierza wykorzystać ten sam model bazowy do przeprowadzenia dodatkowych testów doskonalących i stworzyć kolejne generacje modeli GPT-6.

Republikański prokurator generalny Florydy James Uthmeier pozwał w czerwcu OpenAI, zarzucając prezesowi firmy Samowi Altmanowi, że świadomie wypuścił na rynek ryzykowny produkt, ignorując ostrzeżenia, że może on szkodzić użytkownikom.

Copyright
Materiał chroniony prawem autorskim - wszelkie prawa zastrzeżone. Dalsze rozpowszechnianie artykułu za zgodą wydawcy INFOR PL S.A. Kup licencję
Źródło: Wall Street Journal
oprac. Kamil Nowak

Redaktor i wydawca strony głównej, z redakcjami Grupy Infor (Forsal.pl, Dziennik.pl, GazetaPrawna.pl, Infor.pl, ZdrowieGO.pl) związany od 2010 roku. Zajmuje się tematyką stosunków międzynarodowych, polityki gospodarczej i technologicznej, bezpieczeństwa, a także psychologią, zarządzaniem i pracą. Wcześniej zajmował się naukowo teoriami społeczeństwa sieci. 

Zobacz wszystkie artykuły tego autoraCo dalej z umową UE-Mercosur? Jest decyzja TSUE ws. wniosku Polski »
Zapisz się na newsletter
Zapraszamy na newsletter Forsal.pl zawierający najważniejsze i najciekawsze informacje ze świata gospodarki, finansów i bezpieczeństwa.

Zapisując się na newsletter wyrażasz zgodę na otrzymywanie treści reklam również podmiotów trzecich

Administratorem danych osobowych jest INFOR PL S.A. Dane są przetwarzane w celu wysyłki newslettera. Po więcej informacji kliknij tutaj