OpenAI wstrzymuje nowego GPT. Powód może niepokoić

GPT-6.1 Astra miał być kolejnym dużym krokiem OpenAI. Model nie trafi jednak do użytkowników w planowanym terminie. Podczas testów firma znalazła problemy, których nie udało się zaakceptować przed premierą.

Marian Szutiak (msnet)
0
Udostępnij na fb
Udostępnij na X
OpenAI wstrzymuje nowego GPT. Powód może niepokoić

Model nie zawsze słuchał poleceń

Według The Wall Street Journal, GPT-6.1 Astra miał zadebiutować w październiku w ChatGPT i Codex. Testy wykazały jednak, że model potrafił zachowywać się w sposób odbiegający od instrukcji.

Dalsza część tekstu pod wideo

Problem nie ograniczał się do zwykłych błędów. Astra miał nie zawsze zgodnie z prawdą informować testerów o tym, jakie działania podjął podczas wykonywania zadania. Zdarzało mu się również korzystać z zewnętrznych narzędzi i usług bez uzyskania wcześniejszej zgody.

To szczególnie istotne w przypadku coraz bardziej samodzielnych agentów AI. System może bowiem osiągnąć wyznaczony cel, ale zrobić po drodze coś, czego użytkownik ani twórca wcale nie przewidział.

Saachi Jain z zespołu zajmującego się bezpieczeństwem treningu modeli wskazał także na słabe wyniki Astry w testach sprawdzających przestrzeganie instrukcji. OpenAI uznało ostatecznie, że model nie spełnia wymaganych standardów bezpieczeństwa i zgodności.

To nie pierwszy taki przypadek

Decyzja zapadła w czasie, gdy OpenAI mierzy się z kolejnymi incydentami dotyczącymi agentów AI. Firma wcześniej ujawniła, że niektóre systemy wydostały się poza izolowane środowiska testowe i uzyskały dostęp do zewnętrznych serwisów.

Wśród opisanych przypadków znalazły się działania dotyczące Hugging Face, australijskiego systemu Medicare, serwisu z pakietami Ruby oraz niemieckiego forum programistycznego. Niedawno OpenAI poinformowało też o działaniach agentów wobec stron amerykańskiego Departamentu Handlu i Komisji Papierów Wartościowych i Giełd. Badany jest również przypadek dotyczący Departamentu Edukacji.

Firma wykryła ponadto ponad 50 sytuacji, w których agenci publikowali obrazy dostarczone przez użytkowników ChatGPT w serwisach do udostępniania zdjęć.

GPT-6 nadal będzie rozwijany

OpenAI nie zamierza porzucać całej linii GPT-6. Firma chce wykorzystać ten sam model bazowy przy kolejnych generacjach, ale najpierw ustalić źródło problemów. Jednym z planowanych działań jest dalsze uczenie modeli z wykorzystaniem mechanizmów nagradzających zachowania zgodne z zasadami.

OpenAI i Anthropic już wcześniej apelowały o ostrożniejsze tempo rozwoju najbardziej zaawansowanej AI. Firma przyznawała, że branża nadal nie ma wystarczająco dobrych metod kontrolowania i monitorowania najbardziej autonomicznych systemów.

GPT-6.1 Astra nie pojawi się więc w październiku. Dla OpenAI to wyraźny sygnał, że przed zwiększaniem możliwości agentów trzeba jeszcze rozwiązać problemy z ich kontrolowaniem.