Badacz bezpieczeństwa sztucznej inteligencji z firmy Anthropic ostrzegł, że istnieje ponad 10-procentowe prawdopodobieństwo, iż coraz bardziej zaawansowane systemy AI mogą "zabić wszystkich ludzi" w ciągu najbliższej dekady, co podkreśla rosnące w branży obawy dotyczące tempa rozwoju tej technologii.
Evan Hubinger, kierownik zespołu ds. stress testów AI (AI Alignment Stress-Testing) w firmie Anthropic, napisał na platformie X: "Osobiście uważam, że w ciągu najbliższej dekady prawdopodobieństwo to przekracza 10%". Wyjaśnił, że ryzyko związane z obecnymi modelami AI jest "niskie", ale wyraził zaniepokojenie możliwością powstania superinteligencji w wyniku rekurencyjnego samodoskonalenia - czyli zdolności systemu AI do autonomicznego opracowania własnego następcy. Dodał, że Anthropic "robi, co w jego mocy", ale nie ma jeszcze planu rozwiązania problemu zgodności celów w przypadku superinteligencji i "nie jest na drodze do jego szybkiego opracowania".
Komentarze Hubingera pojawiły się w odpowiedzi na rezygnację Jacoba Coxona, badacza AI pracującego w Anthropic. We wpisie na platformie X Coxon zarzucił firmom OpenAI i Anthropic, że "pędzą w stronę samodoskonalącej się superinteligencji, ryzykując nasze życie". "Żadna z tych firm nie postępuje odpowiedzialnie" - stwierdził. Coxon argumentował, że przyszłe modele AI mogą zyskać zdolność do włamywania się do systemów, szybkiego przekształcania całych gałęzi przemysłu oraz przejmowania "realnej władzy i zasobów". Wezwał do lepszej koordynacji działań między twórcami AI, w tym do tymczasowego wstrzymania prac nad zwiększaniem możliwości modeli.
"W OpenAI wielu pracowników nie w pełni uświadamia sobie stawkę, jaką jest przyszłość cywilizacji" - ostrzegł. Z kolei w firmie Anthropic - jak zauważył - "znaczenie tego wyzwania jest dobrze rozumiane", ale panuje tam przekonanie, że "skoro nikt inny nie zachowa się odpowiedzialnie, oni sami muszą to zrobić, mimo istniejącego ryzyka".
Giganci branży AI znajdują się pod coraz większą presją w związku z działaniem autonomicznych systemów. W ostatnich miesiącach firmy OpenAI, Anthropic i Meta informowały o bezprecedensowych incydentach, w których narzędzia AI wykorzystywano do przeprowadzania cyberataków. Rzeczywiście, w opublikowanym w sierpniu raporcie dotyczącym ryzyka firma Anthropic oceniła, że choć zagrożenie stwarzane przez obecne modele jest niewielkie, to "pewność co do tej oceny jest mniejsza niż w przypadku wcześniejszych raportów". Wskazano, że zaawansowane modele mogą w przyszłości zautomatyzować procesy badawczo-rozwojowe, gwałtownie przyspieszyć postęp w dziedzinach technicznych i "doprowadzić do katastrofalnych skutków". "Obserwujemy wczesne oznaki potencjalnego przyspieszenia" - oświadczyła amerykańska firma.
na podst. informacji MobileWorldLive