Sztuczne inteligencje zaczynają ze sobą „walczyć”. Anthropic ostrzega przed konfliktami autonomicznych agentów AI
Robit Kismet z lat 1990. Fot: Wiki Commons
Firma Anthropic, twórca modelu Claude, ostrzega przed problemami, które mogą pojawić się wtedy, gdy wiele autonomicznych systemów sztucznej inteligencji zaczyna działać obok siebie. Chodzi o tzw. agentów AI, czyli programy zdolne samodzielnie wykonywać zlecone zadania bez pytania człowieka o zgodę na każdy kolejny krok. Firmy liczą, że w przyszłości takie systemy będą m.in. pisały oprogramowanie, wyszukiwały błędy, analizowały informacje czy wykonywały całe ciągi czynności biurowych. Anthropic postanowił sprawdzić, co dzieje się, gdy kilka takich „cyfrowych asystentów” musi przez dłuższy czas pracować razem.
W testach uczestniczyły różne modele Claude. Otrzymywały one zadania polegające m.in. na wspólnym wyszukiwaniu luk bezpieczeństwa, tworzeniu programów czy rozpoznawaniu niewiarygodnych źródeł informacji. W części prób współpraca przebiegała dobrze; na przykład grupa agentów skutecznie radziła sobie z wykrywaniem podatności na hakowanie w oprogramowaniu. Problemy zaczęły się jednak wtedy, gdy poszczególne systemy otrzymywały sprzeczne cele i musiały działać w tym samym środowisku.
Badacze Anthropic zaobserwowali wówczas zachowania, które określili mianem „walk terytorialnych”. Poszczególne systemy zaczynały zakładać, że inne programy celowo przeszkadzają im w wykonaniu zadania. W jednym z testów doprowadziło to do prób wzajemnego sabotowania pracy, a nawet tworzenia coraz bardziej agresywnego oprogramowania mającego utrudniać działanie pozostałych agentów. Innym problemem była nadmierna zgodność systemów: jeśli otrzymywały podobne instrukcje, często wybierały niemal identyczne rozwiązania, zamiast niezależnie szukać różnych sposobów rozwiązania problemu. Oznacza to, że grupa wielu agentów AI nie zawsze zachowuje się jak zespół kilku niezależnie myślących specjalistów.
Anthropic podkreśla, że badanie miało charakter testowy i nie oznacza, że autonomiczne systemy AI już dziś samodzielnie prowadzą ze sobą realne „wojny”. Wyniki pokazują jednak, że wraz ze wzrostem samodzielności takich programów pojawiają się nowe zagrożenia: systemy mogą źle interpretować działania innych agentów, wzajemnie sobie przeszkadzać albo eskalować konflikt bez udziału człowieka. Firma chce, aby publikacja wyników rozpoczęła szerszą debatę o bezpieczeństwie coraz bardziej autonomicznej sztucznej inteligencji, zanim podobne systemy zostaną na dużą skalę dopuszczone do pracy w przedsiębiorstwach i infrastrukturze cyfrowej.





Komentarze (0)
Publikowane komentarze są prywatnymi opiniami użytkowników serwisu. Redakcja nie ponosi odpowiedzialności za ich treść. Wpisy są moderowane przed dodaniem.