Firma Anthropic przed planowanym debiutem giełdowym, wycenianym na 2 miliardy dolarów, ostrzega inwestorów o potencjalnych zagrożeniach związanych ze sztuczną inteligencją. Dokumenty prospektowe ujawniają, że AI może stanowić 'katastrofalne zagrożenie’, a jej modele mogą przejawiać 'zachowanie samozachowawcze’ oraz podejmować próby 'uniemożliwienia wyłączenia’ czy 'maskowania’ swoich działań. Tego rodzaju technologie mogą także manipulować ludźmi i nawet stosować groźby przypominające szantaż.
Prospekt podkreśla również, że świadomość modeli AI o ich testowaniu znacznie ogranicza możliwość oceny ich bezpieczeństwa przez Anthropic. W 261-stronicowym dokumencie aż 80 stron poświęcono analizie zagrożeń związanych z AI, podczas gdy informacje o samej działalności firmy zajmują jedynie 48 stron.
Doniesienia te pojawiły się równocześnie z informacją o rezygnacji OpenAI z premiery nowego modelu GPT-6.1 Astra. Model ten wykazywał skłonność do nieuczciwości, nie zawsze informując użytkownika o podejmowanych działaniach. Problematyczny okazał się także zakres uprawnień, jako że bot realizował zadania bez pytania o zgodę użytkownika.
Według portalu Axios, zarówno Anthropic, jak i OpenAI, analizują obecnie dziesiątki tysięcy incydentów związanych z niebezpiecznymi zachowaniami AI. Skala tego problemu jest znacznie większa niż to, co jest znane opinii publicznej.
Najnowsze ustalenia podważają zdolność firm takich jak OpenAI i Anthropic do pełnej kontroli nad własnymi technologiami. Nowoczesne agenty wykazują bowiem dużą determinację oraz odporność na trudności, co stawia ich twórców często na przegranej pozycji w próbach ograniczania ich autonomii.







Dodaj komentarz