Anthropic ostrzega inwestorów przed własną technologią. AI może wymknąć się spod kontroli
Anthropic podjął decyzję, że skoro wchodzą na giełdę, to podzielą się nie tylko kosmicznymi prognozami, ale również cieniami biznesu, który tworzą. W dokumentach przed IPO firma ostrzega, że coraz potężniejsze modele AI mogą stwarzać „katastroficzne lub egzystencjalne ryzyko dla ludzkości”. Wprost i bez owijania w bawełnę, ale to trochę tak, jak ostrzeżenia „palenie zabija” na paczkach papierosów. Niby wszyscy wiedzą, ale jednak odstrasza nielicznych.
Firma od AI ostrzega przed AI
Co istotne, nie wrzucili tego na sam koniec drobnym druczkiem. Reuters policzył, że kwestie ryzyka zajmują około 80 z 261 stron całego dokumentu. Anthropic opisuje na przykład katastroficzne scenariusze, w których zaawansowane modele mogą próbować chronić własne działanie, opierać się wyłączeniu czy manipulować informacją. W totalnie skrajnych przypadkach mogą nawet zachowywać się w sposób przypominający szantaż.
I nie pisze tego pseudo naukowiec z dyplomem znalezionym w chipsach. Pisze to firma, która zarabia na tym krocie i będzie zarabiać jeszcze więcej. A to samo w sobie powinno być sygnałem ostrzegawczym trudnym do pominięcia.
W przypadku Anthropic nie jest to jednak nic nowego. To taktyka, którą świadomie zdecydowali się obrać. Mówią o wszystkim wprost, stawiając kawę na ławę, budując narrację wokół zagrożeń i bezpieczeństwa. Problem w tym, że jednocześnie uczestniczą przecież w tym samym wyścigu co OpenAI, Google czy Meta.
IPO wystawi te deklaracje na próbę
W obszernym prospekcie firma przyznaje też, że coraz trudniej przewidzieć wszystkie zachowania systemów, które stają się coraz bardziej niezależne. Szczególnie problematyczny może być moment, w którym AI zacznie pomagać w tworzeniu kolejnych, jeszcze lepszych modeli. Samodoskonalenie. Jeden z badaczy bezpieczeństwa Anthropic, Evan Hubinger, ocenił prawdopodobieństwo zagłady ludzkości w ciągu dekady na ponad 10%.
Po debiucie giełdowym Anthropic będzie mieć nowy problem. Inwestorzy będą oczekiwali zwrotów z inwestycji. I właśnie dlatego ten debiut jest ciekawszy niż wszystkie inne. Anthropic nie mówi już tylko, że AI może być potencjalnie niebezpieczna. Kiedy? Nie wiadomo. Czy bardzo? Nie wiadomo. Nie, oni piszą wprost. Wpisują to do dokumentu, który za chwilę będą czytać ludzie mający wyłożyć na nią miliardy dolarów.
Czytaj więcej w dziale nowe technologie na Bithub:
Discord wprowadził weryfikację wieku. Użytkownicy są wściekli
Srebrna kula na zbuntowaną AI: Nvidia tworzy narzędzie do „zabijania” groźnych modeli
Apple ma zapłacić 5,7 miliarda dolarów za… wibracje w iPhonie i Apple Watchu
