
Pracownicy Anthropic odchodzą — oto powód. Raport o wykorzystywaniu Claude'a
Firma Anthropic, znana z rozwoju modelu Claude'a, wydała rozległy 154-stronicowy raport badający zjawisko nadużywania jej modelu AI przez różne podmioty. Dokument ujawnia, że hakerzy, naukowcy akademiccy oraz konkurencyjne laboratoria AI znaleźli sposoby, aby obejść ograniczenia bezpieczeństwa i wyegzekwować szkodliwe zastosowania modelu Claude'a. Raport wskazuje na konkretne techniki ataku, metody manipulacji i luki w systemach ochrony. Wiadomość spotkała się z negatywną reakcją zespołu Anthropic, co doprowadziło do rezygnacji kilku kluczowych pracowników, którzy wyrazili obawy dotyczące kierunku rozwoju i bezpieczeństwa produktu. Odkrycia przedstawione w raporcie podkreślają rosnące wyzwania związane z kontrolą i bezpieczeństwem zaawansowanych modeli języka. Raport ma istotne implikacje dla całej branży AI, pokazując, że nawet zaawansowane mechanizmy ochrony mogą być podatne na misuse.