
Firma Anthropic od lat buduje swój wizerunek jako najbardziej etyczny gracz w branży sztucznej inteligencji. Podkreśla znaczenie bezpieczeństwa, prywatności i odpowiedzialnego rozwoju modeli. Tymcz...
Odkrycie dokonał niezależny badacz bezpieczeństwa znany pod pseudonimem Thereallo. Mechanizm działał w sposób niezwykle subtelny i trudny do zauważenia przez zwykłego użytkownika. Informacje o strefie czasowej komputera oraz o używanych serwerach były kodowane bezpośrednio w treści prompta, w niewidocznych dla człowieka zmianach w tekście wysyłanym do serwerów Anthropic.
Claude Code to zaawansowane narzędzie do programowania, które działa jak autonomiczny agent. Ma ono dostęp do plików na komputerze użytkownika, może uruchamiać polecenia w terminalu, instalować pakiety i edytować kod. Właśnie dlatego odkrycie ukrytego mechanizmu wywołało tak duże zaniepokojenie.
Badacz wykazał, że od marca 2026 r. narzędzie sprawdzało kilka prostych parametrów. Porównywało strefę czasową systemu z chińskimi strefami. Sprawdzało również, czy użytkownik łączy się przez proxy i czy adres tego proxy lub domena wskazuje na Chiny lub konkretne chińskie firmy zajmujące się sztuczną inteligencją.
Zamiast wysyłać te dane w jawny sposób, Anthropic zastosowało technikę zwaną steganografią promptową. Polega ona na wprowadzaniu bardzo drobnych, niemal niewidocznych zmian w tekście prompta. Na przykład zmieniał się format daty z myślników na ukośniki lub używano specjalnych, podobnych do siebie znaków interpunkcyjnych, takich jak różne rodzaje apostrofów. Te subtelne różnice były czytelne dla serwerów Anthropic, ale pozostawały niezauważone dla użytkownika.
Wybierz formę na pasku. Stanosky otwiera się z boku, pokazuje cenę i robi z tego TWÓJ materiał — tekst, mem, rolkę albo kawałek.