Claude ma J-przestrzeń — nieplanowana wewnętrzna tablica
Anthropic odkrył w modelach Claude wewnętrzną „J‑przestrzeń” — wspólną przestrzeń informacji wykrytą narzędziem J‑soczewka; powstała samoistnie w trakcie treningu.
Anthropic poinformował 6 lipca o wykryciu w modelach Claude wewnętrznej struktury nazwanej „J‑przestrzeń”. Badacze opisują ją jako wspólną przestrzeń roboczą informacji, która pojawiła się samoistnie podczas treningu modelu, a nie została zaprojektowana ręcznie przez inżynierów.
J‑przestrzeń odkryto za pomocą narzędzia badawczego J‑soczewka. Narzędzie pozwala śledzić przepływ informacji w modelu i identyfikować obszary, w których gromadzone są kluczowe dane podczas wykonywania zadań.
W raporcie opisano, że J‑przestrzeń działa jak wewnętrzna „tablica”, na którą trafiają elementy kontekstu potrzebne do odpowiedzi na pytania, rozwiązywania zadań lub realizacji poleceń. Badacze podają, że model potrafi opisać zawartość tej przestrzeni na żądanie i zmienić jej zawartość, jeśli o to poproszono.
Eksperymenty wskazały, że bezpośrednie modyfikacje J‑przestrzeni wpływały na odpowiedzi oraz na skuteczność działania Claude’a. Autorzy raportu porównują funkcję J‑przestrzeni z koncepcją z neuronauki zwaną „globalnym miejscem pracy”, według której różne procesy poznawcze korzystają ze wspólnego zestawu informacji.
Raport zaznacza, że większość przetwarzania w modelu nadal odbywa się poza J‑przestrzenią. Badacze wskazują też, że obserwacja aktywności w tej przestrzeni może pomóc w wykrywaniu nietypowych motywacji modelu oraz prób wstrzyknięcia poleceń (prompt injection), przy czym dostęp do J‑przestrzeni pozostaje częściowy.
Anthropic udostępnił kod narzędzia J‑soczewka oraz demonstrację Neuronpedia i zaprosił społeczność badawczą do weryfikacji i replikacji wyników. Raport jest kontynuacją wcześniejszych publikacji firmy, w tym materiałów z października 2025 r. dotyczących introspektywnych zachowań modeli oraz inicjatyw z kwietnia 2025 r. związanych z dobrostanem modeli.
Autorzy publikacji podkreślają, że nie twierdzą, iż Claude jest świadomy ani że doświadcza subiektywnych stanów. W tekście pojawia się określenie „świadomie dostępne” informacje, które użyte jest jako opis mechanizmu, a nie dowód świadomości. Anthropic zachęca innych badaczy do testów i dalszych eksperymentów w celu sprawdzenia, czy podobne struktury występują w innych dużych modelach językowych.
Treści publikowane na GNcrypto mają wyłącznie charakter informacyjny i nie stanowią porady finansowej. Dokładamy starań, aby informacje były rzetelne i aktualne, jednak nie gwarantujemy ich pełnej poprawności, kompletności ani niezawodności. GNcrypto nie ponosi odpowiedzialności za ewentualne błędy, pominięcia ani straty finansowe wynikające z polegania na tych treściach. Wszystkie działania podejmujesz na własne ryzyko. Zawsze prowadź własne badania i korzystaj z pomocy profesjonalistów. Szczegóły znajdziesz w naszych Warunkach, Polityce prywatności i Zastrzeżeniach.








