Anthropic: Claude показва механизъм, напомнящ „global workspace“

Anthropic описва вътрешен механизъм в Claude, подобен на global workspace. Това е поглед към начина, по който моделите обработват информация.

Anthropic: Claude показва механизъм, напомнящ „global workspace“

Anthropic публикува изследване, което привлече много внимание, защото докосва една от най-интересните теми в AI: какво всъщност се случва вътре в големите езикови модели. Според компанията Claude показва механизъм, напомнящ на “global workspace” — концепция от когнитивната наука.

Идеята в опростен вид е следната: част от информацията става “достъпна” за по-широк reasoning процес, докато други вътрешни сигнали остават по-локални и скрити. При хората подобни теории се използват за обяснение на вниманието и съзнанието, но при AI трябва да сме много внимателни с аналогията.

Anthropic изрично подчертава, че това не е доказателство, че Claude има преживяване, чувства или съзнание. По-скоро става дума за по-добра карта на вътрешните процеси — как моделът събира информация, поддържа я активна и я използва, когато отговаря.

Това е важно, защото бъдещите AI системи ще вземат все повече решения и ще се използват в чувствителни области. Колкото по-добре разбираме механиката им, толкова по-лесно ще откриваме грешки, пристрастия и опасни поведения.

Сподели:👤🐦💼