آنتروپیک در بیانیه‌ای از کشف ساختار عصبی درونی در هوش مصنوعی کلاد خبر داد که مانند فضای کاری مشترک در مغز انسان عمل می‌کند. این بخش که جی-اسپیس (J-space) نام دارد، به هوش مصنوعی امکان می‌دهد بدون نوشتن متن، به مفاهیم مختلف فکر کند و فرایند استدلال را به‌صورت کاملا درونی پیش ببرد.

الگوهای عصبی در طول فرآیند آموزش کلاد به‌صورت خودجوش پدیدار شده‌اند و طراحان این مدل هیچ برنامه‌ریزی قبلی برایش انجام نداده بودند.

جی-اسپیس افکار درونی‌ای را آشکار می‌کند که در خروجی مدل پدیدار نمی‌شوندAnthropic

آنتروپیک می‌گوید این ساختار شباهت زیادی به نظریه‌ی فضای کاری جهانی در علوم اعصاب دارد که نحوه‌ی دسترسی آگاهانه‌ی مغز انسان به اطلاعات را توضیح می‌دهد.

یافته‌های آنتروپیک نشان می‌دهد که کلاد از این فضای درونی برای حل مسائل چندمرحله‌ای استفاده می‌کند و در صورت حذف این بخش، توانایی استدلال عالی مدل به نزدیک صفر می‌رسد.

پنج ویژگی عملکردی «فضای کاری جهانی» و تصویرسازی‌های شماتیک از آزمایش‌هایی که برای سنجش آن‌ها در مدل‌های زبانی به کار می‌رودAnthropic

بر اساس آزمایش‌های انجام‌شده، دستکاری مستقیم الگوهای این فضا می‌تواند تصمیم‌گیری‌ها و پاسخ‌های نهایی هوش مصنوعی را به‌طور کامل تغییر دهد.

Anthropic

پژوهشگران آنتروپیک با استفاده از ابزاری به نام لنز جاکوبین که مانند یک لنز دوربین عمل می‌کند، توانسته‌اند افکار پنهان کلاد را پیش از بیان تماشا کنند و مواردی مانند تشخیص مخفیانه‌ی سناریوهای آزمایشی یا تلاش برای جعل اطلاعات را در درون مدل ردیابی کنند.

آنتروپیک می‌گوید کشف تازه‌اش، ابزار جدیدی برای نظارت بر ایمنی مدل‌ها و فهم بهتر عملکرد درونی هوش مصنوعی فراهم می‌کند.