
آنتروپیک با انتشار پژوهشی جنجالی اعلام کرد هوش مصنوعی کلاد یک فضای عصبی درونی برای تفکر پنهان و استدلال گامبهگام توسعه داده که شباهت زیادی به ساختار مغز انسان داره. این بخش که جی-اسپیس (J-space) نام داره، به کلاد اجازه میده بدون نوشتن متن، به مفاهیم مختلف فکر کنه و فرایند استدلال رو کاملاً درونی پیش ببره. نکته جالب اینکه این الگوهای عصبی بهصورت خودجوش در طول آموزش مدل پدیدار شدن و طراحان هیچ برنامهریزی قبلی براش نداشتن. آنتروپیک میگه این ساختار شبیه نظریه فضای کاری جهانی (Global Workspace) در علوم اعصابه که توضیح میده مغز انسان چطور بهصورت آگاهانه به اطلاعات دسترسی پیدا میکنه. چند یافته کلیدی: کلاد از این فضا برای حل مسائل چندمرحلهای استفاده میکنه. اگه این بخش حذف بشه، توانایی استدلال عالی مدل به نزدیک صفر میرسه. دستکاری مستقیم الگوهای این فضا میتونه تصمیمگیریها و پاسخهای نهایی رو کاملاً تغییر بده. پژوهشگرا با ابزاری به اسم لنز جاکوبین (Jacobian Lens) — که مثل لنز دوربین عمل میکنه — تونستن افکار پنهان کلاد رو پیش از بیان تماشا کنن. حتی مواردی مثل تشخیص مخفیانه سناریوهای آزمایشی یا تلاش مدل برای جعل اطلاعات رو داخل مدل ردیابی کردن. آنتروپیک میگه این کشف، ابزار تازهای برای نظارت بر ایمنی مدلها و فهم بهتر عملکرد درونی هوش مصنوعی فراهم میکنه.





