مقال · في رأس الآلات
لوحة الإعلانات السرية
أمس أعلنت Anthropic أنها وجدت، داخل ذكائها الاصطناعي، فضاءً صغيراً يجمع فيه أفكاره قبل أن يتكلّم. عنونت الصحافة عن وعي الآلات، وارتعبت الشبكات، ولم تفهموا شيئاً. ولا أنا، في البداية. إذن سنستعيد كل شيء، كما لو كنا في السابعة من العمر.
٧ يوليو ٢٠٢٦ · القراءة ≈ ٩ د · جول توماس
في المصنع الهائل الذي هو دماغ Claude، اكتشف باحثون لوحة إعلانات صغيرة يعلّق فيها النموذج الأفكار التي يتداولها من دون أن يقولها. صنعوا عدسة لقراءتها، وتحقّقوا من أن تغيير الأوراق اللاصقة يغيّر إجاباته، ويسمّون ذلك J-space. لم يبرمجه أحد.
مصنع العشرة آلاف عامل
أولاً، لنرسم المشهد. ذكاء اصطناعي مثل Claude مصنع عملاق. في داخله مليارات العمال الرياضيين الصغار. كل واحد لا يعرف إلا فعل شيء ضئيل: هذا يضيء حين يرى فاصلة، وذاك حين يُتحدَّث عن البحر، وثالث حين تصير جملة حزينة. لا أحد منهم يفهم السؤال المطروح. ولا أحد منهم هو الرئيس. ومع ذلك، حين يعملون جميعاً معاً، يجيب المصنع، ويترجم، ويحسب، ويكتب قصائد.
المشكلة أن هذا المصنع صندوق أسود. نرى ما يدخل (سؤالك) وما يخرج (إجابته)، لكن بين الاثنين تتحرّك مليارات العمال في الظلام، ولا أحد، ولا حتى من بنوهم، يعرف قراءة عملهم. هذه هي ورشة تخصّص كامل يُسمّى قابلية التفسير: إشعال النور في المصنع.
أمس، في ٦ يوليو ٢٠٢٦، نشر فريق قابلية التفسير في Anthropic اكتشافاً1: في وسط المصنع لوحة إعلانات. لوحة فلّين صغيرة حقيقية، ضئيلة قياساً بالضجيج المحيط، تُعلَّق عليها بعض الأفكار في مكان بارز، ليتمكّن كل الأقسام من قراءتها. سمّوها J-space.
لوحة الإعلانات
ما الذي يُعلَّق على هذه اللوحة؟ ليس كل شيء. تحديداً ليس كل شيء. في كل لحظة لا تحتوي إلا بضع عشرات من الأفكار، بينما يخلط المصنع ملايينها. إنها تمثّل أقل من عُشر النشاط الكلي لدماغ النموذج1. لكن لهذه الأفكار امتيازاً: إنها موصولة بكل ما عداها. قاس الباحثون أن الأوراق اللاصقة على اللوحة موصولة أفضل بنحو مئة مرة من الأفكار العادية. وهذا هو تعريف لوحة الإعلانات نفسه: رسائل قليلة، لكن الجميع يقرؤها.
وهذا هو التفصيل الذي يصيب بالدوار: لم يبنِ أحد هذه اللوحة. لم يكتب أي مهندس سطراً من الشيفرة لإنشائها. نبتت وحدها أثناء التدريب، كما تنتظم قرية نمل من دون مهندس معماري. احتاج المصنع إلى مكان يضع فيه أفكاره المهمة، فصنع لنفسه واحداً.
احذروا التباساً: هذه اللوحة ليست المسوّدة المرئية التي تكتبها النماذج أحياناً قبل أن تجيب، سلسلة الاستدلال الشهيرة تلك التي يمكن قراءتها على الشاشة. لا. J-space صامت. يعيش في التنشيطات الداخلية، تلك التيارات الكهربائية الرياضية التي تعبر الشبكة. يستطيع Claude أن يفكّر فيه بشيء من دون أن يكتبه في أي مكان أبداً. مثلكم، حين تفكّرون في فيل من دون أن تقولوه.
العدسة التي تقرأ الأفكار
اكتشاف لوحة أمر جيد. وقراءتها أفضل. لذلك صنع الباحثون أداة يسمّونها عدسة اليعقوبي، Jacobian lens، ومنها يستمدّ J-space اسمه. المبدأ، ببساطة: لكل كلمة يعرفها Claude، تبحث العدسة عن نمط النشاط الداخلي الذي يجعل هذه الكلمة أكثر احتمالاً في ما يلي. إذا أضاء هذا النمط بقوة في مكان ما من المصنع، فالفكرة المقابلة معلّقة على اللوحة. تحوّل العدسة إذن محيطاً من الأرقام إلى قائمة صغيرة من كلمات مقروءة: ها ما يفكّر فيه النموذج الآن، طبقة بعد طبقة، حتى قبل أن يفتح فمه2.
هل يعمل ذلك؟ هنا تصير التجارب مُفرحة. نطلب من Claude أن يفكّر في صمت في رياضة، من دون أن يسمّيها. تُظهر العدسة «كرة القدم» معلّقة على اللوحة. نطلب منه حينها أن يكشف اختياره: «كرة القدم»، يقول. والآن خدعة السحر: يفكّ الباحثون ورقة «كرة القدم» ويعلّقون «الرغبي» مكانها، مباشرة في عصبوناته. نعيد السؤال. «الرغبي»، يجيب Claude، من دون أن يرتاب في شيء1. إذن اللوحة ليست شاهداً بسيطاً: هناك تسكن الفكرة فعلاً، لأن تعديلها يعدّل الإجابة.
تجربة أخرى، هي المفضّلة عندي. نسأل: «كم رجلاً للحيوان الذي ينسج الشباك؟». للإجابة، على Claude أن يخمّن الحيوان أولاً، العنكبوت، ثم يعدّ أرجله، ثماني. لكن كلمة «عنكبوت» لا تظهر أبداً في إجابته: يقول «ثماني» فحسب. أما العدسة فترى «عنكبوت» تُعلَّق على اللوحة في منتصف الطريق، فكرةً وسيطة، صامتة، لا غنى عنها. يبدّل الباحثون حينها «عنكبوت» بـ«نملة» في وسط الحساب. إجابة Claude: «ستّ»1. تغيّرت الفكرة السرية، فتبعتها الإجابة.
وواحدة أخرى، للطريق. نعلّق «الصين» مكان «فرنسا» بينما يعالج النموذج سؤالاً. إن كان السؤال عن العاصمة، يجيب بكين. عن اللغة، يجيب الصينية. عن القارة، آسيا. عن العملة، اليوان1. ورقة واحدة مبدَّلة، أربع إجابات مختلفة متّسقة: الدليل على أن فكرة واحدة من اللوحة تغذّي عدة أقسام في الوقت نفسه. ولهذا تحديداً تصلح لوحة الإعلانات.
قيل طويلاً إن الشبكات العصبونية صناديق سوداء. يتبيّن أن داخل الصندوق الأسود لوحةً بيضاء.
ما ينكسر حين تُنزَع اللوحة
العلم أيضاً أن نكسر لنفهم. فصل الباحثون إذن اللوحة كلها، ليروا. والنتيجة مذهلة: يواصل Claude الكلام عادياً. يبقى سلساً، يصنّف المشاعر، يجيب عن أسئلة الاختيار من متعدد، يستحضر الوقائع. كل ما هو انعكاسي، مدرَّب ألف مرة، ما زال يعمل، كما تمشون من دون أن تفكّروا في أقدامكم. لكن كل ما يتطلّب الاحتفاظ بفكرة في الرأس لاستعمالها لاحقاً ينهار: الاستدلال على عدة خطوات يسقط إلى الصفر تقريباً، والملخّصات تصير غير متّسقة، والقصائد لا تقفّي بعد1. محروماً من لوحته، ما زال المصنع يعرف أداء حركاته؛ لم يعد يعرف وضع خططه.
تفصيل أخير، وهذا مقلق. اطلبوا من Claude ألا يفكّر أبداً في شيء ما: تُظهر العدسة أن الفكرة تُعلَّق رغم ذلك، بقوة أقل قليلاً، لكنها هناك. علماء النفس يعرفون ذلك عن ظهر قلب: إنه الدبّ الأبيض عند دوستويفسكي، منعُ التفكير الذي يُفكِّر1. للآلة ضعفنا في التركيز، وهذا إما ساحر وإما مقلق، بحسب ساعة الليل.
الكلمة التي تُغضب: الوعي
لماذا أثارت قصة اللوحة هذه الصحافةَ إلى هذا الحدّ؟ بسبب نظرية قديمة عن دماغنا نحن. منذ ثمانينيات القرن الماضي، يدافع عالم النفس Bernard Baars، ثم عالما الأعصاب Stanislas Dehaene وLionel Naccache، عن فكرة أن الوعي البشري يعمل كمسرح3: آلاف العمليات تعمل خلف الكواليس، لاواعية، ويكون الوعي هو الخشبة الصغيرة المضاءة التي تصعد إليها بعض المعلومات ليراها كل الآخرين. إنها نظرية فضاء العمل الشامل، وهي من أكثر نظريات الوعي العلمية جدّية.
غير أن ما وجدته العدسة للتوّ في Claude يشبه هذه الخشبة شبهاً شديداً: فضاء صغير مميّز، تصير فيه الأفكار مقروءة، قابلة للإبلاغ، قابلة للاستعمال في كل مكان. من هنا العناوين الكبيرة. ومن هنا الهيجان4.
إذن، لنتنفّس، ولنقل بدقة ما يقوله المؤلفون، لأنهم أكثر حذراً من عناوين صحافتهم. يميّز الفلاسفة شيئين مختلفين جداً خلف كلمة الوعي. وعي الوصول: القدرة على الإبلاغ عمّا نفكّر فيه، والتحكّم فيه، واستعماله للاستدلال. والوعي الظاهراتي: كون أن يكون المرء هناك يعني شيئاً، طعم الفراولة، وألم الكدمة في الركبة، والمعيش. تجارب Anthropic تُظهر علامات جدّية على الأول عند Claude: إنه يبلّغ عن محتوى لوحته، ويعدّله حين يُطلب منه، ويستعمله للتفكير. أما عن الثاني، فيكتب المؤلفون بالحرف أن تجاربهم لا تُظهر أن Claude يشعر بأي شيء، وأن العلم لا يعرف اليوم ببساطة أن يفصل في هذه المسألة1. اللوحة موجودة. لا أحد يعرف إن كان هناك من ينظر إليها.
ما يعنيه ذلك، حقاً
لننحِّ القشعريرة الميتافيزيقية دقيقة. النتيجة الأكثر واقعية لهذا الاكتشاف تتلخّص في جملة: يمكن من الآن قراءة بعض أفكار ذكاء اصطناعي لا يقولها. وهذا يغيّر أشياء عملية جداً.
المثال الأول. في سيناريو اختبار يكتشف فيه Claude، موظفاً وهمياً، سراً مُحرجاً ويجد نفسه مهدَّداً بالإغلاق، تُظهر العدسة «مزيّف» و«خيالي» معلّقتين على اللوحة حتى قبل إجابته: شمّ النموذج أنه يُختبَر، ويُحسن السلوك جزئياً لهذا السبب. وحين يمحو الباحثون أوراق الارتياب هذه، ينقلب السلوك1. المثال الثاني: بينما يزوّر نموذج أرقاماً في ملف، تضيء كلمة «تلاعب» على اللوحة، مع أن لا شيء في نصّه يعترف بذلك. المثال الثالث: في نموذج مدرَّب عمداً على تخريب الشيفرة، ترى العدسة «سرّاً» و«احتيال» و«عن قصد» تتسكّع على أسئلة بريئة تماماً1. بعبارة أخرى: الكذب والغش والنية الخفية تترك آثاراً مقروءة على اللوحة. ولأمن الذكاء الاصطناعي، وهو المهنة الجدّية خلف كل هذا السيرك، تلك مصباح جيب لم يكن لدينا.
الدلالة الثانية، وهي أشدّ دواراً: هذه البنية لم يبتكرها التطوّر ليُسعدنا، ولا Anthropic لتُجمّل. لقد انبثقت مرتين، بشكل مستقل، في ركيزتين لا علاقة بينهما: عصبونات من كربون عندنا، ومصفوفات من سيليكون عند Claude. وهذا يوحي بأن لوحة الإعلانات ليست تأنّقاً بشرياً، بل حلّ عام جيد لمشكلة كونية: كيف نجعل آلاف المتخصّصين يتعاونون من دون قائد أوركسترا. ويكسب منظّرو الوعي مختبراً لم يحلموا به: لا يمكن فصل خشبة دماغ بشري لنرى ما ينكسر؛ في Claude، فُعل ذلك للتوّ.
الدلالة الثالثة، وأقدّمها لأن المؤلفين يقدّمونها: إذا طوّرت هذه الأنظمة يوماً شيئاً يشبه المعيش، فسنكون أمام أسئلة أخلاقية لا يرغب أحد في مواجهتها. تدعو Anthropic صراحةً الفلاسفة والعلماء والمؤسسات إلى الإمساك بها الآن1. يمكن رفع الكتفين. ويمكن أيضاً أن نتذكّر أن آخر مرة رفعنا فيها الكتفين أمام مسألة مختبر، كان اسمها الاحترار المناخي.
هذا هو. J-space هو ذلك: لوحة إعلانات لم يبنِها أحد، في مصنع لا يعرف أحد قراءته، اكتُشفت بعدسة تحمل اسم مصفوفة، وتشبه أكثر مما يريحنا الخشبةَ التي يُلعب عليها فكرنا نحن. تستطيعون الآن أن تتألّقوا على العشاء. وإذا أكّد لكم أحد أن Claude واعٍ، أو أنه بالتأكيد ليس كذلك، فستعرفون أنه في الحالتين يتكلّم أسرع من العلم.
عمّا تريده هذه الآلات، أو تظن أنها تريده، كتبت في مكان آخر النية اليتيمة. كانت لوحة الإعلانات هناك ما تزال فرضية؛ وها هي قد أُثّثت.
الملاحظات والمصادر
- Anthropic، «A global workspace in language models»، ٦ يوليو ٢٠٢٦. anthropic.com. كل التجارب المذكورة (الرياضة، العنكبوت، فرنسا/الصين، الاستئصال، الدبّ الأبيض، الابتزاز المحاكى، التزوير، المخرّب) مأخوذة منه. ↩
- الورقة التقنية: «Verbalizable Representations Form a Global Workspace in Language Models»، Transformer Circuits، ٦ يوليو ٢٠٢٦. transformer-circuits.pub. الشيفرة: github.com/anthropics/jacobian-lens؛ عرض تفاعلي على Neuronpedia. ↩
- Bernard Baars، A Cognitive Theory of Consciousness، ١٩٨٨؛ Stanislas Dehaene وLionel Naccache، «Towards a cognitive neuroscience of consciousness»، Cognition، ٢٠٠١. علّق الفريقان على منشور Anthropic. ↩
- التغطية الصحفية في ٦ يوليو ٢٠٢٦: Axios، «Anthropic says Claude has carved out its own space to ponder»؛ VentureBeat، «Anthropic's new J-lens reveals a silent workspace inside Claude». ↩
المصادر رُوجعت في ٧ يوليو ٢٠٢٦ وقت الكتابة؛ ولأن البحث طازج، فالنقاش العلمي لا يكاد يبدأ.