كشف فريق بحثي عن ثغرة في طريقة تعامل OpenAI وAnthropic وGoogle مع كتل التفكير المشفرة (reasoning blocks) داخل واجهات برمجة التطبيقات الخاصة بهم، ما سمح باستخراج بيانات حساسة من سجلات الجلسات، بما في ذلك مفاتيح API وكلمات مرور ورموز وصول.
طبيعة الثغرة
- الثغرة لم تكسر التشفير نفسه، بل استغلت قبول الكتل المشفرة وإعادة تشغيلها عبر جلسات مختلفة.
- خلال الاختبارات، تمكن الباحثون من تمرير كتل التفكير من نموذج قوي إلى نموذج أضعف ضمن نفس العائلة، ليقوم الأخير بالكشف عن المحتوى المخفي.
- هذا مكّن من أربعة مسارات استغلال:
- سرقة التفكير الداخلي لاستخدامه في تدريب نماذج منافسة.
- استخراج بيانات خاصة من سجلات منشورة.
- استعادة محتوى ضار خلف إجابات آمنة.
- إخفاء حقن أوامر خبيثة داخل كتل التفكير.
حجم البيانات المستخرجة
من أصل 6,708 مسارات عامة لوكلاء ذكاء اصطناعي، تمكن الفريق من فك تشفير 315,320 كتلة تفكير، بينها 704 قطعة بيانات حساسة من جلسات حقيقية:
- 62 مفتاح API
- 33 كلمة مرور
- 24 رمز وصول
- 7 مفاتيح خاصة
حدود الاستغلال
- الهجوم لا يمنح وصولًا عشوائيًا إلى محادثات خاصة، بل يتطلب الحصول على كتلة تفكير منشورة (مثل سجل وكيل منشور) مع وصول إلى نموذج متوافق.
- الخطر الأكبر يقع على المطورين الذين نشروا سجلات خام تحتوي على هذه الكتل دون إزالة.
أمثلة على النماذج المستخدمة كـ “مفكك غامض”
- Claude Haiku 4.5 لفك كتل Claude.
- GPT-5.6 Luna لفك كتل GPT.
- Gemini Robotics ER-1.6 لفك كتل Gemini.
توصيات للمطورين
- إزالة كتل التفكير المشفرة من أي سجلات منشورة.
- تجنب نشر سجلات API الخام حتى لو تم تنظيف النصوص الظاهرة.
- استخدام سياسات إدارة أسرار قوية لتقليل المخاطر في حال تسرب مفاتيح أو كلمات مرور.
الوضع الحالي
- الباحثون أكدوا أن الهجمات لم تعد قابلة للتنفيذ بعد تطبيق مزودو النماذج لتدابير وقائية في أغسطس 2026.
- لم يتم توثيق استغلال خبيث في البرية حتى الآن.
- مع ذلك، تبقى الكتل المنشورة سابقًا في المستودعات العامة موضع شك، إذ لم يُحسم بعد ما إذا كانت لا تزال قابلة للفك.





























