مشكلة حسابات هيدرا: لماذا يبدأ الدفاع عن التقطير بتحديد الهوية (AR)
ذكرت Anthropic 16 مليون عملية تبادل عبر حوالي 24,000 حساب احتيالي، وشبكة وكيلة واحدة تدير أكثر من 20,000 حساب في وقت واحد. التقطير ليس مشكلة موجه، بل مشكلة وصول.

في 23 فبراير 2026، نشرت Anthropic أرقامًا مقاسة حول شيء كانت صناعة الذكاء الاصطناعي تناقشه حتى ذلك الحين بشكل مجرد. في حملات التقطير المحددة، أفادت الشركة أن المختبرات "أجرت أكثر من 16 مليون عملية تبادل مع Claude عبر ما يقرب من 24,000 حساب احتيالي". تفصيلة واحدة في هذا التقرير تعيد صياغة المشكلة بأكملها: "شبكة وكيلة واحدة أدارت أكثر من 20,000 حساب احتيالي في وقت واحد".
عشرون ألف حساب. فاعل واحد.
هذا هو شكل التهديد. التقطير العدائي — استخدام مخرجات نموذج رائد لتدريب نسخة أرخص منه — لا يتم تنفيذه بواسطة حساب واحد مشبوه يقوم بطلب واحد مشبوه. بل يتم تنفيذه بواسطة منظمة تنشر حملة استخراج واحدة عبر آلاف الحسابات وأدوات الدفع والأجهزة ومسارات الشبكة، بحيث يبدو كل حساب فردي غير ملحوظ. عند مراجعتها واحدة تلو الأخرى، لا يثير أي منها أي شيء. عند مراجعتها كبيان رسومي، هي آلة واحدة.
هذا هو السبب في أن الدفاع لا يمكن أن يقتصر على النموذج أو على حركة المرور فقط. بل يجب أن يجيب أيضًا على سؤال لا تستطيع تلك الطبقات الإجابة عليه: من يقف وراء هذه الحسابات حقًا؟
النقاط الرئيسية
- أفادت Anthropic عن أكثر من 16 مليون عملية تبادل تم إنشاؤها عبر ما يقرب من 24,000 حساب احتيالي في حملات التقطير المحددة، مع شبكة وكيلة واحدة تدير أكثر من 20,000 حساب في وقت واحد.
- التقطير هو مشكلة وصول منسق، وليس مشكلة طلب واحد. المراجعة لكل حساب لا ترى ذلك هيكليًا.
- يحدد موجز العدد الصادر عن منتدى النماذج الرائدة في فبراير 2026 التقطير العدائي وأساليبه. تم تحديد نطاقه للتهديد وليس للضوابط، لذا فإنه لا يقدم أي توصية بشأن التحقق من الحساب، الهوية، تحديد المعدل، أو التحكم في الوصول.
- تشمل إجراءات التخفيف المدرجة من قبل Anthropic "التحقق المعزز للحسابات التعليمية والناشئة" جنبًا إلى جنب مع مصنفات الكشف وبصمات السلوك.
- تقوم طبقة الوصول المتحقق منه بثلاثة أشياء لا تستطيع ضوابط النموذج القيام بها: إنها تقلل من إخفاء الهوية، وتربط الحسابات التي تشترك في شخص، جهاز، أو شبكة، وتجعل الحساب المعاد إنشاؤه يموت عند الوصول.
- التحقق من الهوية وحده لا يمنع استخراج النموذج. إنه طبقة واحدة من ثلاث، ولا يحل محل الطبقتين الأخريين.
ماذا حدث بالفعل
تقرير Anthropic يستحق القراءة بالكامل، ولكن هناك ثلاث نتائج تهم أكثر أي شخص يصمم ضوابط الوصول.
تركز الحجم في عدد قليل من الفاعلين. نسبت Anthropic "أكثر من 13 مليون" عملية تبادل إلى MiniMax، و"أكثر من 3.4 مليون" إلى Moonshot AI، و"أكثر من 150,000" إلى DeepSeek. هذه ليست عمليات استخراج انتهازية. إنها برامج صناعية مستمرة.
كانت الحسابات منسقة، وكان التنسيق مرئيًا في البيانات الوصفية. وصفت Anthropic "أنماطًا متطابقة، طرق دفع مشتركة، وتوقيتًا منسقًا" مما "أشار إلى 'موازنة الحمل'" عبر الحسابات. جاء الإسناد من "بيانات طلب وصفية ومؤشرات البنية التحتية" — في إحدى الحالات، بيانات طلب وصفية "تطابقت مع الملفات الشخصية العامة لكبار موظفي Moonshot".
تكررت الموجهات بمقياس سخيف. لاحظت Anthropic اختلافات في الموجهات تصل "عشرات الآلاف من المرات عبر مئات الحسابات المنسقة".
اقرأ هذه الثلاثة معًا ويظهر نمط. كل إشارة كشفت عن هذه الحملات تقريبًا كانت إشارة علاقية — شيء مشترك بين الحسابات. طرق دفع مشتركة. توقيت مشترك. بنية تحتية مشتركة. قوالب موجهات مشتركة. لا يوجد أي منها مرئي إذا كانت وحدة التحليل الخاصة بك هي حساب واحد.
لماذا تفشل المراجعة لكل حساب
تم تصميم معظم أدوات مكافحة إساءة الاستخدام حول حكم لكل حساب. يسجل الحساب، ويتم تقييمه، ويحصل على نطاق مخاطر، ويحصل على قرار. يعمل هذا النموذج جيدًا لإساءة الاستخدام التي صمم من أجلها — محتال يستخدم بطاقة مسروقة، مرسل بريد عشوائي يرسل إلى قناة.
يفشل ضد التقطير لسبب هيكلي محدد: يتحكم المهاجم في مقدار الحملة التي يحملها أي حساب واحد.
إذا كان حد المراجعة الخاص بك هو "حساب يقوم بـ 50,000 طلب غير عادي"، فإن المهاجم يستخدم 20,000 حساب يقوم كل منها بـ 800 طلب. إذا انخفض حدك، يضيفون حسابات. الاقتصاد يفضلهم لأن الحسابات هي أرخص مدخل في النظام. مكالمة واجهة برمجة تطبيقات نموذج رائد لها تكلفة هامشية حقيقية؛ عنوان البريد الإلكتروني ليس كذلك.
لذا فإن مشكلة تحسين المهاجم بسيطة: حافظ على سلوك كل حساب تحت أي عتبة لكل حساب، وقم بالتوسع أفقيًا. وهذا يعمل، لأن الدفاع يقيس الكائن الخطأ. إنه يقيس الحسابات عندما يكون الخصم فاعلًا.
هذه هي خاصية هيدرا. اقطع رأس حساب واحد فيظهر اثنان آخران، لأن الشيء الذي يولد الحسابات لم يتم لمسه أبدًا. شبكة وكيلة تدير أكثر من 20,000 حساب في وقت واحد، كما أفادت Anthropic، هي التعبير النقي عن ذلك — بهذا الحجم، إزالة الحسابات واحدًا تلو الآخر ليست دفاعًا، بل هي مهمة صيانة.
لهزيمة هيدرا، يجب أن تتوقف عن قطع الرؤوس وتبدأ في العثور على الجسد.
الطبقات الثلاث للدفاع عن التقطير
الدفاع الجاد له ثلاث طبقات، ويتم امتلاكها بشكل مختلف.
| الطبقة | المالك | الدور |
|---|---|---|
| ضوابط النموذج | مزود النموذج | تحديد آثار التفكير الحساسة، تشكيل المخرجات، حماية سلوك النموذج |
| كشف حركة المرور | مزود النموذج، أو مكدس بحث/بائع | كشف أنماط الاستخراج المتكررة، المركزة دلاليًا، أو المنسقة |
| الوصول المتحقق منه | البنية التحتية للهوية | تحديد من يقف وراء الحساب، ربط المعرفات المشتركة، فرض السياسة عبر كل ما هو متصل بمسيء مؤكد |
الطبقتان الأوليان مفهومتان جيدًا ويتم البحث فيهما بنشاط. على جانب حركة المرور، العمل الأكاديمي الأخير مشجع حقًا: ليو، قوه، ودونغ (arXiv 2606.05725، يونيو 2026) يؤطرون مراقبة الاستخراج كاختبار توزيع نافذة حركة المرور المعاير بشكل حميد، باستخدام الحد الأقصى لتباين المتوسط في الفضاء الدلالي المعاير فقط على حركة المرور الحميدة. عبر أربعة عشر زوجًا من الاستعلامات العادية للمهاجم من أربع سيناريوهات استخراج، أبلغوا عن معدل كشف بنسبة 100% لحالات المهاجم الخالص بمعدل خطأ إيجابي كاذب بنسبة 0.3% على الاستعلامات الحميدة.
هذه نتيجة قوية، ومن المهم أن نكون واضحين بشأن ما تعنيه: يعمل كشف حركة المرور، وليست الطبقة التي تتحدث عنها Didit. التحليل الدلالي لتوزيعات الموجهات هو وظيفة مزود النموذج، ويجب أن يبقى هناك.
الطبقة الثالثة هي الطبقة التي تحتوي على أقل إرشادات تصميم منشورة — بما في ذلك في الموجز القانوني الخاص بالصناعة حول التهديد.
ما يغطيه الموجز القانوني
نشر منتدى النماذج الرائدة موجزه حول التقطير العدائي في نفس اليوم الذي صدر فيه تقرير Anthropic. إنها وثيقة جيدة. تعرف التقطير العدائي على أنه الوصول السري إلى مخرجات النموذج — عادةً بانتهاك شروط الخدمة — لتدريب نموذج ثانوي يكرر قدرات المعلم مع تجاوز تدريب السلامة الخاص به. وهي تسرد الأساليب: استخراج تسلسل التفكير، نقد تسلسل التفكير، تصنيف تسلسل التفكير تلقائيًا، توليد الموجهات للتعلم المعزز، وتوليد البيانات الاصطناعية. وتسمي القدرات المستهدفة: التفكير الرياضي والعلمي، الترميز الوكيل، المعالجة متعددة الوسائط، التفكير العام.
كما تعترف بالتوتر الحقيقي في هذا المجال — "معالجة هذه المخاوف الأمنية دون إعاقة البحث المشروع".
ما لا تحتويه هو أي توصية بشأن التحقق من الحساب، تحديد الهوية، تحديد المعدل، أو التحكم في الوصول.
هذا اختيار للنطاق، واختيار معقول: يهدف الموجز إلى تحديد التهديد وأساليبه، وليس وصف الضوابط. تصميم طبقة الوصول هو ببساطة وثيقة مختلفة.
إنها وثيقة لم تكتبها الصناعة بعد — على الرغم من أن المختبر الذي قاس التهديد أدرج "التحقق المعزز للحسابات التعليمية والناشئة" ضمن إجراءات التخفيف التي يستثمر فيها، جنبًا إلى جنب مع مصنفات الكشف وبصمات السلوك. تقوم طبقة الوصول بعمل حقيقي في الممارسة العملية ولديها القليل جدًا من إرشادات التصميم المنشورة وراءها. هذا ما يدور حوله بقية هذا المنشور.
ما تفعله طبقة الوصول المتحقق منه بالفعل
كن دقيقًا بشأن الادعاء هنا، لأن المبالغة في الادعاء هي كيف تفقد هذه الفئة بأكملها مصداقيتها.
لا يكتشف التحقق من الهوية التقطير. لا يمكنه رؤية دلالات الموجهات، ولا يعرف القدرة المستهدفة، ولن يخبرك أبدًا أن تدفق الطلبات يبدو وكأنه استخراج تسلسل التفكير. هذه هي وظيفة طبقة حركة المرور.
ما تفعله الهوية هو تغيير هيكل تكلفة المهاجم بأربع طرق محددة.
يقلل من إخفاء الهوية. الحساب المرتبط بشخص متحقق منه أو شركة مسجلة هو حساب له مالك يمكن إسناده إليه. هذا لا يوقف إساءة الاستخدام، ولكنه يغير تكلفة إساءة الاستخدام ومخاطرها.
يربط الحسابات التي تشترك في شيء مادي. الحسابان المسجلان بنفس الوجه، أو نفس الجهاز، أو نفس الشبكة مرتبطان سواء كان سلوكهما يبدو مرتبطًا أم لا. هذه هي الإشارة التي لا يمكن أن تنتجها مراجعة كل حساب، وهي بالضبط فئة الإشارة — طريقة الدفع المشتركة، التوقيت المشترك، البنية التحتية المشتركة — التي كشفت الحملات التي وصفتها Anthropic.
يجعل إعادة الإنشاء مكلفة. تعتمد خاصية هيدرا على أن الحسابات الجديدة رخيصة وغير مرتبطة بالحسابات القديمة. عندما تنتشر حالة إساءة استخدام مؤكدة إلى كل معرف لمسته — الوجه، الوثيقة، الهاتف، البريد الإلكتروني، IP، والجهاز — يفشل الحساب التالي الذي تم إنشاؤه من نفس البنية التحتية عند الباب بدلاً من أن يتم اكتشافه بعد 800 طلب.
يحافظ على الاحتكاك بعيدًا عن المطورين الشرعيين. هذا هو القيد الذي يجعل الأمر برمته قابلاً للتطبيق. التحقق المطبق على الجميع هو ضريبة نمو. التحقق المطبق بشكل تكيفي — حسب مستوى الوصول، الحصة، حجم الائتمان، الجغرافيا، أو تنبيه سلوكي من طبقة حركة المرور — يضع الاحتكاك على المخاطر ويترك مسار المطور الموثوق به سريعًا.
أربعة أشياء. لا شيء منها هو "يمنع الاستخراج". كل الأربعة حقيقية.
أين تتناسب Didit
Didit هي بنية تحتية للهوية والاحتيال، والأساسيات التي تتكون منها طبقة الوصول المتحقق منه هي تلك التي نشحنها بالفعل وننشر أسعارها:
- التحقق من الهوية — وثيقة الهوية، حيوية سلبية، مطابقة الوجه وتحليل IP، مجمعة بسعر 0.33 دولار لكل تحقق، مع 500 تحقق مجاني من KYC شهريًا.
- البحث عن الوجه 1:N — البحث البيومتري عبر المستخدمين المتحقق منهم الذين سجلتهم تطبيقاتك الخاصة، مجاني مع التحقق. هذا هو الأساس الذي يربط حسابين بشخص واحد.
- تحليل IP والجهاز — 0.03 دولار، ومضمن في حزمة 0.33 دولار. يصدر
DUPLICATED_IP_ADDRESS،DUPLICATED_DEVICE_FINGERPRINT،DEVICE_RECOVERED_HIGH_CONFIDENCE،AUTOMATION_FRAMEWORK_DETECTEDوالرموز ذات الصلة. - واجهة برمجة تطبيقات القوائم — قوائم الحظر عبر 12 نوعًا من الإدخالات، حيث يؤدي الحظر من جلسة مؤكدة واحدة إلى استخراج المعرفات التي التقطتها تلك الجلسة تلقائيًا — الوجه، الوثيقة، الهاتف، البريد الإلكتروني، IP والجهاز.
- المصادقة البيومترية — 0.10 دولار لإعادة التحقق بدون كلمة مرور، لربط إجراء مميز بالشخص الذي قام بالتسجيل بدلاً من رمز حامل.
- التحقق من الأعمال — من 2.00 دولار لكل شركة: البحث في السجل، الملاك المستفيدون النهائيون والمسؤولون، مع فحص الكيان بسعر 0.20 دولار وأي فحص هوية مرتبط لمالك مستفيد يتم تحصيله بأسعار التحقق من المستخدم القياسية. للوصول على مستوى المنظمة والبحث.
يمكنك دمج هذه في أي سياسة تحتاجها منصتك. التكوين هو هيكلك؛ الأساسيات هي الأجزاء. يتم تسليم كل منها عبر واجهة برمجة التطبيقات الموحدة /v3/ بسعر منشور وبدون حد أدنى — بعضها كنقطة نهاية خاصة بها، مثل POST /v3/face-search/، وبعضها من خلال سير عمل جلسة، مثل المصادقة البيومترية، التي لا تحتوي على نقطة نهاية مستقلة خاصة بها.
حالات الاستخدام
موفرو النماذج الرائدة. اربط الوصول عالي الحصة، عالي الائتمان، والبحثي بشخص أو شركة متحقق منها، مع ترك المستويات المجانية ومنخفضة الحجم خالية من الاحتكاك.
منصات واجهة برمجة تطبيقات الذكاء الاصطناعي وموفرو الاستدلال. يرث البائعون والمجمّعون إساءة الاستخدام دون وراثة مكدس الكشف. غالبًا ما تكون طبقة الوصول هي التحكم الوحيد الذي يمتلكونه واقعيًا.
منتجات الترميز والوكيل بالذكاء الاصطناعي. تستخدم إساءة استخدام التجربة وزراعة الائتمان نفس آليات مضاعفة الحسابات مثل التقطير. تعالج نفس الأساسيات الربط بينهما.
منصات وأسواق الذكاء الاصطناعي السحابية. التحقق على مستوى المنظمة يجيب على سؤال "هل هذه شركة حقيقية لها مالكون مستفيدون حقيقيون" قبل منح حصة المؤسسة.
الأسئلة المتكررة
هل يمنع التحقق من الهوية تقطير النموذج؟
لا. يتم منع الاستخراج — بالقدر الذي يمكن أن يتم به — بواسطة ضوابط مخرجات على مستوى النموذج وبواسطة الكشف الدلالي لحركة المرور. تقلل الهوية من إخفاء الهوية، وتربط الحسابات عبر حملة، وتجعل الحسابات المعاد إنشاؤها تفشل مبكرًا. إنها طبقة واحدة من ثلاث.
ألن يؤدي التحقق إلى إبعاد المطورين الشرعيين؟
فقط إذا طبقته على الجميع. التصميم الذي يعمل هو تكيفي: تحقق من المخاطر، المستوى، الحصة، حجم الائتمان، الجغرافيا، أو تنبيه سلوكي. يجب ألا يرى معظم المطورين خطوة التحقق أبدًا. خدمة Reusable KYC من Didit مجانية، لذا يمكن للمطور الذي تم التحقق منه بالفعل في مكان آخر على الشبكة اجتياز الفحص دون إعادته.
هل يمكن لـ Didit أن تخبرني أن تدفق الطلبات يبدو وكأنه تقطير؟
لا. لا ترى Didit موجهاتك ولا تحلل دلالات الطلبات. تأتي هذه الإشارة من طبقة حركة المرور الخاصة بك. ما توفره Didit هو تحديد الهوية لربط هذا التنبيه بفاعل، وأساسيات التنفيذ للعمل عبر كل حساب متصل بهم.
كم يكلف هذا على نطاق منصة الذكاء الاصطناعي؟
يتم تسعير التحقق لكل فحص ناجح بدون حدود دنيا: 0.33 دولار للحزمة الكاملة للهوية، 0.03 دولار لتحليل IP والجهاز وحده، مجاني للبحث عن الوجه 1:N، 0.10 دولار لإعادة المصادقة البيومترية، ومن 2.00 دولار للتحقق من الأعمال. نظرًا لأن السياسة تكيفية، فإنك تدفع مقابل جزء الوصول الذي يستدعي التحقق بالفعل. أول 500 تحقق من KYC كل شهر مجاني.
لدينا بالفعل بائع احتيال. لماذا هذا مختلف؟
تعيد معظم أدوات الاحتيال حكمًا لكل حساب. مشكلة التقطير هي مشكلة لكل فاعل، والأساسيات التي تربط الحسابات بفاعل واحد — البحث البيومتري 1:N عبر مستخدميك، الارتباط بين الجهاز و IP، وانتشار قائمة الحظر عبر كل معرف من حالة مؤكدة واحدة — هي الأشياء المحددة التي لا يقوم بها تسجيل النقاط لكل حساب.
هل أنت مستعد للبدء؟
ابدأ بالأساس الذي ينتج إشارة الربط التي تفتقدها اليوم.
- اقرأ الوثائق — البحث عن الوجه 1:N، تحذيرات تحليل IP والجهاز، وواجهة برمجة تطبيقات القوائم.
- شاهد المنتج — التحقق من المستخدم والتحقق من الأعمال.
- تحقق من الأسعار — كل وحدة مسعرة علنًا، الدفع لكل نجاح، بدون حدود دنيا.
- ابدأ مجانًا — أنشئ حسابًا على business.didit.me وقم بإجراء أول 500 تحقق من KYC شهريًا بدون تكلفة.
مقالات ذات صلة
- مشكلة حسابات هيدرا: لماذا يبدأ الدفاع عن التقطير بتحديد الهوية (AR)
- التحقق من الشركات للوصول إلى واجهة برمجة تطبيقات الذكاء الاصطناعي: من يتحكم في هذا الحساب حقًا؟ (AR)
- التحقق من الوصول إلى واجهة برمجة التطبيقات لمقدمي نماذج الذكاء الاصطناعي: بنية متعددة المستويات حسب المخاطر (AR)
- البحث بالوجه 1:N: الكشف عن جميع الحسابات التي يتحكم بها شخص واحد (AR)
- التحقق البيومتري متعدد المستويات لوصول واجهة برمجة تطبيقات الذكاء الاصطناعي: ربط الامتياز بالشخص (AR)
- شبكات حسابات الهيدرا: كيف تتحول 20 ألف حساب إلى فاعل واحد (AR)