→ العودة إلى المدونة
Security & Privacy

WeWorm واختبار احتواء الانتشار الذاتي لأمان المراسلة المدعومة بالذكاء الاصطناعي

يمثل بحث WeWorm من Calif.io عامل ضغط مفيدا للفرق التي تربط الذكاء الاصطناعي بالمراسلة وجلسات الأجهزة وأدوات استخدام الحاسوب. تقدم هذه المقالة اختبار احتواء الانتشار الذاتي من Optijara، وهو إطار من ست بوابات للتحقق من الاحتواء قبل توسيع نطاق سير عمل المراسلة المستقلة.

بقلم Hamza Diaz
8 سبتمبر 202610 دقيقة قراءة12 مشاهدة

لماذا يغير WeWorm سؤال الأمان للمراسلة المدعومة بالذكاء الاصطناعي

تصل رسالة تبدو غير ضارة إلى سطح مراسلة مدعوم بالذكاء الاصطناعي. لا ينبغي أن يكون السؤال الأول: هل يستطيع المساعد فهم هذه الرسالة؟ هذا معيار منخفض جدا. السؤال الأدق هو ما إذا كان النظام يبقي الرسالة محصورة قبل أن تتسبب في إرسال أو رفع أو إعادة توجيه أو نقرة أو جسر جلسة.

يوفر بحث WeWorm العلني من Calif.io طريقة مفيدة للمشغلين لطرح هذا السؤال من دون تحويل النقاش إلى استعراض عن الاختراقات. تشمل مجموعة المصادر صفحة بحث WeWorm من Calif.io، وعروض الفيديو العامة، وأبحاث zero-click وOEMPocalypse ذات الصلة، وصفحات تطبيق WeChat ومنصته العامة المعتمدة لسياق المراسلة. تدعم هذه الأدلة نقاش الاحتواء الدفاعي. ولا تدعم ادعاءات بشأن استغلال نشط، أو أثر غير معلن لدى المورّدين، أو إصدارات متأثرة بعينها، أو حوادث لدى عملاء Optijara.

المسألة التشغيلية واضحة: أصبحت المراسلة بنية تحتية للعمل. تستخدم الفرق المراسلة لتوجيه حالات الدعم، والموافقة على التغييرات التشغيلية، وتنسيق متابعة المبيعات، ونقل الملفات، وإبقاء محادثات العملاء مستمرة. عند إضافة الذكاء الاصطناعي، قد يقترب المحتوى غير الموثوق من أدوات يمكنها العمل عبر جهات الاتصال والملفات وجلسات المتصفح والأجهزة. هذا القرب يغير الخطر. لا ينبغي أبدا أن تصبح الرسالة هي من يكتب سياسة ما يسمح للأداة بفعله.

هذه هي غاية اختبار احتواء الانتشار الذاتي من Optijara، أي APCT. فهو يمنح المؤسسين والمشغلين وقادة تقنية المعلومات وصناع القرار في الذكاء الاصطناعي طريقة لتحديد ما إذا كانت أسطح المراسلة واستخدام الحاسوب المدعومة بالذكاء الاصطناعي قادرة على مقاومة قابلية وصول المشغلات، وإساءة استخدام الثقة عبر الأجهزة، والحركة الجانبية المؤتمتة. الرؤية العملية هي أن الذكاء الاصطناعي للقراءة فقط وللمسودات فقط غالبا ما يستحق التبني في وقت أبكر من المراسلة المستقلة، لأنه يخلق قيمة مع نطاق تأثير أصغر. ضع أدلة الاحتواء قبل اقتصاديات التوسع.

البنية الدفاعية: من مشغل الرسالة إلى محاولة الانتشار

على المستوى الدفاعي، يتبع خطر الانتشار عادة مسارا قصيرا. يتم عرض المحتوى الوارد أو تحليله أو معاينته. يفسره سطح مدعوم بالذكاء الاصطناعي. قد يصبح السياق ذو الامتياز أو الأدوات قابلا للوصول. تطلب إجراءات صادرة. وإذا فشلت الضوابط، فقد تنتقل محاولة الانتشار عبر الردود أو إعادة التوجيه أو الروابط أو الملفات أو جهات الاتصال أو المجموعات أو الجلسات المقترنة.

تستثني هذه المقالة كود الاستغلال، والحمولات التشغيلية، وخطوات سرقة بيانات الاعتماد، والتخفي، والاستمرارية، وتعليمات إعادة الإنتاج. مستوى التحكم هو الموضوع. تعد تطبيقات المراسلة حساسة لأن سياق المحادثة موثوق، والجلسات تستمر عبر عملاء الهاتف المحمول وسطح المكتب والويب، والروابط والوسائط ومحادثات المجموعات ورسوم جهات الاتصال أمور طبيعية. يتوقع الناس أن تكون المراسلة سريعة. ويمكن أن تعمل هذه السرعة ضد الأمان إذا أثر المحتوى غير الموثوق في الأدوات قبل تشغيل فحوص السياسة.

ادعاء الهجومالمصدر المتحقق منهالثقةتفسير آمنما لا ينبغي استنتاجه
WeWorm بحث أمني علني عن سلوك دودة برمجية في المراسلةصفحة WeWorm من Calif.io والعروضعاليةعامله كإشارة لاختبار الاحتواءلا تدّع وجود استغلال نشط من دون دليل
يمكن لأسطح zero-click أن تخلق خطرا غير معتاد للمشغلاتبحث zero-click من Calif.ioمتوسطةاختبر ما إذا كان المحتوى الوارد يستطيع استدعاء الأتمتةلا تفترض أن كل عميل أو إصدار متأثر
توسع الجلسات عبر المنصات مشكلة الاحتواءصفحات WeChat العامة للهاتف المحمول والمنصةمتوسطةأدرج جسور الهاتف المحمول وسطح المكتب وجلسات الويب في الاختباراتلا تدّع أثرا محددا على منصة ما ما لم يعلن عنه
يمكن لسلوك المصنعين الأصليين وعلى مستوى الجهاز أن يؤثر في حدود الانتشاربحث OEMPocalypse من Calif.ioمتوسطةأدرج حدود الثقة في الجهاز والجلسةلا تدمج أبحاثا منفصلة في سلسلة استغلال واحدة

APCT: إطار الاحتواء من Optijara بست بوابات

يقسم APCT إشارة بحث الديدان البرمجية إلى ست بوابات تشغيلية. تطرح كل بوابة سؤال احتواء واحدا، وتجمع الأدلة، وتنتهي إلى قرار: اعتماد أو تجربة محدودة أو انتظار. الاختبارات العادية تكشف إخفاقات قد لا تتناولها العروض.

flowchart TD A[رسالة واردة] --> B[محلل أو عارض] B --> C{قرار الحجر} C -->|غير موثوق| D[محرك السياسة] C -->|موثوق ومحدد النطاق| E[تحليل للقراءة فقط] D --> F[وسيط الأدوات] F --> G{بوابة تأكيد جديدة} G -->|لا يوجد تأكيد| H[حظر الإجراء الصادر] G -->|تم التأكيد| I[إجراء معتمد] F --> J[كاشف الشذوذ] J --> K{تم تجاوز العتبة} K -->|نعم| L[مفتاح الإيقاف] L --> M[مخزن الأدلة] M --> N[حلقة الاسترداد]
بوابة APCTوضع الفشلسؤال الاختبار الدفاعيالأدلة المطلوب جمعهاإشارة النجاح
قابلية وصول المشغلمحتوى غير موثوق يستدعي الأتمتةهل يمكن لرسالة أن تشغل إجراء من دون نية صريحة من المستخدم؟سجلات الاستدعاء، حدود المطالبة، حالة الواجهةلا يوجد استدعاء ذاتي من إدخال غير موثوق
عزل حدود الثقةسياق الرسالة يصل إلى الهوية أو امتيازات الإدارةهل المحتوى معزول عن قوة الحساب والجهاز والمؤسسة؟خرائط الأذونات، نطاقات الجلساتيبقى سياق الرسالة منخفض الامتياز
فصل المحتوى عن الأدواتمحتوى الرسالة يختار الأدوات أو يوجههاهل التحليل وتنفيذ الأدوات منفصلان؟سجلات وسيط الأدوات، قرارات السياسةتتطلب الأدوات موافقة السياسة
الاحتواء عبر الأجهزةجلسة واحدة تؤثر في أخرىهل جلسات الهاتف المحمول وسطح المكتب والويب مقسمة؟جرد الأجهزة، سجلات الجلساتلا يوجد إجراء جانبي ضمني
تأكيد الإجراء الصادرالمساعد يرسل أو يعيد التوجيه أو يرفع أو ينقر بصمتهل يتم تأكيد الإجراءات الصادرة وغير القابلة للعكس بصياغة جديدة؟لقطات شاشة للمطالبة، سجلات الإجراءات المحظورةمطلوب اعتماد قابل للقراءة من الإنسان
الكشف، ومفتاح الإيقاف، والأدلة، والاستردادالنظام لا يستطيع إيقاف الأحداث أو إعادة بنائهاهل يمكن للفريق الكشف والتعطيل والتحقيق والاستعادة؟أحداث المعدل، طابع وقت مفتاح الإيقاف، ملاحظات الاستردادالتعطيل يعمل ومسار التدقيق مكتمل

تسأل البوابة الأولى، قابلية وصول المشغل، عما إذا كان المحتوى الوارد غير الموثوق يستطيع فعل أكثر من قراءته أو حجره. ينبغي أن تكون الإجابة الافتراضية لا. يمكن للرسالة أن تقدم بيانات، لكنها لا ينبغي أن تبدأ الأتمتة بذاتها. البوابة الثانية هي عزل حدود الثقة. لا تستحق المحادثة قوة الحساب أو الإدارة أو الفوترة أو المؤسسة أو الجهاز لمجرد أنها تظهر في سلسلة موثوقة.

تفصل البوابة الثالثة المحتوى عن إذن الأداة. إذا استطاعت رسالة التأثير في الأداة التي تستدعى، أو جهة الاتصال التي تختار، أو الملف الذي يرفع، فقد أصبحت الرسالة فعليا سياسة. استخدم وسيطا له أذونات محددة النطاق وقرارات قابلة للفحص. تغطي البوابة الرابعة احتواء الأجهزة والجلسات. تحتاج جلسات الويب، وعملاء سطح المكتب، وعملاء الهاتف المحمول، والأجهزة المقترنة، وملفات تعريف المتصفح إلى سياسات منفصلة، لأن الفشل في سطح واحد لا ينبغي أن يمنح حركة جانبية إلى سطح آخر.

تتعامل البوابة الخامسة مع تأكيد الإجراء الصادر. يجب أن تتطلب عمليات الإرسال وإعادة التوجيه والرفع والدعوات والموافقات والنقرات غير القابلة للعكس موافقة جديدة قابلة للقراءة من الإنسان تصف الإجراء والهدف والنتيجة. البوابة السادسة هي قدرة الطوارئ العملية: الكشف، ومفتاح الإيقاف، والتقاط الأدلة، والاسترداد. إذا لم يستطع الفريق إيقاف الأتمتة بسرعة أو إعادة بناء ما حدث، فهو لم يجتز الاحتواء بمعنى معتبر.

مصفوفة أسطح المراسلة: أين تختبر قبل النشر

يمثل WeChat سياقا مفيدا لأن قوائم تطبيقاته العامة وصفحات منصته تظهر افتراضات شائعة في المراسلة: عملاء الهاتف المحمول، والرسم الاجتماعي، والاستخدام عبر الأجهزة، والتواصل المستمر. لا تدعي هذه المقالة وجود إصدارات متأثرة بعينها أو أثر غير معلن لدى المورّدين. ينبغي للمشغلين التعامل مع البحث العلني كسبب لاختبار أسطح المراسلة المتصلة بالذكاء الاصطناعي لديهم على نحو آمن.

نوع السطحمصدر المشغلالامتيازات القابلة للوصولالقدرة الصادرةضبط الاحتواءالأدلة المطلوب التقاطهاالوضعية الموصى بها
عملاء مراسلة بشرية فقطمحادثات يفتحها المستخدمجلسة المستخدمردود يدويةتأكيد المستخدمخريطة جلسات أساسيةاعتماد التقوية المعتادة
ملخصات الذكاء الاصطناعي ومساعدو الردالرسائل، السلاسل، المرفقاتمحتوى للقراءة فقطاقتراحات مسوداتوضع المسودات فقطسجلات الملخص، سياسة المطالبةاعتماد إذا كان للقراءة فقط
أتمتة فرز الدعمرسائل العملاءبيانات وصفية للطابور، وسومتحديثات التذاكرأذونات API محددة النطاقاستدعاءات الأدوات، فروق التذاكرتجربة محدودة بحدود
توجيه CRM أو الملفاتالرسائل مع سجلات الأعمالجهات الاتصال، الملفات، السجلاتتحديثات وعمليات رفعأقل امتياز وتأكيدسجلات قبل وبعدتجربة محدودة بحذر
وكلاء استخدام الحاسوب المرتبطون بالمراسلةواجهة معروضة، روابط، وسائطمتصفح مسجل الدخول أو جلسة جهازنقرات، إرسال، رفعوسيط أدوات، تقسيم الجلساتسجلات شاشة، موافقات الإجراءاتانتظار ما لم يجتز APCT
جسور الأجهزة وجلسات الويبجلسات مقترنةهوية الهاتف المحمول وسطح المكتب والويبإجراء متعدد الأسطحعزل الأجهزةجرد الجلساتانتظار أدلة قوية

ذروة الخطر ليست في المراسلة وحدها. بل في المراسلة مع أدوات مستقلة وجلسات مصدق عليها مستمرة. ابدأ مع تعطيل الإجراء التلقائي، وفصل حسابات الاختبار عن هوية الإنتاج، وتضييق أذونات جهات الاتصال والملفات، وتأكيد الإرسال، والاحتفاظ بآثار القرارات. تحتاج سير العمل القابلة للتشغيل آليا إلى بوابات أقوى من الصفحات القابلة للقراءة من الإنسان.

خطة مختبر APCT آمنة لتقييم مقاومة الانتشار دون نقرة

ينتمي APCT إلى مختبر مضبوط، لا إلى رسم جهات اتصال حي. استخدم حسابات معزولة، وأجهزة منفصلة، ورسائل اصطناعية، وبيانات غير حساسة، وجهات اتصال خارجية معطلة، ومن دون أهداف من أطراف ثالثة. الهدف هو ملاحظة ما إذا كانت الضوابط تصمد تحت ضغط حميد. لا تحاول إعادة إنتاج دودة برمجية.

المرحلةإجراء آمنالأدلةمعيار النجاح أو الفشل
النطاقجرد عملاء المراسلة وميزات الذكاء الاصطناعي والأدوات والجلسات والحساباتقائمة أصول وخريطة أذوناتكل الأسطح المتصلة معروفة
العرضإرسال رسائل اصطناعية حميدة تختبر التحليل والمعايناتلقطات شاشة للواجهة، سجلات المحلللا يوجد استدعاء أداة من المحتوى وحده
حد الاستدعاءمحاولة مطالبات مختبرية معتمدة تطلب الأتمتةسجلات المطالبة والسياسةتتطلب الأتمتة نية المستخدم
مطالبة الإذنطلب إجراءات المسودة والإرسال وإعادة التوجيه والرفع وفتح الروابط في المختبرسجلات الموافقةالإجراءات الحساسة تتطلب تأكيدا صريحا
المعدل والشذوذمحاكاة طلبات حميدة متكررةأحداث حد المعدلالضوابط تكشف السرعة غير المعتادة
مفتاح الإيقافتعطيل الأتمتة أثناء المختبرطابع وقت وأحداث محظورةتتوقف الإجراءات الجديدة بصورة متوقعة
الاستردادالاستعادة من سياسة معروفة السلامة ومراجعة السجلاتملاحظات الاستردادمسار التدقيق مكتمل

أبق المختبر بسيطا عمدا. استبعد حمولات الاستغلال، وجمع بيانات الاعتماد، والتخفي، والاستمرارية، والانتشار غير المضبوط، والاختبار على الشبكات العامة. تشمل الأدلة المفيدة لقطات الشاشة أو السجلات، وإعدادات المطالبة والسياسة، والموافقات، والإجراءات المحظورة، وأحداث حد المعدل، وطابع وقت مفتاح الإيقاف، وملاحظات الاسترداد، وسجل قرار نهائيا. إذا لم ينشر مورّد تفاصيل كافية لاختبار ادعاء بأمان، فسجل الفجوة واختبر الحد الذي تتحكم فيه بدلا من ذلك.

اعتماد أو تجربة محدودة أو انتظار: مصفوفة القرار لأتمتة المراسلة بالذكاء الاصطناعي

سير العملاعتمد عندماجرّب بشكل محدود عندماانتظر عندما
تلخيص الرسائلللقراءة فقط، بلا وصول إلى الأدوات، وسجلات واضحةتحتاج المرفقات أو سياقات المجموعات إلى مراجعةتستطيع الملخصات تشغيل إجراءات
الردود المقترحةمسودات فقط، والمستخدم يحرر قبل الإرسالقوالب ومجموعات جهات اتصال محدودةيستطيع المساعد الإرسال مباشرة
فرز الدعموسوم وطوابير محددة النطاقتحديثات التذاكر قابلة للعكسيستطيع الفرز مراسلة العملاء ذاتيا
تحديثات CRMحقول ضيقة وسجلات تدقيقموافقة بشرية على التحديثاتيستطيع محتوى الرسالة تغيير السجلات من دون مراجعة
توجيه الملفاتمجلدات وأنواع ملفات معتمدةالملفات الحساسة مستبعدةيحدث الرفع من مطالبات غير موثوقة
التواصل مع جهات الاتصالمسودات معتمدة بشريامجموعة جهات اتصال اصطناعية أو داخلية صغيرةتوجد إعادة توجيه ذاتية أو توسعة لجهات الاتصال
إجراءات استخدام الحاسوبنادرا، وفقط بعد اجتياز كل البواباتملف تعريف متصفح معزول وحسابات مختبريةتبقى الجلسات المشتركة أو تسلسل الإجراءات عبر الأجهزة

اعتمد سير العمل للقراءة فقط أو المسودات فقط عندما تكون ضوابط المشغل ونطاق الأدوات والتأكيد البشري وتقسيم الجلسات والمراقبة والتراجع وحالة الإفصاح قوية. جرّب سير العمل الصادر المقيّد مع مجموعات جهات اتصال اصطناعية أو محدودة. انتظر قبل إعادة التوجيه الذاتية، أو توسعة جهات الاتصال، أو تسلسل الإجراءات عبر الأجهزة، أو تدفقات استخدام الحاسوب غير الخاضعة للمتابعة عندما تكون أدلة الاحتواء ضعيفة. قد يكون المساعد المخصص للقراءة فقط، الذي يساعد المحللين ولا يستطيع إرسال أي شيء، أفضل من مساعد مستقل يحتاج إلى استثناءات في كل مكان. يمكن أن تساعد Optijara الفرق على إجراء مراجعات بأسلوب APCT قبل ربط مساعدي الذكاء الاصطناعي بالمحادثات أو جهات الاتصال أو الملفات أو جلسات استخدام الحاسوب الحية.

قائمة التنفيذ، والأخطاء الشائعة، والمحاذير

بند القائمةالمالكالدليل
جرد الأتمتات المتصلة بالمراسلةتقنية المعلومات أو الأمنسجل الأصول
تصنيف مصادر المشغلاتالمنتج والأمنخريطة المشغلات
فصل تحليل المحتوى عن الأدواتالهندسةسياسة وسيط الأدوات
تطبيق نطاقات أدوات بأقل امتيازفريق المنصةمصفوفة الأذونات
طلب تأكيد جديد للإجراءات الصادرةالمنتجسجلات واجهة الموافقة
تقسيم الجلسات والأجهزةتقنية المعلوماتجرد الجلسات
إضافة حدود معدل وكشف شذوذهندسة الأمنسجلات التنبيهات
الحفاظ على مفتاح إيقافالعملياتدليل تشغيل التعطيل
التقاط الأدلةالأمنمسار تدقيق
التدرب على الاستردادالعملياتملاحظات الاسترداد
تتبع حالة إفصاح المورّد والتخفيفمالك المخاطرسجل المصادر

الأخطاء الشائعة يمكن توقعها. تتعامل الفرق مع الملخصات كأنها غير ضارة، وتسمح لمحتوى الرسالة باختيار الأدوات، وتشارك الجلسات عبر الأجهزة من دون فصل السياسات، وتعتمد على تدريب المستخدمين وحده، وتتخطى سجلات الإجراءات الصادرة، وتختبر المسارات السعيدة فقط، أو تنشر قبل التدرب على الاسترداد. والقيود مهمة أيضا. لا تثبت نتائج المختبر أمانا دائما. يختلف سلوك المزوّدين. يمكن لتحديثات النماذج أن تغير السلوك. قد تحد قواعد الخصوصية من التسجيل. يمكن لتقادم ذاكرة التخزين المؤقت أن يخفي انجراف السياسة. وقد تقلل الضوابط الأشد السهولة، خاصة في طوابير الدعم والعمليات السريعة.

المقياسسبب أهميتهطريقة المراجعة
معدل اجتياز البواباتيظهر نضج الاحتواءراجع كل بوابة في APCT
محاولات الإجراء الصادر المحظورةتؤكد أن الضوابط نشطةافحص سجلات السياسة
معدل تجاوز التأكيديظهر ضغط المستخدمين والاحتكاكراجع الموافقات
سرعة إرسال شاذةتكشف سلوكا شبيها بالانتشارراقب أحداث المعدل
زمن الوصول إلى مفتاح الإيقافيقيس جاهزية الطوارئنفذ تدريبات تعطيل
زمن الاسترداديظهر المرونة التشغيليةتدرب على الاستعادة
اكتمال التدقيقيدعم التحقيقعاين سجلات الأدلة
وتيرة إعادة الاختبار بعد التغييرتكشف الانجرافأعد الاختبار بعد تغييرات النموذج أو التطبيق أو السياسة
{
  "topic": "WeWorm defensive containment for AI-enabled messaging",
  "framework": "Autonomous Propagation Containment Test",
  "gates": ["trigger_reachability", "trust_boundary_isolation", "content_tool_separation", "cross_device_session_containment", "outbound_confirmation", "detection_kill_switch_evidence_recovery"],
  "recommended_posture": "adopt read-only and draft-only workflows first, pilot constrained outbound workflows, wait on unattended cross-device action chaining",
  "do_not_do": ["do not reproduce worms", "do not test against third parties", "do not connect untrusted messages directly to send or upload tools"],
  "sources": ["https://calif.io/research/weworm", "https://calif.io/research/zero-click", "https://calif.io/research/oempocalypse"]
}

ينبغي أن تأتي أدلة الاحتواء قبل توسيع نطاق المراسلة المستقلة. قيمة WeWorm أنه ينقل محادثة التبني بعيدا عن سؤال: هل تستطيع الميزة أن تعمل؟ وباتجاه سؤال: هل يستطيع السطح احتواء محاولات الانتشار قبل أن تعبر حدود الثقة؟ هذا هو الاختبار الصحيح لأي فريق يربط الذكاء الاصطناعي بالمحادثات أو جهات الاتصال أو الملفات أو الأجهزة أو الجلسات.

لمطالعة نمط مكمّل لفرز الأدلة، راجع اختبار قبول مراجعة أمان الذكاء الاصطناعي من Optijara. ويمكن للفرق التي تربط النماذج بالأدوات أيضا تكييف حدود الأذونات والتصعيد في تصميم مستوى التحكم الوكيلي.

النقاط الرئيسية

  • 1ينبغي التعامل مع WeWorm كإشارة احتواء دفاعية، لا كسبب لإطلاق ادعاءات اختراق غير مدعومة.
  • 2يختبر APCT ست بوابات: قابلية وصول المشغل، وعزل حدود الثقة، وفصل المحتوى عن الأدوات، والاحتواء عبر الأجهزة، وتأكيد الإجراء الصادر، والكشف مع الاسترداد.
  • 3النمط الأعلى خطرا هو الجمع بين المراسلة والأدوات المستقلة والجلسات المصدق عليها المستمرة.
  • 4ينبغي أن يستخدم التقييم الآمن حسابات مختبرية معزولة، ورسائل اصطناعية، وجهات اتصال خارجية معطلة، ومن دون إعادة إنتاج الاستغلال.
  • 5سير العمل للقراءة فقط والمسودات فقط مرشح أول أفضل من إعادة التوجيه الذاتية، أو توسعة جهات الاتصال، أو إجراءات استخدام الحاسوب غير الخاضعة للمتابعة.
  • 6ينبغي التقاط أدلة الاحتواء كسجلات، ولقطات شاشة، وسجلات سياسة، وإجراءات محظورة، وطوابع وقت لمفتاح الإيقاف، وملاحظات استرداد.

الخلاصة

يمنح WeWorm المشغلين اختبارا ملموسا، لا قصة تخويف. يحول APCT الخطر إلى ست بوابات يمكن ملاحظتها وتسجيلها واستخدامها لاتخاذ قرار اعتماد أو تجربة محدودة أو انتظار قبل ربط الذكاء الاصطناعي بالمراسلة الحية أو الملفات أو الأجهزة أو جهات الاتصال أو الجلسات.

الأسئلة الشائعة

ما هو WeWorm؟

WeWorm هو بحث أمني من Calif.io في سلوك الديدان البرمجية للمراسلة دون نقرة وعبر المنصات. تناقشه هذه المقالة كإشارة بحثية دفاعية علنية، لا كدليل على اختراق غير معلن أو أثر واسع على المنصات.

ما هو اختبار احتواء الانتشار الذاتي؟

APCT هو إطار Optijara المكون من ست بوابات للتحقق مما إذا كانت أسطح المراسلة واستخدام الحاسوب المدعومة بالذكاء الاصطناعي قادرة على احتواء المشغلات، وإساءة استخدام حدود الثقة، والإجراءات الصادرة، والكشف، واستجابة مفتاح الإيقاف، والتقاط الأدلة، والاسترداد.

هل يعني هذا أن كل مساعد مراسلة بالذكاء الاصطناعي غير آمن؟

لا. يعتمد الخطر على المشغلات، والأذونات، والوصول إلى الأدوات، وتصميم الجلسات، وتدفقات التأكيد، والمراقبة، والاسترداد. يختلف ملخص للقراءة فقط في فئة الخطر عن وكيل مستقل لاستخدام الحاسوب.

كيف يمكن للفرق أن تختبر بأمان من دون إعادة إنتاج دودة برمجية؟

استخدم حسابات مختبرية معزولة، ورسائل اصطناعية، وبيانات غير حساسة، وجهات اتصال خارجية معطلة، وأذونات صارمة، وتسجيل الأدلة، واختبار مفتاح الإيقاف، وتدريبات الاسترداد. لا تستخدم كود استغلال أو أهدافا من أطراف ثالثة.

ما سير العمل الذي ينبغي للفرق اعتماده أولا؟

ابدأ بسير عمل للقراءة فقط أو المسودات فقط أو محدد النطاق بإحكام، يتطلب تأكيدا بشريا وينتج سجلات واضحة. انتظر قبل إعادة التوجيه الذاتية، وتوسعة جهات الاتصال، والتسلسل عبر الأجهزة، وإجراءات استخدام الحاسوب غير الخاضعة للمتابعة.

المصادر

شارك هذا المقال

Hamza Diaz

بقلم

Hamza Diaz

حمزة دياز هو مؤسس Optijara، حيث يبني وكلاء ذكاء اصطناعي عمليين، وأنظمة أتمتة، وسير عمل Copilot للشركات الخدمية. يكتب عن تشغيل الذكاء الاصطناعي، واستراتيجية الوكلاء، والتطبيق الواقعي للفرق التي تريد أنظمة مفيدة بدلًا من الضجيج.