لم يعد الحقن الفوري المخفي البسيط — نص أبيض على أبيض، وتعليقات HTML، وUnicode غير المرئي — يعمل ضد حاملي شهادات LLM الحديثة. لقد أدى التعرف على الأنماط وعزل الحدود وتسليط الضوء على سد هذه الثغرات.

لكن الهجمات الأكثر تطوراً لا تزال فعالة.

لا يستطيع LLMs التمييز بشكل موثوق بين المحتوى والتعليمات. هذه خاصية هيكلية لكيفية معالجة النص، وليست خطأً في انتظار التصحيح. تم توسيع سطح الهجوم ليشمل أصول علامتك التجارية، ووكلاء الذكاء الاصطناعي، ومكدس البائعين، وسير العمل الذي يواجه العملاء.

كيف يصبح مركز المساعدة الخاص بك فخًا للتصيد الاحتيالي

ChatGPhish هو أوضح مثال. يقوم المهاجمون بتضمين حمولات ضارة في صفحات الويب العادية (مدونتك، ومركز المساعدة، ووثائق منتجك).

عندما يطلب المستخدم من الذكاء الاصطناعي تلخيص تلك الصفحة، تتسبب التعليمات المخفية في قيام الذكاء الاصطناعي بإنشاء تنبيه حساب مزيف جنبًا إلى جنب مع رمز QR ضار، والذي يتم عرضه أصلاً داخل واجهة الدردشة.

ونظرًا لأنه يظهر داخل ChatGPT أو Perplexity بدلاً من ظهوره على عنوان URL خارجي مشبوه، فإنه يتجاوز قوائم حظر عناوين URL وتحذيرات مدير كلمات المرور بالكامل.

يتعرض عميلك للتصيد الاحتيالي. يتم إلقاء اللوم على علامتك التجارية. لم تكن لديك أي فكرة عن استخدام الصفحة كآلية للتسليم.

كن العلامة التجارية توصي منظمة العفو الدولية.

تعرف على مكان ظهور علامتك التجارية في بحث الذكاء الاصطناعي، وأين يفوز المنافسون، وما يلزم لتصبح الإجابة التي يوصي بها الذكاء الاصطناعي.

شاهد رؤية الذكاء الاصطناعي الخاصة بك

اختطاف حصة إحالة LLM عبر التضمين الدلالي

يعد التضمين الدلالي أكثر طرق الهجوم فعالية ضد النماذج العليا. يقوم المهاجمون بنسج تعليمات ضارة في فقرات تبدو مشروعة. لا تستطيع LLM التمييز بين المحتوى الذي يجب أن تلخصه والتعليمات التي يجب أن تتبعها.

يمكن للمنافس تضمين تعليمات في مقالة مقارنة صناعية تخبر وكلاء الذكاء الاصطناعي الذين يتصفحون الويب بالتوصية بمنتجاتهم بدلاً من منتجاتك. لا اختراق ولا خرق، مجرد فقرة تشبه النثر.

يعد هذا تهديدًا مباشرًا لمشاركة إحالة LLM الخاصة بك، ولا يتطلب الوصول إلى البنية التحتية الخاصة بك على الإطلاق. تعترف نماذج LLM بالتهديد ببطء، بما في ذلك Claude، الذي يحذر المستخدمين من أن محتوى المحادثة الضار قد يتسبب في تسرب بياناتهم.

يؤدي مربع الدردشة الخاص بواجهة Claude مع مطالبة المستخدم التي تطلب ملخصًا لعنوان URL للتسويق الخارجي إلى تشغيل لافتة تحذير أمنية وردية بارزة في الأسفل، لتحذير المستخدم من أن المحتوى الضار الموجود على الصفحة قد يخدع الذكاء الاصطناعي في محاولة اتخاذ إجراءات ضارة أو مشاركة البيانات.

تعمق أكثر: القبعة السوداء GEO حقيقية – ولهذا السبب يجب عليك الانتباه

المدخلات متعددة الوسائط المسلحة: البودكاست والفيديو والوكلاء الصوتيين

تعمل الهجمات متعددة الوسائط على توسيع التهديد ليشمل كل تنسيق تنتجه وكل قناة تنشرها.

يسمح إخفاء المعلومات العصبية للمهاجمين بإخفاء التعليمات في الصور التي لا يمكن تمييزها بصريًا عن الصور العادية.

يسمح الإخفاء الصوتي النفسي بتضمين الأوامر المخفية في الصوت بترددات لا يستطيع البشر اكتشافها. تعتبر ملفات البودكاست ذات العلامات التجارية ومقاطع فيديو YouTube والمحتوى الصوتي المدعوم كلها ناقلات هجوم نشطة.

يمكن أن يحصل المستمع في البودكاست المدعوم الخاص بك على تعليمات يتم تسليمها بصمت إلى مساعد الذكاء الاصطناعي الخاص به الذي يعمل دائمًا، ولن يعرف أي منكما.

يأخذ StyleBreak هذا إلى أبعد من ذلك. أظهر الباحثون أن التلاعب بالنغمة العاطفية للصوت (الغاضب، أو الحزين، أو الخائف) يمكن أن يتجاوز مرشحات الأمان الخاصة بنموذج اللغة الصوتية دون أي كود أو نص مخفي.

بالنسبة للعلامات التجارية التي تدير مراكز اتصال تعتمد على الصوت أولاً أو أنظمة الرد الصوتي التفاعلي (IVR)، يعد هذا تهديدًا هجوميًا مدمجًا مباشرة في التنسيق نفسه.

احصل على النشرة الإخبارية التي يعتمد عليها مسوقو البحث.


وكلاء الذكاء الاصطناعي المارقون في دعم العملاء

تقوم فرق التسويق وRevOps بنشر وكلاء مستقلين بشكل أسرع من قدرة فرق الأمان على تدقيقهم. هؤلاء الوكلاء معرضون لما يسميه الباحثون مشكلة النائب المرتبك.

يمكن اختطاف أي وكيل لديه إمكانية الوصول إلى مدخلات غير موثوقة (رسائل البريد الإلكتروني الواردة أو محتوى الويب) وأداة مميزة (إرسال رسائل البريد الإلكتروني أو تعديل سجلات CRM أو إصدار المبالغ المستردة) من خلال هذا الإدخال.

يرسل المهاجم إلى وكيل خدمة العملاء الخاص بك بريدًا إلكترونيًا يتضمن مطالبة مخفية. يقرأه الوكيل كطلب مشروع وينفذ الحمولة، وبالتالي يسرب بيانات المستخدم، أو يرسل بريدًا عشوائيًا إلى قائمتك، أو يمسح سجلات CRM.

في مثال صارخ على استخدام الذكاء الاصطناعي كسلاح ضد الوجود الاجتماعي للعلامة التجارية، قام المهاجمون مؤخرًا باختطاف حسابات Instagram رفيعة المستوى من خلال التلاعب ببرنامج الدردشة الآلي لدعم الذكاء الاصطناعي الخاص بشركة Meta.

فتح المتسللون محادثة مع Meta AI Support Assistant وطلبوا منه إضافة عنوان بريد إلكتروني جديد إلى حساب الضحية. أرسل برنامج chatbot رمز التحقق إلى البريد الإلكتروني للمهاجم. بمجرد التأكيد، قام بتسليم زر “إعادة تعيين كلمة المرور” والوصول الكامل إلى الحساب، بما في ذلك الملفات الشخصية الحكومية والعسكرية.

يمكن التحدث مع وكلاء الدعم المستقلين لتجاوز بروتوكولات الأمان الأساسية. الترميز الحيوي يجعل الأمر أسوأ. إذا كنت تقوم بإنشاء أدوات داخلية باستخدام إنشاء التعليمات البرمجية بمساعدة الذكاء الاصطناعي، فيمكنك نشرها دون مراجعة أمنية كافية.

إذا قرأ وكيل مارق سجلات الأخطاء الخاصة به بعد حدوث عطل، فيمكن للحمولة المضمنة في رسالة الخطأ هذه اختطاف النظام من الداخل.

تعمق أكثر: مخاطر سلامة الذكاء الاصطناعي: كيف يتجاوز كسر الحماية الأفضل من N الضمانات

تخريب سلسلة التوريد: خطر بائعي الذكاء الاصطناعي غير الخاضعين للفحص

إن قوة وضعك الأمني ​​لا تقل قوة عن البائع الأقل أمانًا في مجموعة الذكاء الاصطناعي لديك.

أكدت شركة Mercor وقوع حادثة وقعت في 31 مارس مرتبطة بإصدارات ضارة من LiteLLM، وهي أداة API مفتوحة المصدر للذكاء الاصطناعي تُستخدم على نطاق واسع عبر مجموعات المؤسسات.

أشارت OWASP إلى أن الاختراق أثار مخاوف من احتمال كشف معلومات حساسة حول أساليب التدريب النموذجي وعمليات المقاولين.

توقفت عمليات Meta مؤقتًا نتيجة لذلك. إذا كنت تستخدم موردي الذكاء الاصطناعي التابعين لجهات خارجية لمعالجة بيانات العملاء أو تشغيل تحليل الحملة، فسيضع البائع المخترق إستراتيجيات حملتك وشرائح العملاء ومنطق التسعير مباشرة أمام الجهات الفاعلة التي تهدد التهديد.

ما يجب عليك أن تطلبه من تكنولوجيا المعلومات

الدفاع الهيكلي الأكثر الموصى به على نطاق واسع هو نمط Dual-LLM: يقرأ أحد النماذج المعزولة المدخلات غير الموثوق بها، وينفذ نموذج متميز منفصل منطق الأعمال، ولا يتشارك الاثنان أبدًا في طبقة معالجة.

أظهر باحثون من معهد ماساتشوستس للتكنولوجيا CSAIL، وGoogle DeepMind، وETH Zurich – بما في ذلك المؤلفان الرئيسيان Edoardo Debenedetti وIlia Shumailov – في ورقتهم البحثية “هزيمة الحقن الفورية عن طريق التصميم” أن هذا النهج له نقطة عمياء محددة: “في حين أن تدفق التحكم محمي بواسطة نمط LLM المزدوج، لا يزال من الممكن التلاعب بتدفق البيانات”.

حتى مع تنفيذ خطة آمنة على بيانات مسمومة، تظل ملفاتك السرية تصل إلى المهاجم.

أربعة متطلبات لأي نشر للذكاء الاصطناعي يمس سير عمل التسويق:

  • قم بتعيين الوصول إلى الذكاء الاصطناعي عبر خمس عتبات: الاسترجاع، الذاكرة، التخطيط، اختيار الأدوات، والإخراج. كل نقطة امتياز هي سطح حقن.
  • الإنسان في حلقة العمل لإجراءات عالية المخاطر: يجب على أي وكيل يمكنه إرسال رسائل البريد الإلكتروني أو تعديل قواعد البيانات أو إصدار المبالغ المستردة أو نشر المحتوى أن يطلب تأكيدًا بشريًا صريحًا قبل التنفيذ.
  • بنية العزلة: قم بتنفيذ فصل Dual-LLM، ولكن قم بمراجعة تدفق البيانات، وليس فقط تدفق التحكم.
  • فحص البائعين كممارسة أمنية: تعامل مع كل أداة ذكاء اصطناعي تابعة لجهة خارجية في مجموعتك باعتبارها ناقل هجوم محتمل. المطالبة بالشفافية بشأن أنماط العزل والاستجابة للحوادث قبل توقيع أي عقد.

لا يستطيع حاملو شهادة LLM التمييز بين الأمر الحقيقي والأمر الضار. أصبحت الآن أصول علامتك التجارية والبودكاست ومستندات المساعدة وعلاقات البائعين الخاصة بك هي سطح الهجوم. تحتاج الحوكمة إلى اللحاق بالركب.

تعمق أكثر: كيف تختلف أنماط مطالبات الذكاء الاصطناعي حسب الصناعة وشكل رؤية البحث

تتم دعوة المؤلفين المساهمين لإنشاء محتوى لـ Search Engine Land ويتم اختيارهم لخبرتهم ومساهمتهم في مجتمع البحث. يعمل المساهمون لدينا تحت إشراف هيئة التحرير ويتم فحص المساهمات للتأكد من جودتها وملاءمتها لقرائنا. Search Engine Land مملوكة لشركة Semrush. لم يُطلب من المساهم الإشارة بشكل مباشر أو غير مباشر إلى Semrush. الآراء التي يعبرون عنها هي آرائهم الخاصة.


اكتشاف المزيد من اشراق اون لاين - تقنية المواقع

اشترك للحصول على أحدث التدوينات المرسلة إلى بريدك الإلكتروني.

شاركها.
اترك تعليقاً

اكتشاف المزيد من اشراق اون لاين - تقنية المواقع

اشترك الآن للاستمرار في القراءة والحصول على حق الوصول إلى الأرشيف الكامل.

متابعة القراءة