ما هي متصفحات الذكاء الاصطناعي؟ وكيف تنفذ المهام بدلًا منك؟

اعتدنا استخدام متصفح الإنترنت كأداة نفتح من خلالها المواقع ونبحث ونقرأ الصفحات ونملأ النماذج بأنفسنا. لكن دخول الذكاء الاصطناعي إلى المتصفح بدأ يغير هذه العلاقة؛ فبدل أن يكتفي البرنامج بعرض صفحات الويب، أصبح قادرًا على فهم جزء من محتواها والإجابة عن الأسئلة المتعلقة بها، وفي بعض الأنظمة تنفيذ سلسلة من الخطوات نيابة عن المستخدم.
من هنا ظهر مفهوم متصفحات الذكاء الاصطناعي AI Browsers، بالتزامن مع دمج مساعدات AI داخل المتصفحات التقليدية وظهور متصفحات صُممت حول الذكاء الاصطناعي منذ البداية.
الفكرة تتجاوز إضافة مربع دردشة إلى جانب الصفحة. الاتجاه الأكثر تقدمًا هو بناء متصفح يستطيع الانتقال من قراءة الإنترنت إلى التعامل معه وتنفيذ المهام داخله.
فما متصفح الذكاء الاصطناعي؟ وكيف يفهم صفحات الويب؟ وهل يستطيع فعلًا حجز موعد أو مقارنة عشرات المنتجات أو ملء النماذج بدلًا منك؟
ما هي متصفحات الذكاء الاصطناعي AI Browsers؟
متصفح الذكاء الاصطناعي هو متصفح ويب يدمج نماذج وتقنيات AI في تجربة التصفح بهدف مساعدة المستخدم على فهم المحتوى أو البحث أو التعامل مع المواقع وتنفيذ بعض الإجراءات.
قد تكون الوظيفة بسيطة مثل تلخيص الصفحة المفتوحة، أو أكثر تقدمًا مثل تحليل عدة صفحات ومقارنة المعلومات الموجودة فيها.
وفي الفئة الأكثر تطورًا، يمكن أن يتحول المتصفح إلى ما يشبه وكيلًا Agent قادرًا على تنفيذ سلسلة من الخطوات لتحقيق هدف يحدده المستخدم.
بدل أن تقول له: “افتح هذا الموقع”، يمكن أن يصبح الطلب أقرب إلى: “ابحث عن الخيارات المناسبة وفق هذه الشروط وقارن بينها”.
وهنا يبدأ الفرق الحقيقي بين إضافة AI عادية وبين ما يعرف أحيانًا باسم Agentic Browser أو المتصفح الوكيل.
وقد دخلت عدة شركات هذا السباق. أطلقت Perplexity متصفح Comet المبني حول البحث والمساعد الذكي، بينما طرحت OpenAI متصفح ChatGPT Atlas مع ChatGPT مدمجًا مباشرة في تجربة التصفح. كما دمجت Google قدرات Gemini الوكيلة في Chrome لتنفيذ مهام متعددة الخطوات على الويب. (perplexity.ai) (openai.com) (blog.google)
كيف يعمل متصفح الذكاء الاصطناعي؟
يحتاج المتصفح التقليدي بصورة أساسية إلى جلب صفحة الويب وعرضها وتمكين المستخدم من التفاعل معها.
أما متصفح AI فيضيف طبقة تستطيع التعامل مع محتوى الصفحة وسياق المستخدم وأحيانًا عناصر الواجهة نفسها.
عندما تطلب من المتصفح تلخيص مقال مثلًا، يمكن للنظام تحليل محتوى الصفحة المفتوحة وإرسال السياق المناسب إلى النموذج، ثم إنشاء الملخص.
لكن تنفيذ المهام أكثر تعقيدًا.
إذا طلب المستخدم من متصفح وكيل البحث عن رحلة مناسبة، فقد يحتاج النظام إلى:
- فهم الهدف والشروط التي حددها المستخدم.
- فتح موقع أو أكثر.
- إدخال مدينة المغادرة والوجهة والتاريخ.
- قراءة النتائج.
- الانتقال بين الخيارات.
- مقارنة الأسعار أو المواعيد.
- عرض النتيجة أو طلب موافقة المستخدم قبل إجراء حساس.
أي أن النموذج لا يتعامل مع نص فقط، بل يحتاج إلى فهم حالة المتصفح واتخاذ قرار بشأن الخطوة التالية ثم تنفيذها.
وقد شرحت Google نموذجًا مشابهًا في قدرات Gemini داخل Chrome، حيث يستطيع النظام تنفيذ مهام متعددة الخطوات، مع طلب التأكيد قبل إجراءات حساسة مثل الشراء أو النشر. (blog.google)
ما الذي تستطيع متصفحات AI فعله؟
تختلف الإمكانات من متصفح إلى آخر، لكن يمكن تقسيمها إلى عدة مستويات.
فهم الصفحة المفتوحة
يستطيع المساعد معرفة سياق الصفحة ومساعدة المستخدم في:
- تلخيص المقالات الطويلة.
- شرح مصطلح أو فقرة.
- استخراج نقاط محددة.
- مقارنة معلومات داخل الصفحة.
- الإجابة عن أسئلة مرتبطة بالمحتوى.
هذه الوظيفة تقلل الحاجة إلى نسخ النص يدويًا إلى روبوت محادثة منفصل.
البحث عبر عدة صفحات
بدل فتح مجموعة من نتائج البحث وقراءتها واحدة تلو الأخرى، يستطيع AI جمع المعلومات من مصادر متعددة ثم تنظيمها.
هنا يتحول المتصفح من واجهة لعرض المواقع إلى طبقة تساعد في البحث والتحليل.
التعامل مع علامات التبويب
يمكن للذكاء الاصطناعي المساعدة في فهم ما هو مفتوح داخل علامات التبويب وتنظيم العمل بينها.
وتصبح هذه الميزة أكثر أهمية عندما يحتاج المستخدم إلى مقارنة معلومات موزعة على عدة مواقع.
تنفيذ المهام
هذه هي المرحلة التي تجعل المتصفح أقرب إلى الوكيل.
فبدل تقديم تعليمات للمستخدم حول ما يجب الضغط عليه، يستطيع النظام في بعض الحالات التفاعل مع المواقع بنفسه.
وتصف OpenAI وضع Agent في ChatGPT Atlas بأنه قادر على تنفيذ مهام مثل البحث والتحليل وأتمتة بعض الإجراءات داخل المتصفح، مع ضوابط للمستخدم على ما يستطيع الوكيل الوصول إليه أو تنفيذه. (openai.com)
ما الفرق بين متصفح AI والمتصفح التقليدي؟
وجود ميزات ذكاء اصطناعي لا يلغي الوظائف الأساسية للمتصفح، لكنه يضيف طبقة جديدة فوقها.
| المتصفح التقليدي | متصفح الذكاء الاصطناعي |
| يعرض صفحات الويب | يعرض الصفحة ويمكنه تحليل محتواها |
| المستخدم ينفذ الخطوات بنفسه | يمكن لـAI تنفيذ بعض الخطوات |
| البحث يعتمد أساسًا على الاستعلام والنتائج | يمكن تحويل البحث إلى حوار ومهمة |
| المقارنة بين المواقع يقوم بها المستخدم | يمكن للنظام جمع المعلومات ومقارنتها |
| الصفحة هي محور التفاعل | الهدف الذي يطلبه المستخدم قد يصبح محور التفاعل |
| الأتمتة تحتاج عادةً إلى أدوات إضافية | قد تكون قدرات الأتمتة مدمجة في المتصفح |
لكن الحدود ليست ثابتة؛ إذ أصبحت المتصفحات التقليدية نفسها تضيف ميزات AI، ولذلك قد يتقلص الفرق بين الفئتين مع الوقت.
ما الفرق بين محرك بحث AI ومتصفح AI؟
قد يبدو الاثنان متشابهين لأن كليهما يستطيع الإجابة عن الأسئلة باستخدام معلومات من الإنترنت.
لكن محرك البحث بالذكاء الاصطناعي يركز أساسًا على الوصول إلى المعلومات والإجابة عن الاستعلامات، بينما يعمل المتصفح على مستوى أوسع من تجربة الويب.
المتصفح يعرف الصفحة المفتوحة وعلامات التبويب، وقد يمتلك — وفق الصلاحيات الممنوحة له — القدرة على التفاعل مع عناصر الموقع.
ولهذا يستطيع متصفح AI الانتقال نظريًا من سؤال مثل:
“ما أفضل الخيارات المتاحة؟”
إلى مهمة مثل:
“قارن الخيارات وفق شروطي وساعدني على إكمال الخطوات”.
وهذا التحول من استرجاع المعلومات إلى تنفيذ الإجراءات هو أحد أهم الاتجاهات الحالية في تطور التصفح.
هل تستطيع متصفحات الذكاء الاصطناعي الضغط والكتابة بدلًا منك؟
في الأنظمة التي توفر قدرات Agentic Browsing، نعم، ضمن الحدود التي يسمح بها المتصفح والموقع.
يحتاج النظام في هذه الحالة إلى معرفة العناصر التي يمكن التفاعل معها، مثل الحقول والأزرار والقوائم والروابط، ثم اختيار الإجراء المناسب.
يمكن أن يستخدم لذلك معلومات بنيوية من الصفحة، أو تمثيلًا لعناصر الواجهة، أو قدرات رؤية حاسوبية، أو مزيجًا من عدة تقنيات.
لكن قدرة الوكيل على الضغط على زر لا تعني أنه يجب السماح له بتنفيذ أي شيء دون تدخل المستخدم.
هناك فرق كبير بين فتح نتيجة بحث وبين:
- شراء منتج.
- إرسال رسالة.
- نشر محتوى.
- حذف ملف.
- الموافقة على عقد.
- إدخال بيانات مالية.
ولهذا تعتمد الأنظمة الأكثر حذرًا على نقاط توقف تطلب تأكيد المستخدم قبل بعض الإجراءات الحساسة.
لماذا أصبحت متصفحات الذكاء الاصطناعي مهمة الآن؟
السبب هو التقاء عدة تطورات تقنية في الوقت نفسه.
أصبحت النماذج أفضل في فهم النصوص والصور والواجهات، وظهرت أنظمة تستطيع استخدام الأدوات، بينما انتقلت المنافسة في الذكاء الاصطناعي من من يقدم أفضل إجابة؟ إلى من يستطيع إكمال المهمة؟
المتصفح بيئة مناسبة جدًا لهذا التحول، لأن جزءًا كبيرًا من حياة المستخدم الرقمية يحدث داخله أصلًا: البحث والتسوق والعمل والبريد والخدمات الحكومية والسفر وإدارة الحسابات.
ولهذا أصبح المتصفح موقعًا استراتيجيًا لشركات الذكاء الاصطناعي.
Google توسع Gemini داخل Chrome، وOpenAI دخلت المجال مباشرة عبر Atlas، بينما بنت Perplexity تجربة Comet حول مساعد يستطيع استخدام سياق التصفح وتنفيذ مهام. (blog.google) (openai.com) (perplexity.ai)
ما مخاطر متصفحات الذكاء الاصطناعي؟
كلما حصل الذكاء الاصطناعي على قدرة أكبر على تنفيذ الإجراءات، أصبحت الأخطاء المحتملة أكثر أهمية.
روبوت محادثة يقدم إجابة خاطئة قد يضلل المستخدم، لكن وكيلًا يستطيع التفاعل مع المواقع يمكن أن ينفذ أيضًا إجراءً خاطئًا.
الوصول إلى بيانات حساسة
قد يرى المتصفح معلومات من صفحات مسجل الدخول إليها، أو مستندات أو بريدًا إلكترونيًا أو بيانات شخصية، وفق تصميم المنتج والصلاحيات الممنوحة له.
لذلك تصبح إدارة الصلاحيات والذاكرة والسياق من عناصر الأمان الأساسية.
Prompt Injection
إحدى المشكلات المهمة هي أن التعليمات التي يقرأها الوكيل قد لا تأتي من المستخدم فقط.
يمكن لصفحة ويب أن تحتوي على نص أو محتوى مصمم لمحاولة التأثير في سلوك النموذج. ويعرف هذا النوع من المخاطر باسم Prompt Injection.
وقد حذرت OpenAI عند إطلاق Atlas من أن الوكلاء الذين يتصفحون الويب يواجهون مخاطر Prompt Injection، وأنه رغم إضافة وسائل حماية، لا يمكن ضمان إيقاف جميع الهجمات من هذا النوع. (openai.com)
المشكلة تصبح أكثر حساسية عندما يستطيع النموذج تنفيذ إجراءات بدل الاكتفاء بقراءة المحتوى.
تنفيذ إجراء غير مقصود
قد يسيء الوكيل فهم طلب المستخدم، أو يختار نتيجة غير صحيحة، أو يتفاعل مع عنصر لم يكن المقصود استخدامه.
لذلك لا ينبغي التعامل مع AI Browser على أنه مستخدم بشري معصوم من الخطأ.
هل يمكن لموقع ويب أن يخدع وكيل الذكاء الاصطناعي؟
هذا أحد الأسئلة الأمنية الجديدة التي ظهرت مع توسع الوكلاء.
الويب صُمم أساسًا ليقرأه البشر والمتصفحات التقليدية، لكن الوكيل يحاول تفسير المحتوى باعتباره جزءًا من البيئة التي يعمل داخلها.
وهنا يمكن أن تختلط المعلومات مع التعليمات.
قد يرى النموذج نصًا موجودًا داخل صفحة ويحاول التعامل معه كتوجيه يجب تنفيذه، رغم أن هذا النص لم يصدر عن المستخدم.
وتصبح المشكلة أخطر إذا امتلك الوكيل صلاحية الوصول إلى مواقع أخرى أو تنفيذ إجراءات حساسة.
لهذا لا يعتمد أمن المتصفحات الوكيلة على جودة نموذج الذكاء الاصطناعي فقط، بل يحتاج أيضًا إلى فصل الصلاحيات، والتحقق من الإجراءات، وتقييد الوصول، وطلب موافقة المستخدم عند النقاط الحساسة.
هل يعني AI Browser نهاية المتصفحات الحالية؟
الأقرب أن يتغير تعريف المتصفح نفسه بدل أن تختفي المتصفحات التقليدية فجأة.
فالخصائص التي كانت تميز “متصفح AI” بدأت تدخل بالفعل إلى المتصفحات المعروفة.
إذا أصبحت القدرة على سؤال الصفحة، ومقارنة علامات التبويب، وتنفيذ بعض المهام جزءًا طبيعيًا من Chrome أو غيره، فلن يحتاج المستخدم بالضرورة إلى التفكير في فئة منفصلة اسمها متصفحات الذكاء الاصطناعي.
التحول الأعمق هو في واجهة استخدام الإنترنت.
منذ عقود، كانت العملية:
اكتب عنوانًا → افتح موقعًا → ابحث → اضغط → اقرأ → نفّذ.
أما النموذج الجديد فيحاول اختصار جزء من هذه السلسلة إلى:
اشرح ما تريد تحقيقه → دع النظام يبحث وينفذ الخطوات → راجع النتيجة ووافق عند الحاجة.
هل سيتصفح الذكاء الاصطناعي الإنترنت بدلًا منا؟
في بعض المهام، بدأ ذلك يحدث بالفعل.
لكن من غير المرجح أن يصبح المستخدم مجرد متفرج على وكيل يتخذ جميع القرارات نيابة عنه. فهناك مهام تحتاج إلى حكم بشري، وأخرى تتطلب موافقة قانونية أو مالية، ومواقف لا يستطيع النموذج فهم تفاصيلها بصورة موثوقة.
الأكثر احتمالًا هو ظهور مستويات مختلفة من التفويض.
قد نسمح للذكاء الاصطناعي بجمع عشرات الخيارات وتلخيصها، ثم نختار بأنفسنا. وفي مهمة أخرى قد نسمح له بملء البيانات، لكن نحتفظ بالضغط النهائي على زر التأكيد.
وهكذا يتحول المتصفح تدريجيًا من نافذة نستخدمها للوصول إلى الإنترنت إلى وسيط ذكي يستطيع فهم الهدف والمساعدة في تحقيقه.
وإذا استمر تطور المتصفحات الوكيلة، فقد تصبح المنافسة القادمة في سوق المتصفحات أقل ارتباطًا بسرعة تحميل الصفحة وحدها، وأكثر ارتباطًا بالسؤال: إلى أي درجة يمكن أن نثق بالمتصفح كي يعمل نيابة عنا؟