اطلب معاودة الاتصال

ما الذي يستشهد به وضع الذكاء الاصطناعي في جوجل عندما يسأل مريض سعودي بالعربية

Svg
  • مدة القراءة 58 دقيقة
  • لخّص باستخدام الذكاء الاصطناعي
  • 24 سبتمبر 2026

اطرح سؤالًا صحيًا سعوديًا مرتين، بالعربية والإنجليزية، وستجد أن الإجابتين لا تستندان إلى شيء مشترك تقريبًا. عبر 40 زوجًا متطابقًا سجّلنا 753 استشهادًا، وبلغ متوسط تداخل النطاقات بين الإجابات المتقابلة 0.149.

أربعة عشر زوجًا من الأربعين لم تشترك في أي مصدر على الإطلاق.

ما وجدناه

  • اللغتان بالكاد تتقاطعان. متوسط التداخل 0.149 عبر 40 زوجًا، وأربعة عشر زوجًا لا تشترك في شيء.
  • اسأل «مَن الأفضل» بالعربية، فتختفي المؤسسات. استشهاد واحد فقط من أصل 121 استشهادًا عربيًا جاء من مؤسسة.
  • بالعربية تأتي الإجابة ممن يبيع شيئًا. الصفحات التجارية تستحوذ على 69.3% من الاستشهادات العربية، و58.2% من الإنجليزية.
  • والمؤسسات في الاتجاه المعاكس. 9.1% من المجموعة العربية، و24.0% من الإنجليزية.
  • التصدر في المركز الأول لا يجعلك مُستشهدًا بك. في الأسئلة الـ 19 التي يكون فيها هذا المختبر النتيجة العضوية الأولى، ظهر في 63.2% من الإجابات العربية.
  • ليست خاصية لدى مزود واحد. يُسقط ChatGPT حصته المؤسسية العربية بـ 14.2 نقطة، وجوجل بـ 14.9. الاتجاه يتكرر، أما الحجم فلا.

عن هذا الإصدار

هذا إصدار مرحلي من عيّنة أسئلة ثابتة لا نزال نجمعها. لدينا 87 عملية التقاط عبر 49 سؤالًا مختلفًا، لذا تعامل مع كل فترة ثقة في هذه الصفحة على أنها واسعة عن قصد.

وأُجري ذراع تكرار منفصل من ثلاث عشرة عملية التقاط في 10 سبتمبر لقياس مقدار ما يعود من كل هذا إلى مجرد التباين بين عملية تشغيل وأخرى.

وله أقسامه الخاصة أدناه، وهو مستبعد من كل رقم مجمّع في هذه الصفحة، لأن أسئلته تظهر أصلًا في العيّنة، وعدّها مرتين لن يمنحك نسبة يمكنك إعادة إنتاجها.

وأعادت ست عمليات التقاط أخرى إجابات مكتملة لا تحمل أي استشهادات على الإطلاق، وهي موجودة في data/zero-citation-captures.csv، لأن مجموعة بيانات على مستوى الاستشهادات لا تستطيع تمثيل عملية التقاط لم تنتج أيًّا منها. وفي سؤال واحد، عن أفضل طبيب أطفال في الرياض، فعل ذراعا اللغتين ذلك معًا، وهي المرة الأولى التي يختفي فيها سطح الاستشهادات في اللغتين للسؤال نفسه.

هناك سبعة وعشرون استشهادًا، أي 3.6% من الإجمالي، تعذّر تتبعها إلى وجهتها. استبعدناها من جميع الأرقام على مستوى النطاقات مع إبقائها ضمن عدد الاستشهادات، لأن حذفها كان سيقلّص المقام بصمت ويجمّل كل نسبة مئوية ننشرها.

كل ما هنا مؤرخ، والصفوف الخام تُنشر معه. يمكنك التحقق من أي رقم في هذه الصفحة مقابل مجموعة البيانات الكاملة على مستوى الاستشهادات، صف لكل استشهاد، بدلًا من أن تأخذ كلامنا على علّاته.

لماذا أجرينا هذه الدراسة

لم ينشر أحد قياسًا أصليًا لاستشهادات البحث العربي بالذكاء الاصطناعي. وقد تحققنا مرتين قبل كتابة هذه الجملة، عبر قواعد البيانات الأكاديمية ومنشورات القطاع، باللغتين.

دراسة Profound التي شملت 3.25 مليار استشهاد تغطي 14 دولة لكنها تقدّم مزيج المنصات لا لغة المصدر، ودراسة Temso بسبع لغات تستبعد العربية صراحةً، ودراسة Weglot تغطي أربع لغات ليس بينها العربية.

نحن نُدير Delta Medical Laboratories، وهو مختبر سعودي يحتل المركز الأول على Google.com.sa في 355 من أصل 628 كلمة مفتاحية متتبعة في ملف تتبع أغسطس 2026، و453 ضمن أفضل ثلاث نتائج. وتنقسم المجموعة المتتبعة إلى 257 كلمة مفتاحية تجارية، 138 منها في المركز الأول، و371 معلوماتية، 217 منها في المركز الأول.

وهذا يمنح الدراسة شيئًا لم تملكه أبحاث المزودين، وهو خط أساس موثق للترتيب يُختبر الاستشهاد مقابله، بدلًا من افتراض بشأن مَن يستحق أن يُستشهد به.

فرضيتنا

إذا كان الويب العربي يعادل تقريبًا جزءًا من ثمانين من حجم الويب الإنجليزي، فإن إجابات الذكاء الاصطناعي العربية ستعتمد على مصادر إنجليزية بمعدل أعلى بكثير من اعتماد الإجابات الإنجليزية على مصادر عربية.

بيشوي عادل، رئيس قسم SEO وGEO في VOCTOS

كنا مخطئين في الاتجاه، والطريقة التي أخطأنا بها هي النتيجة نفسها.

لم تلجأ الإجابات العربية إلى المؤسسات الإنجليزية، بل إلى صفحات تجارية عربية، وحيث لم توجد صفحة عربية مناسبة صنع النظام واحدة بدلًا من أن يخفض معياره.

المنهجية

وضع الذكاء الاصطناعي في جوجل، دون تسجيل دخول، ودون سجل محادثات، وتشغيل واحد لكل أمر.

طُرح كل سؤال من أسئلة العيّنة الأربعين باللهجة الخليجية العامية وبالإنجليزية في غضون دقائق من بعضهما. واللهجة الخليجية العامية هي المستوى اللغوي الذي تُكتب به هذه الأسئلة فعلًا.

جرى الجمع في 9 و10 سبتمبر 2026. ويُشار إلى السوق السعودي داخل نص الاستعلام، بالطريقة التي يكتبها بها الشخص، لا عبر مصدر الطلب.

ثلاث خطوات في هذا المسار لا تظهر في أي دراسة منشورة استطعنا العثور عليها، وكلٌّ منها يحرّك الأرقام بما يكفي لتغيير عنوان رئيسي.

تتبع إعادة التوجيه. يُخفي Google AI Mode كل وجهة خلف /goto رمز يبلغ نحو 114 حرفًا. لا يُفك ترميزه بـ base64 إلى رابط، ولا يستطيع fetch() قراءته من سياق الصفحة.

الطريق الوحيد إلى النطاق الحقيقي هو تتبع إعادة التوجيه وتسجيل المكان الذي يصل إليه المتصفح. وأي دراسة قرأت DOM وتوقفت عنده لم تكن تعرف النطاقات التي كانت تعدّها.

إزالة التكرار. حملت عملية التقاط واحدة 35 رابطًا أفضت إلى 19 وجهة فريدة، وحملت أخرى 20 أفضت إلى 6. وعدّ الروابط بدلًا من الوجهات يضخّم إجمالي الاستشهادات نحو ثلاثة أضعاف، لذا نعدّ الوجهات الفريدة لكل إجابة والنطاقات القابلة للتسجيل الفريدة كلًّا على حدة.

رفض عمليات الالتقاط الفارغة. أعادت إحدى عمليات التشغيل صفر روابط لأن جوجل رفضت تقديم وضع الذكاء الاصطناعي أصلًا، وفي جدول البيانات يبدو ذلك الصف مطابقًا لإجابة لم تستشهد بشيء. ولا تكون عملية الالتقاط الخالية من الاستشهادات صالحة إلا حين يكون نص الإجابة موجودًا.

وظهر قيدان إضافيان أثناء الجمع، وكلاهما كلّفنا بيانات. فرموز إعادة التوجيه تنتهي صلاحيتها خلال دقائق من الالتقاط.

كما أن تتبعها تنقّلًا تلو الآخر يُطلق تقييد المعدل، وهذا وحده أتلف 15 من 27 استشهادًا عبر عمليتي التقاط قبل أن نغيّر المنهجية. وقد حلّ التتبع على دفعات من خمسة إلى ستة تنقلات في كل جولة المشكلة، فتتبعت عملية الالتقاط التالية 19 من 19.

وكلا نمطي الإخفاق مسجّلان في مجموعة البيانات بوصفهما UNRESOLVED-<reason> بدلًا من استبعادهما. فيبقى المقام صادقًا.

هل تستشهد اللغتان بالمصادر نفسها؟

في الغالب لا. فعبر 40 زوجًا متطابقًا يبلغ متوسط تداخل Jaccard على النطاقات القابلة للتسجيل 0.149، بفترة ثقة 95% بطريقة bootstrap من 0.100 إلى 0.204.

نحو ستة من كل سبعة مصادر وراء الإجابة العربية غائبة عن توأمها الإنجليزي. وأربعة عشر زوجًا لا تشترك في أي شيء على الإطلاق.

وتتسع الفجوة كلما ابتعد الموضوع عن أي شيء دوّنته مؤسسة.

فئة السؤالالأزواجمتوسط Jaccard
مؤسسي10.333
اختيار مقدم الخدمة230.185
السعر والحجز60.123
الحالة والأعراض50.075
تفسير نتائج الفحوص50.050

حافظ الصفّان الأخيران على مكانهما عبر أربع جولات جمع. فالأسئلة التي لها إجابة مرجعية معتمدة هي حيث تتباعد اللغتان أكثر، وهذا هو الجزء من هذا الترتيب الذي نستطيع الدفاع عنه.

صف مقدمي الخدمة غير مستقر، ولم نعد نقرؤه كدرجة في السلّم. كان عند 0.146، أسفل السعر بقليل، إلى أن أضافت الموجة الثانية أسئلة عن مستشفيات المدن. فجاء أفضل مستشفى في الدمام عند 0.571، وأفضل مستشفى في جدة عند 0.500، والمختبرات في الدمام عند 0.375، مما رفع متوسط الفئة إلى 0.195. فالمستشفى المسمّى في مدينة مسمّاة قائمة قصيرة من كيانات كبيرة تستطيع اللغتان العثور عليها، وهي مشكلة استرجاع مختلفة عن «أفضل مختبر في الرياض» عند 0.000، ودمج الاثنين في رقم واحد للفئة يُخفي ذلك.

وقد زادت أسئلة «الأفضل» الأربعة التالية هذه الصورة وضوحًا، وعاكست القراءة التي كانت لدينا. فقد سألت عن أفضل طبيب أسنان، وطبيب عظام، وعيادة أسنان، وعيادة جلدية بدلًا من أفضل مستشفى، وجاءت عند 0.000 و0.000 و0.167 و0.333. إذن ليست الصياغة التجارية ما يجعل اللغتين تتقاربان، بل حجم الكيان الذي يدور حوله السؤال.

فالمستشفيات الكبيرة في المدينة قائمة عامة قصيرة، أما عيادات الأسنان فيها فقائمة خاصة طويلة، وتختار كل لغة عيادات مختلفة منها. والفئة الآن 23 زوجًا من ثلاثة أنواع مختلفة بوضوح على الأقل، ومتوسطها 0.185. وأضافت الدورة 14 نوعًا ثالثًا وخفّضت المتوسط مجددًا: سجّل أفضل مركز أشعة ورنين مغناطيسي في الرياض 0.000، وأفضل مختبر في مكة 0.143، وسؤال عن القرب، «هل يوجد مختبر قريب مني في جدة»، 0.250.

لذا فالنسخة الصادقة من هذا التدرج أضيق من تلك التي حملتها هذه الصفحة من قبل. الأمر ليس أن أسئلة مقدمي الخدمة تقع بين السعر والحالة، بل أن أسئلة تفسير الفحوص والحالات تقع في القاع باستمرار، وكل ما فوقها مختلط.

أسئلة المستشفيات والفحص قبل الزواج تشترك في moh.gov.sa عبر اللغتين، لأن الوزارة تنشر باللغتين. أما سؤال الغدة الدرقية فلا يشترك في شيء: أعادت الإنجليزية هيئة الخدمات الصحية البريطانية (NHS) ومستشفى سويسريًا وثلاث عيادات أمريكية، بينما أعادت العربية الجزيرة ومستشفيين تركيين ومجموعة مستشفيات مصرية.

الإجابات العربية والإنجليزية نادرًا ما تشترك في مصدر تداخل Jaccard للنطاقات المُستشهد بها، للسؤال نفسه باللغتين. المتوسط 0.149، وفترة الثقة 95% بطريقة bootstrap من 0.1 إلى 0.204. 0 0.1 0.2 0.3 0.4 best_doctor_riyadh 0.667 best_hospital_dammam 0.571 best_hospital_jeddah 0.5 labs_dammam 0.375 premarital 0.357 best_ivf_ksa 0.357 المستشفيات، الرياض 0.333 best_derma_clinic_jeddah 0.333 pcr_riyadh 0.273 best_physio_riyadh 0.273 lab_near_me_jeddah 0.25 فحص CBC 0.2 best_maternity_jeddah 0.2 أعراض السكري 0.182 best_dental_clinic_riyadh 0.167 best_lab_mecca 0.143 cholesterol 0.111 checkup_cost 0.105 best_homelab_riyadh 0.091 نقص فيتامين د 0.083 مختبر في جدة 0.071 best_hospital_riyadh 0.071 lab_accreditation 0.067 best_center_jeddah 0.062 المختبرات في السعودية 0.053 ferritin 0.048 أعراض جرثومة المعدة 0 vitd_price 0 المستوى الطبيعي لفيتامين د 0 مختبر في الرياض 0 rdw_high 0 tsh 0 hairloss 0 lab_accuracy 0 thyroid_women 0 best_derma_riyadh 0 best_dentist_jeddah 0 best_ortho_riyadh 0 best_radiology_riyadh 0 dental_implant_price_riyadh 0 أبحاث VOCTOS، 40 زوجًا متطابقًا، Google AI Mode، 9 سبتمبر 2026. القيمة 1.0 تعني مجموعات مصادر متطابقة.
الإجابات العربية والإنجليزية نادرًا ما تشترك في مصدر. تداخل Jaccard للنطاقات المُستشهد بها، للسؤال نفسه باللغتين. المتوسط 0.149، وفترة الثقة 95% بطريقة bootstrap من 0.1 إلى 0.204.

مَن يجيب فعلًا، عيادة أم مؤسسة؟

بالعربية، عيادة في الغالبية الساحقة. فالصفحات المملوكة تجاريًا حملت 69.3% من الاستشهادات العربية، بفترة ثقة Wilson 95% من 64.3 إلى 73.9 عبر 352 استشهادًا، مقابل 58.2% بالإنجليزية بفترة من 52.8 إلى 63.3 عبر 337.

أما المؤسسات الطبية والناشرون والجهات الصحية فتسير في الاتجاه المعاكس: استحوذت على 9.1% من المجموعة العربية و24.0% من الإنجليزية.

هاتان الفترتان، من 6.5 إلى 12.6 ومن 19.8 إلى 28.9، لا تقتربان من التلامس. وهي المقارنة الوحيدة في هذا الإصدار التي ندافع عنها بحجم العينة هذا.

أدت إضافة اثني عشر سؤالًا تجاريًا صريحًا من نوع «الأفضل» إلى خفض الحصة المؤسسية العربية من 13.8% إلى 9.1%. وهذا هو الاتجاه المتوقع، ويوضح القسم الخاص بالنية التجارية أدناه السبب.

في فئة تعاملها جوجل كفئة عالية الخطورة بالإنجليزية، يُجيب عن الجانب العربي إلى حد كبير أشخاص يبيعون شيئًا.

الإجابة العربية تجارية، والإجابة الإنجليزية مؤسسية حصة الاستشهادات حسب نوع المصدر، مع فترات ثقة Wilson 95%. 0% 20% 40% 60% 80% 100% المؤسسات، بالعربية n=352 9.1% [6.5 إلى 12.6] المؤسسات، بالإنجليزية n=337 24.0% [19.8 إلى 28.9] مملوكة لعلامات تجارية، بالعربية n=352 69.3% [64.3 إلى 73.9] مملوكة لعلامات تجارية، بالإنجليزية n=337 58.2% [52.8 إلى 63.3] أبحاث VOCTOS، Google AI Mode، 9 سبتمبر 2026. لا يتداخل أيٌّ من زوجي الفترات.
الإجابة العربية تجارية، والإجابة الإنجليزية مؤسسية. حصة الاستشهادات حسب نوع المصدر، مع فترات ثقة Wilson 95%.

إلا في السعر، حيث تبيع اللغتان

ذلك العنوان متوسط لأربعة أنواع مختلفة جدًا من الأسئلة، والمتوسط يُخفي أكثر ما فيه فائدة. وعند تقسيمه حسب الفئة، تبدو حصة المؤسسات والجهات الحكومية على هذا النحو.

فئة السؤالبالعربيةالإنجليزيةالفجوةالفترات
تفسير نتائج الفحوص16.3%60.0%43.7 نقطةمنفصلة
اختيار مقدم الخدمة3.4%15.4%12.0 نقطةمنفصلة
الحالة والأعراض22.8%48.7%25.9 نقطةمتداخلة
السعر والحجز7.5%10.1%2.6 نقطةمتداخلة

في السعر يختفي الأثر. فالعربية تجارية بنسبة 69.8% والإنجليزية 68.1%، والحصة المؤسسية أقل من 11% في كلتيهما.

والسبب ليس لغويًا. فلا وزارة ولا مجلة علمية ولا كلية طب تنشر تكلفة فحص فيتامين د في الرياض.

لا يوجد مصدر مؤسسي تلجأ إليه أيٌّ من اللغتين، فتذهب الإجابتان إلى من نشر سعرًا.

وهذا جدير بالتمسك به، لأنه يقلب النصيحة المعتادة.

في أسئلة الأسعار لا تنافس Mayo Clinic بالإنجليزية، بل تنافس النوع نفسه من المواقع التي تنافسها بالعربية، مما يجعل الإنجليزية الأرخص بين اللغتين للدخول.

اسأل «مَن الأفضل» بالعربية، فتكاد المؤسسات تختفي

واحد من 121. هذا هو عدد الاستشهادات المؤسسية والحكومية عبر سبعة عشر سؤالًا عربيًا من نوع «الأفضل»، والواحد هو moh.gov.sa في سؤال أفضل مستشفى في الدمام.

أما الجانب الإنجليزي من الأسئلة السبعة عشر نفسها فأعاد خمسة، من أصل 95 استشهادًا.

أضفنا أول أربعة من هذه الأسئلة في 10 سبتمبر لأن بنك الأسئلة الأصلي كان يميل إلى الأسئلة المعلوماتية، والمشتري لا يكتب «كيف تختلف المختبرات في الدقة»، بل يكتب «الأفضل».

وأضافت الموجة الثانية ثلاثة عشر سؤالًا آخر، أربعة عن المستشفيات ثم تسعة عن العيادات والتخصصات والمختبرات والأطباء المسمّين، وهي سبب اختلاف هذا القسم عن النسخة المنشورة صباح اليوم.

أسئلة مقدمي الخدمةبالعربيةالإنجليزية
صياغة «الأفضل»، المؤسسات والجهات الحكومية0.8% من 1215.3% من 95
صياغة «الأفضل»، المملوكة تجاريًا75.2%72.6%
صياغة «الأفضل»، الأدلة والمجمّعات14.9%11.6%
أسئلة أخرى عن مقدمي الخدمة، المؤسسات والجهات الحكومية7.5% من 6728.6% من 56

قالت نسخة سابقة من هذا القسم صفرًا من 41، وجعلت ذلك عنوانًا رئيسيًا. كان ذلك الرقم صحيحًا للأسئلة الأربعة التي كانت في بنك الأسئلة حينها، ولم يصمد أمام الأربعة التالية. فالتوسع من المختبرات والأطباء إلى المستشفيات أدخل صفحة وزارية واحدة إلى المجموعة العربية. والنتيجة المصاغة كغياب تفصلها ملاحظة واحدة عن الخطأ، وهذا ما حدث هنا. وقد بقي العدد العربي عند واحد بالضبط عبر ثلاثة عشر سؤالًا إضافيًا منذ ذلك الحين، لذا فالحصة تتراجع الآن مع نمو المقام لا مع ارتفاع العدد.

ما يصمد بعد التوسع هو الشكل لا الصفر. فنسبة 0.8% العربية تحمل فترة Wilson من 0.1 إلى 4.5، ونسبة 5.3% الإنجليزية فترة من 2.3 إلى 11.7، ولم تعودا منفصلتين: فهما تتداخلان بين 2.3 و4.5.

نقدّم التداخل بدلًا من الانفصال السابق. وما لا شك فيه بحجم العينة هذا هو الحصة التجارية، 75.2% من استشهادات «الأفضل» العربية مقابل 72.6% بالإنجليزية، وحقيقة أن ستة عشر من سبعة عشر سؤالًا عربيًا من نوع «الأفضل» لم تُعِد أي مصدر مؤسسي على الإطلاق.

تجيب اللغتان عن سؤال «الأفضل» من اقتصادين مختلفين. تلجأ الإنجليزية إلى ناشري التصنيفات ومجمّعي المراجعات: تصنيفات المستشفيات من Newsweek أربع مرات، ومن Statista مرة واحدة، و zavis.ai ثلاث مرات. أما العربية فتلجأ إلى منصات الحجز والأنشطة التجارية نفسها: delta-medlab.com سبع مرات، instagram.com و saudi.vezeeta.com خمس مرات لكلٍّ منهما، ثم tebcan.com وموقع المستشفى imc.med.sa أربع مرات لكلٍّ منهما.

سؤال أفضل طبيب هو الحالة القصوى. فعند طرحه بالعربية أعاد تسعة استشهادات عبر نطاقين اثنين بالضبط، كلاهما منصة لحجز المواعيد. لا مستشفى، ولا وزارة، ولا سجل مهني.

إذن فالكيان الذي يُوصى به حين يسأل مريض سعودي عن أفضل طبيب بالعربية هو من تُدرجه منصات الحجز، ومنصات الحجز تُدرج من يدفع ليُدرج.

هذه مشكلة تنافسية مختلفة عن تصدر صفحة عيادة، وهي التي تستحق الحل أولًا إن كانت إيراداتك تعتمد على استعلامات «الأفضل».

النتيجة تصمد أمام خيار الترميز الوحيد الذي كان يمكن أن يصنعها. تصنيفات المستشفيات من Newsweek مرمّزة كأخبار، و zavis.ai كدليل، لا كمؤسسات طبية، لأن منتج التصنيف إعلام تجاري. أعد ترميز الاستشهادات الثمانية كلها من نوع «الأفضل» كمؤسسات، فترتفع النسبة الإنجليزية من 5.3% إلى 13.7%، بينما لا تتحرك النسبة العربية إطلاقًا، لأن كل استشهاد بمنتج تصنيف في مجموعة «الأفضل» إنجليزي. إذن فقرار الترميز يوسّع الفجوة ولا يصنعها، والاتجاه صامد في الحالتين.

تحذير واحد قبل أن يقتبس أحد هذا: سبعة عشر سؤالًا، و121 استشهادًا عربيًا و95 إنجليزيًا، التُقطت على مدى يومين. الاتجاه واضح والعينة صغيرة، والحقيقتان متلازمتان.

إجابة «أفضل مستشفى» مبنية من الخريطة، لا من المقالات

في أسئلة المستشفيات الأربعة التي أُضيفت في الموجة الثانية، جاءت كل وجهة تتبعناها تقريبًا من شريط الأماكن بجانب الإجابة لا من شارة استشهاد داخل النص. واحد وثلاثون من ثلاثة وثلاثين كانت أزرار «الموقع الإلكتروني» في بطاقة نشاط تجاري، واثنان فقط كانا استشهادين داخل النص.

وهذا يغيّر ما تصفه نتيجة «الأفضل» أعلاه. فحين يجيب المحرك من شريط الكيانات فهو يقرأ سجلات أنشطة تجارية لا مستندات، لذا فما يحسم من يظهر هو اكتمال الملف، والفئة، والموقع، والمراجعات. والنشر لا يصل إلى ذلك السطح إطلاقًا.

ويفسر ذلك أيضًا اثنتين من أعلى ثلاث درجات في جدول التداخل كله: سجّل أفضل مستشفى في جدة 0.500 وأفضل مستشفى في الدمام 0.571، مقابل متوسط العيّنة 0.149. فشريط الأماكن جغرافي لا لغوي، لذا يتقارب ذراعا اللغتين على القائمة القصيرة نفسها من الأنشطة المحلية.

وأسئلة العيادات الأربعة التالية تقيّد ذلك. أفضل طبيب أسنان في جدة، وأفضل طبيب عظام في الرياض، وأفضل عيادة أسنان في الرياض، وأفضل عيادة جلدية في جدة، أظهرت كلها شريط أماكن أيضًا، وسجّلت الأربعة كلها أقل من كل زوج من أزواج المستشفيات: 0.000 و0.000 و0.167 و0.333. إذن فالشريط الدوّار وحده لا يُجبر اللغتين على الإجابة نفسها، بل يفعل ذلك فقط حين تكون قائمة الأنشطة المرشحة قصيرة. ففي جدة حفنة من المستشفيات الكبيرة ومئات من عيادات الأسنان، وفي النوع الثاني من الأسئلة يخرج ذراعا اللغتين بعيادات مختلفة تمامًا.

نقدّم هذا كتحفّظ على عنواننا الرئيسي نفسه لا كنتيجة منفصلة. فقاعدة الاستخراج لدينا تعدّ كل وجهة وراء رابط /goto ولا تميّز بين السطحين، ولم تُرمَّز الموجة الأولى حسب السطح قط، ولم تُرمَّز عمليات التقاط العيادات الأربع أعلاه أيضًا، لذا لا نستطيع بعد أن نقول كم من العيّنة مصدره الشريط الدوّار.

تحمل عمليات التقاط المستشفيات في الموجة الثانية هذا الترميز في data/citation-surface-w2.csv. والعودة إلى البقية هي المهمة التالية، وحتى تكتمل ينبغي قراءة المتوسط على أنه يغطي نوعي الاستشهاد معًا.

النصفان سعوديان، لكنهما ليسا النصف نفسه

هذه هي النتيجة التي لم نتوقعها، وهي تُسقط النسخة المبسطة من روايتنا نفسها. فقد استحوذت المصادر السعودية على 65.6% من الاستشهادات العربية، 231 من 352، و55.2% من الإنجليزية، 186 من 337.

الإنجليزية ليست قناة للمصادر الأجنبية في سؤال سعودي، فنصفها سعودي أيضًا.

الفرق فيما يملأ النصف الآخر. فالباقي غير السعودي في العربية عربي إقليمي، بـ 24 استشهادًا مصريًا و22 أردنيًا، وقليل من تركيا وقطر والكويت والإمارات. أما الباقي في الإنجليزية فناطق بالإنجليزية، بـ 71 من الولايات المتحدة و17 من المملكة المتحدة و13 من الهند.

إذن فالإجابتان ليستا محلية في مقابل عالمية، بل شبكتا إنترنت إقليميتان تصادف أن تتقاطعا على الأرض السعودية وتتباعدا في كل مكان آخر.

المختبر السعودي الذي ينافس في الإجابة العربية ينافس القاهرة وعمّان، وفي الإجابة الإنجليزية ينافس كليفلاند ولندن.

أي نوع من المصادر يصمد أمام تبديل اللغة؟

نشاط تجاري سعودي، لا مؤسسة. فمن أصل 284 نطاقًا في مجموعة البيانات هذه، استُشهد بـ 54 فقط باللغتين، أي 19.0%. وظهر ثمانية وتسعون بالعربية فقط، و132 بالإنجليزية فقط.

وتتوزع النطاقات الـ 54 العابرة للغتين إلى 38 موقعًا مملوكًا تجاريًا، و5 أدلة، و4 ناشرين طبيين، و4 منصات تواصل اجتماعي، وصفحتين حكوميتين، وموقع إخباري واحد.

إذن فالمجموعة ثنائية اللغة ليست ما قد تخمّنه، وليست المرجعيات العالمية.

Mayo Clinic وCleveland Clinic والأكاديمية الأمريكية لأطباء الأسرة وSt Jude هم الناشرون الأربعة الوحيدون في القائمة، وكانوا الأربعة الوحيدين قبل أن تنمو العيّنة بمقدار الثلث.

كل نطاق أضافته الموجة الثانية إلى هذا الجسر كان مقدم خدمة سعوديًا أو منصة تواصل اجتماعي. والبقية شركات سعودية، ووزارة الصحة، والمركز السعودي لاعتماد المنشآت الصحية، وفيسبوك، وإنستغرام.

النطاق الجسري الأكثر استشهادًا به هو delta-medlab.com بـ 39 استشهادًا، متقدمًا على moh.gov.sa بـ 17 و rahahealth.com.sa بـ 15.

إن أردت الظهور في الإجابتين، فالنمط في هذه العينة يقول إن الشرط هو أن تكون كيانًا يتعرّف عليه المحرك باللغتين.

وفي هذا القطاع، المواقع التي تنجح في ذلك هي في الغالب شركات محلية تنشر بالعربية والإنجليزية، لا مؤسسات دولية صادف أنها تُرجمت.

أي مجموعة لغوية أكثر تركّزًا؟

العربية، وهذا عكس ما توقعناه من المدوّنة الأصغر. فالاستشهادات العربية الـ 352 جاءت من 152 نطاقًا، تستحوذ أفضل عشرة منها على 31.8% من المجموعة، بمؤشر هيرفندال (HHI) يبلغ 195.

أما الاستشهادات الإنجليزية الـ 337 فجاءت من 186 نطاقًا، بحصة 19.9% لأفضل عشرة، وHHI يبلغ 92.

كنا نفهم الأمر بالعكس. فبحسب HHI، المجموعة العربية أكثر تركّزًا من الإنجليزية بـ 2.1 مرة، على الأسئلة نفسها، وبفارق دقائق، وفي المنتج نفسه.

النطاق العربي الأكثر استشهادًا به هو delta-medlab.com بـ 32 استشهادًا، متقدمًا على altibbi.com بـ 15 و magrabihealth.com بـ 10. وDelta عميل لدينا. كما أن أسئلة مقدمي الخدمة تتكرر عبر ثلاث مدن في بنك الأسئلة هذا، لذا اقرأ هذا الرقم كخاصية لهذه العينة لا للسوق.

كل توسيع حتى الآن خفّف تركّز المجموعتين، فانخفض HHI العربي من 299 إلى 260 إلى 234 إلى 214 إلى 190، لأن إجابات «الأفضل» والمستشفيات والعيادات في المدن تمتد أوسع مما امتدت إليه أسئلة المختبرات. وكسرت الدورة 14 هذا المسار: فارتفع المؤشر العربي إلى 195. فعمليات الالتقاط العربية الأربع التي أضافتها كانت ضيقة على نحو غير معتاد، إذ أعادت إحداها استشهادين كلاهما من النطاق نفسه، وعملية الالتقاط المركّزة ترفع المؤشر بدلًا من أن تخففه.

إذن فالتخفيف كان خاصية للأسئلة المضافة لا اتجاهًا، وقد توقفنا عن وصفه كاتجاه. وتحركت النسبة بين اللغتين معه، من 2.0 إلى 2.1.

مجموعة الاستشهادات العربية هي الأكثر تركّزًا بين الاثنتين حصة جميع الاستشهادات التي تستحوذ عليها النطاقات العشرة الأكثر استشهادًا بها. 0% 15% 30% 45% 60% بالعربية 31.8% الإنجليزية 19.9% أبحاث VOCTOS، 9 سبتمبر 2026. HHI العربي 195 عبر 152 نطاقًا، وHHI الإنجليزي 92 عبر 186.
مجموعة الاستشهادات العربية هي الأكثر تركّزًا بين الاثنتين. حصة جميع الاستشهادات التي تستحوذ عليها النطاقات العشرة الأكثر استشهادًا بها.

هل ينتقل التصدر في جوجل إلى إجابة الذكاء الاصطناعي؟

يعتمد ذلك بالكامل تقريبًا على ما يطلبه السؤال. فقد استُشهد بـ Delta في 12 من 25 عملية التقاط عربية لاختيار مقدم الخدمة، أي 48.0% بفترة Wilson من 30.0 إلى 66.5.

وفي عمليات الالتقاط العربية الـ 19 التي تسأل عن الأسعار أو الفحوص أو الحالات، استُشهد به 8 مرات، أي 42.1% بفترة من 23.1 إلى 63.7.

كان رقم مقدمي الخدمة هذا 7 من 7 قبل توسيع بنك الأسئلة، ثم 9 من 11، ثم 9 من 15، ثم 9 من 19، ثم 10 من 22، وهو الآن 12 من 25. وكل عملية التقاط خسرها كانت تسأل عن مستشفى أو طبيب أو عيادة.

وDelta مختبر، لذا لا يستطيع الإجابة عن تلك الأسئلة أصلًا، والتراجع ناتج عن توسيع بنك الأسئلة لا عن تغيير المحرك لرأيه. قسّم الفئة حسب المطلوب، فيتوقف الرقم عن التحرك: تظهر Delta في جميع عمليات الالتقاط العربية الإحدى عشرة الخاصة بمقدمي خدمات المختبرات، وفي واحدة من الأربع عشرة خارجها، وهي أفضل مركز طبي في جدة.

وباتت الفترتان متطابقتين تقريبًا، لذا فالتقسيم كما صيغ لم يعد نتيجة.

القراءة التي تصمد هي القراءة الشرطية: ضمن أسئلة المختبرات يبلغ الانتقال 11 من 11، وخارجها 1 من 14. وهذا هو الرقم الذي ينبغي مراقبته مع مزيد من توسيع بنك الأسئلة، وينبغي التوقف عن استخدام رقم مقدمي الخدمة المجمّع.

وحيث استُشهد بـ Delta كان في الصدارة عادةً، محتلًا المركزين الأول والثاني في سؤال الدمام في الإجابة الإنجليزية كما في العربية.

وحيث غاب، غاب منافسوه في الغالب أيضًا. فسؤال سعر فيتامين د بالإنجليزية أعاد 19 استشهادًا، كلها باستثناء اثنين لمختبر أو مستشفى أو صيدلية سعودية، وليس بينها أي مختبر نتتبعه.

التصدر في المركز الأول ينتقل إلى إجابة الذكاء الاصطناعي في أسئلة مقدمي الخدمة فقط حصة عمليات الالتقاط العربية التي تستشهد بمختبر يحتل المركز الأول على Google.com.sa. 0% 20% 40% 60% 80% 100% أسئلة مقدمي الخدمة n=25 48.0% [30.0 إلى 66.5] كل ما عدا ذلك n=19 42.1% [23.1 إلى 63.7] جميع عمليات الالتقاط العربية n=44 45.5% [31.7 إلى 59.9] أبحاث VOCTOS، Google AI Mode، 9 سبتمبر 2026. العلاقة مع العميل مُفصح عنها في الدراسة.
التصدر في المركز الأول ينتقل إلى إجابة الذكاء الاصطناعي في أسئلة مقدمي الخدمة فقط. حصة عمليات الالتقاط العربية التي تستشهد بمختبر يحتل المركز الأول على Google.com.sa.

ما الذي يشتريه المركز الأول فعلًا

الأرقام أعلاه معدل على مستوى الموقع. وفي 11 سبتمبر عدنا وربطنا كل سؤال عربي بالكلمة المفتاحية في جوجل التي بُني منها، ثم أرفقنا مركز العميل المتتبَّع لتلك الكلمة. ويحمل الآن ستة وعشرون من أصل 47 سؤالًا عربيًا في العيّنة ترتيبًا حقيقيًا، والربط منشور في data/stem-keywords.csv ليكون قابلًا للنقاش.

المركز في أغسطس 2026عمليات الالتقاط العربيةمُستشهَد بهالانتقالفترة الثقة 95%
المركز 1191263.2%41.0 إلى 80.9
المركز 2 أو أدنى7342.9%15.8 إلى 75.0
كل سؤال متتبَّع261557.7%38.9 إلى 74.5
غير متتبَّع إطلاقًا5240.0%11.8 إلى 76.9

اقرأ الصف الأول قبل أي شيء آخر. ففي الأسئلة التي يكون فيها هذا الموقع النتيجة العضوية الأولى، يغيب عن أكثر من ثلث إجابات الذكاء الاصطناعي العربية. هذه هي حجة الدراسة كلها في رقم واحد، وباتت مقيسة لكل سؤال بدلًا من استنتاجها من إجمالي الموقع.

التدرج يسير في الاتجاه الصحيح، لكنه ليس نتيجة. فالفترتان تتداخلان على امتدادهما تقريبًا، وعمليات الالتقاط السبع في الصف الثاني تتضمن ثلاث صيغ لغوية لسؤال جرثومة المعدة نفسه، تشترك في كلمة مفتاحية واحدة وترتيب واحد، ولم يُستشهد بالموقع في أيٍّ منها. تعامل معها كملاحظة واحدة، وسيكون الصف أضعف مما يبدو. ما يدعمه الجدول هو أن المركز الأول لا يضمن الاستشهاد، وما لا يدعمه هو أي ادعاء بشأن قيمة مركز مقارنةً بآخر.

ثلاثة قيود تبقى ملازمة لهذا الجدول. فالترتيبات مؤرخة في أغسطس 2026 وعمليات الالتقاط في 9 و10 سبتمبر، بفارق نحو أسبوعين، وانتقلت كلمة مفتاحية واحدة في المجموعة من المركز الأول إلى الخامس خلال تلك النافذة. وكل سؤال التُقط مرة واحدة، لذا فالسؤال المصنّف دون استشهاد ربما التُقط ببساطة في يوم سيئ، وذراع التكرار يضع تبدّل المصادر بين ليلة وأخرى قرب 40%. والأسئلة الـ 16 التي لا تزال بلا ترتيب هي أسئلة «أفضل X» في الموجة الثانية، التي بُنيت من شبكة قطاعات ومدن لا من كلمة مفتاحية، فلا يوجد ما تُربط به.

أي متغير يحرّك المصادر فعلًا؟

اللغة، وبفارق كبير. أجرينا ثلاث مقارنات مضبوطة على الأسئلة نفسها، كلٌّ منها يغيّر شيئًا واحدًا ويُبقي كل ما عداه ثابتًا.

ما الذي تغيّرالأزواج الصالحةمتوسط Jaccard
لا شيء، السؤال نفسه بعد 24 ساعة80.602
المستوى اللغوي: الخليجية العامية مقابل الفصحى30.472
الصياغة: جملة كاملة مقابل الكلمة المفتاحية المجردة، بالعربية20.258
اللغة: العربية مقابل الإنجليزية400.149

السلّم مطّرد في اتجاه واحد، وطرفاه متباعدان. فإعادة صياغة السؤال بالفصحى تحتفظ بنحو نصف مصادره، واختزاله إلى كلمة مفتاحية يحتفظ بنحو ربعها، وطرحه بالإنجليزية يحتفظ بسُبعها.

الصف العلوي جديد، وهو الصف الذي يجعل الصفوف الثلاثة الأخرى قابلة للقراءة.

كان يمكن لناقد أن يجادل بشكل معقول بأن الفجوة بين اللغتين أثر ناتج عن أمرين مكتوبين بشكل مختلف لا خاصية للغة. لكن طريقتين مختلفتين لكتابة الأمر، داخل لغة واحدة، لا تفتحان فجوة تقترب من ذلك الاتساع.

كم من هذا السلّم مجرد تشويش؟

بما يكفي لحذف صف منه. أعدنا طرح ثلاثة عشر سؤالًا في الساعة نفسها بعد يوم واحد، دون تغيير أي شيء آخر. عاد اثنا عشر منها صالحةً للاستخدام، وفي الجانب العربي بلغ متوسط التداخل مع الالتقاط الأصلي 0.602، بفترة bootstrap من 0.465 إلى 0.733.

هذا هو السقف في هذه الدراسة. فطرح السؤال المطابق مرتين لا يعيد إنتاج مجموعة المصادر المطابقة، لذا لا يمكن قراءة أي شيء هنا بصدق مقابل 1.0 مثالي.

وبعبارة أخرى، نحو 40% من مجموعة المصادر المجمّعة عبر عمليتي التشغيل يظهر في واحدة منهما فقط، مع بقاء السؤال دون تغيير.

ما الذي تغيّرالأزواج الصالحةمتوسط Jaccardالمسافة تحت أرضية التشويش
لا شيء، بفارق 24 ساعة، بالعربية80.602الأرضية نفسها
المستوى اللغوي: من الخليجية إلى الفصحى30.4720.130
الصياغة: من الجملة إلى الكلمة المفتاحية المجردة20.2580.344
اللغة: من العربية إلى الإنجليزية400.1490.453

اللغة هي الأكبر بين الآثار الثلاثة. فعند قياسها كمسافة تحت الأرضية لا تحت 1.0، تبلغ 1.32 ضعف أثر الصياغة و3.48 ضعف أثر المستوى اللغوي.

والقياس مقابل 1.0 كان سيقلل من الثلاثة كلها، لأنه يمنح كل ذراع تداخلًا كان تكرار بسيط سيفقده على أي حال.

ذراع المستوى اللغوي لا يصمد أمام هذا. فمتوسطه البالغ 0.472 يقع داخل فترة الثقة الخاصة بذراع التكرار من 0.465 إلى 0.733. والنتيجة التي تقع داخل نطاق التشويش ليست أثرًا صغيرًا، بل أثر لا نستطيع إثبات وجوده. لقد نشرنا ذلك الذراع كنتيجة في 9 سبتمبر، وهو الآن نتيجة صفرية، وللسلّم ثلاث درجات لا أربع.

أما الصياغة عند 0.258 واللغة عند 0.149 فتقعان كلتاهما تحت الحد الأدنى لذلك النطاق، لذا لا يفسّر أيًّا منهما التباين بين عمليات التشغيل.

هل الإنجليزية أكثر ثباتًا من العربية؟

لا، وكنا نتوقع أن تكون كذلك. جاءت تكرارات الإنجليزية عند 0.545 على أربعة أزواج، مقابل 0.602 للعربية على ثمانية. وفي الأسئلة الثلاثة التي أنتجت فيها اللغتان زوجًا صالحًا، سجّلت العربية 0.624 والإنجليزية 0.549.

الفترتان، من 0.404 إلى 0.658 مقابل من 0.465 إلى 0.733، تتداخلان على امتدادهما تقريبًا. ونقدّم هذا كنتيجة صفرية.

وهذا مهم لطريقة قراءة العنوان الرئيسي. فرقم 0.149 بين اللغتين كان يمكن من حيث المبدأ أن يكون متضخمًا بسبب مقارنة مدوّنة عربية غير مستقرة بمدوّنة إنجليزية مستقرة. لكن الأمر ليس كذلك: فالجانبان يتبدلان بالمعدل نفسه تقريبًا، والفجوة بينهما تصمد رغم ذلك.

التقلب ليس ثابتًا، وهذا هو الجزء المحرج

تتراوح أزواج التكرار العربية بين 0.231 و0.889. فسؤال احتفظ بكل مصادره تقريبًا بين ليلة وضحاها، وآخر احتفظ بأقل من ربعها.

سؤال الاعتماد هو الطرف الأدنى عند 0.231. فعند طرحه في 9 سبتمبر أعاد ستة نطاقات، وبعد يوم أعاد عشرة، يشتركان في ثلاثة.

الجزء المثير هو ما استبدله. فالإجابة الأولى استشهدت بالمركز السعودي لاعتماد المنشآت الصحية، والثانية أسقطته واستشهدت ببوابة CBAHI بدلًا منه، ثم أضافت أربعة مختبرات خاصة وشركة استشارات للشهادات. واحتفظت العمليتان بوزارة الصحة ومستشفى الملك فيصل التخصصي وDelta.

إذن، بين ليلة وضحاها، وفي سؤال عن الجهة التي تعتمد المختبر، غيّر المحرك الجهة الحكومية التي عدّها الإجابة. لم تكن أيٌّ من الإجابتين خاطئة، بل استُمدتا من نصفين مختلفين من الجهاز الحكومي نفسه.

تساقط الشعر هو الطرف الأعلى عند 0.889، وتكراره مجموعة جزئية صارمة من الأصل: ثمانية من تسعة نطاقات بقيت، وسقط واحد، ولم يُضف شيء جديد.

إذن فرقم واحد لثبات المحرك شكل خاطئ لهذا الأمر. فما يمكن لصفحة أن تتوقع الاحتفاظ به بين ليلة وضحاها يعتمد على السؤال، وثمانية أزواج أبعد ما تكون عن الكفاية لمعرفة أي الأسئلة هي. وعمود الفئات لا يتجاوز ملاحظة واحدة في بعض المواضع، ولن نقرأه.

تحذير إضافي: كل زوج هنا بفارق 24 ساعة في يوم واحد، لذا فهذا يقيس فترة واحدة في تاريخ واحد، لا معدل تغيّر.

السؤال نفسه أعاد أحد عشر مصدرًا أمس ولا شيء اليوم

هذا هو الزوج الرابع، وهو أوضح ما في هذا التشغيل. ففي 9 سبتمبر أعاد سؤال «ما الفرق بين فحص الحديد وفحص الفيريتين» 11 استشهادًا عبر 9 نطاقات.

وعند طرحه مجددًا بعد 24 ساعة، في الساعة نفسها، وبالكلمات نفسها، أعاد إجابة كاملة لا تحمل أي استشهادات على الإطلاق. لا قائمة مصادر ولا روابط خارجية في أي مكان من الصفحة. اكتملت الإجابة، وانتهت بمؤشر جوجل «الرد جاهز»، ثم طرحت ثلاثة أسئلة متابعة.

كانت هذه ثاني عملية التقاط خالية من الاستشهادات في الدراسة. الأولى كانت سؤالًا عن مقدمي الخدمة بالفصحى، موصوفًا في القسم التالي، وأنتجت العيّنة منذ ذلك الحين ست حالات أخرى.

ثماني عمليات التقاط من 87 ليست معدلًا نقتبسه كمعدل مستقر، ولن نقدّمه كذلك. ما يثبته هذا الزوج هو أن السلوك غير مرتبط بمستوى لغوي واحد أو فئة أسئلة واحدة، لأن الحالتين لا تشتركان في أيٍّ منهما.

أما الذراع الإنجليزي للسؤال نفسه، المطروح بعد دقائق، فأعاد اثني عشر استشهادًا وسجّل 0.533 مقابل أصله. فأيًّا كان ما أخفى مصادر الإجابة العربية، لم يمسّ الإنجليزية.

زوج كهذا لا يمكن أن يحمل قيمة تداخل. فتسجيله صفرًا سيعني ادعاء أن المحرك استبدل مصادره، بينما ما فعله هو التوقف عن إظهار المصادر أصلًا. هذان سلوكان مختلفان، ومجموعة البيانات تفصل بينهما.

النسخة الفصحى من أحد الأسئلة لم يُستشهد فيها بشيء على الإطلاق

لذراع المستوى اللغوي ثلاثة أزواج صالحة لا أربعة، والمفقود هو المثير للاهتمام.

عند طرحه بالخليجية العامية، أعاد سؤال «أي مختبر أروح له في الرياض» خمسة استشهادات، كلها لمختبرات سعودية.

وعند طرحه بالفصحى، أعاد السؤال نفسه إجابة كاملة دون أي استشهادات من أي نوع. لا قائمة مصادر، ولا روابط خارجية في أي مكان من الصفحة. أوصى بمختبرين مسمّيين ورسم خريطة بدلًا من ذلك.

أعدنا الفحص بعد عشر ثوانٍ أخرى وكانت الإجابة مغلقة ونهائية. لن نبني نظرية على عملية التقاط واحدة، ونشير إليها لأن دراسة استشهادات تُسقطها بصمت كانت ستُخفي أكثر ملاحظاتها إحراجًا.

هل تغيّر صياغة الأمر مَن يُستشهد به؟

ليس بشكل قابل للقياس. فعبر المجموعة العربية كلها، أعادت الأوامر الشبيهة بالكلمات المفتاحية 73.6% من الاستشهادات لمواقع مملوكة تجاريًا بفترة من 60.4 إلى 83.6، مقابل 68.6% للأوامر الحوارية.

الفترتان تتداخلان على امتداد وسطهما كله. وداخل السؤالين المضبوطين لا يكون الاتجاه متسقًا حتى، لأن صياغة الكلمة المفتاحية خفّضت الحصة التجارية في سؤال جرثومة المعدة ورفعتها في سؤال السكري.

الصياغة تغيّر المصادر التي تظهر، لكن لا يبدو أنها تغيّر نوع تلك المصادر، ونقدّم هذا النصف كنتيجة صفرية.

جوجل استشهدت بترجمتها الآلية

أحد المصادر في إجابة فيتامين د العربية كان my-clevelandclinic-org.translate.goog. أي صفحة Cleveland Clinic الإنجليزية مقدّمة عبر وسيط الترجمة من Google Translate، مُستشهدًا بها داخل إجابة عربية، واستشهدت الإجابة نفسها بشكل منفصل بالصفحة غير المترجمة.

وتكرر ذلك في سؤال آخر. فإجابة الـ RDW المرتفع بالعربية بدأت بوسيط الترجمة نفسه لـ Cleveland Clinic في المركز الأول، واستشهدت بوسيط ثانٍ، ubiehealth-com.translate.goog، في موضع أدنى.

حين لا تضم المدوّنة العربية أي مرجعية لسؤال سريري، لا ينزل النظام إلى صفحة عربية أضعف، بل يترجم مرجعية إنجليزية فورًا ويستشهد بالترجمة.

وإن كان هذا السلوك شائعًا لا عرضيًا، فإن كثيرًا من نصائح GEO العربية تستهدف الهدف الخطأ.

استشهد بشركة تقنية حيوية للذرة كمختبر في مكة

عند السؤال بالإنجليزية عن أفضل مختبر طبي في مكة، أعاد المحرك أربعة استشهادات. أحدها، greenlab.com، هو GreenLab, Inc.، شركة أمريكية تصف صفحتها الرئيسية نشاطها بأنه «تخضير الصناعة» بتقنية حيوية نباتية من الجيل التالي عبر زراعة البروتينات في الذرة.

إنها ليست مختبرًا طبيًا، ولا تعمل في السعودية، ولا شيء في الصفحة يتعلق بفحص الدم.

توجد عيادة Green Lab في مكة ويوجد greenlab.com.sa، لذا فالآلية المرجحة تطابق في الاسم انتهى إلى النطاق القابل للتسجيل الخطأ.

نقدّم هذا لأنه من نوع الأخطاء التي لا يستطيع القارئ رؤيتها. فالاستشهاد معروض في الإجابة تمامًا كالمختبرات السعودية الثلاثة الصحيحة بجانبه.

إنه استشهاد واحد من 337 في الجانب الإنجليزي، فلا يحرّك شيئًا.

لكن ما يوضحه أثقل من وزنه: فالكيان الذي لم يُفصل عن غيره في رؤية المحرك للعالم يمكن أن يُلصق بسؤال لا علاقة له به، وبالإنجليزية، في سؤال سعودي، تكون مجموعة الكيانات المرشحة ضعيفة بما يكفي لحدوث ذلك.

رمّزناه مملوكًا لعلامة تجارية و الولايات المتحدة، لأن تصنيفنا يرمّز ما هي الصفحة لا ما إذا كان المحرك محقًا في الاستشهاد بها. وهذا يضيف واحدًا إلى البسط التجاري الإنجليزي. أعد ترميزه كخطأ، فتنتقل الحصة التجارية الإنجليزية من 58.2% إلى 58.0%.

المستشفى نفسه، مُحتسبًا مرتين، مرة لكل لغة

dsfhjeddah.fakeeh.care و en.dsfhjeddah.fakeeh.care موقع واحد. تقدّم جوجل النطاق en. للأمر الإنجليزي والنطاق المجرد للأمر العربي، والمطابقة الصارمة للنطاقات تعدّهما مصدرين مختلفين. وثلاث عائلات نطاقات في مجموعة البيانات هذه تنقسم بهذه الطريقة، تغطي 18 من 726 استشهادًا تم تحديد نطاقه، والثلاث كلها تمتد عبر اللغتين. وانضم مستشفى فقيه في الرياض إلى مستشفى جدة في هذا النمط في الدورة 14، إذ استُشهد بنطاقه المجرد بالعربية وبنطاقه en. بالإنجليزية داخل السؤال نفسه.

وهذا يدفع في الاتجاه نفسه الذي يدفع فيه وسيط الترجمة أعلاه: يجعل اللغتين تبدوان أكثر تباعدًا مما هي عليه المستندات وراءهما فعلًا.

قسناه بدلًا من الجدال حوله. فتوحيد البادئتين en., ar. و www. ينقل العنوان الرئيسي من 0.149 إلى 0.152، ويحرّك زوجًا واحدًا بالضبط، سؤال سعر PCR، من 0.273 إلى 0.400.

يبقى الرقم الصارم هو العنوان الرئيسي، ويُنشر الرقم الموحّد بجانبه، على المبدأ نفسه المتبع مع وسيط الترجمة: سمِّ الانحياز، واحتفظ بالرقم الذي لا يجمّلنا.

السؤال الإنجليزي لم يكن دائمًا السؤال نفسه

في سؤال الاعتماد لم تبقَ اللغتان على الموضوع نفسه. وهذا أثر ناتج عن الترجمة لا اختلاف في الاستشهادات، ونفضّل أن نسمّيه على أن ندفنه.

أعاد الأمر العربي المركز السعودي لاعتماد المنشآت الصحية ثلاث مرات، ووزارة الصحة، وعيادة في الرياض.

أما الأمر الإنجليزي فأعاد جهة الاعتماد مرتين أخريين، ثم انجرف إلى الفحوص الصناعية: مختبر تربة، وشركة جيوتقنية، وقائمة الموردين المؤهلين لدى الشركة السعودية للكهرباء، وشركة تفتيش إسبانية.

كلمة «مختبر» تحمل المعنى الطبي في الصياغة العربية وتفقده في الإنجليزية (Lab). وذلك الزوج يسجّل تداخلًا قدره 0.067، وجزء من هذا الرقم يعود إلى الكلمة لا إلى الويب.

هل هذه العربية، أم هي جوجل؟

كل ما سبق منتج واحد، ولا تستطيع دراسة على محرك واحد أن تخبرك ما إذا كانت قد وجدت خاصية للغة أم خاصية للمزود، وهذا أول سؤال سيطرحه أي قارئ متمكن.

لذا شغّلنا محركًا ثانيًا: ChatGPT، دون تسجيل دخول، ودون حساب، ودون سجل، بالشروط نفسها ورمز السوق السعودي نفسه في نص الاستعلام، في 10 سبتمبر عبر تسع جولات: 85 عملية التقاط تحمل استشهادات، و303 استشهادات، و37 زوجًا متطابقًا، محفوظة في data/citations-chatgpt.csv و data/citations-chatgpt-round2.csv ومستبعدة من كل رقم مجمّع في هذه الصفحة.

طُرح الآن 29 سؤالًا على المحركين، باللغتين، في الأسبوع نفسه، أي تسعة فوق العشرين التي صُممت هذه المقارنة لتحتاجها. هذا ليس اختبار تكرار على لوحتين مبنيتين بشكل مختلف، بل مقارنة مضبوطة واحدة: الأسئلة نفسها، والمستوى اللغوي نفسه، والأسبوع نفسه، وتشغيل واحد لكل أمر في كل محرك، والذراعان يتشاركان مجموعة أسئلة لا موضوعًا. وكل رقم أدناه محسوب بواسطة analyze_chatgpt.py من صفوف المحركين نفسيهما.

29 سؤالًا مشتركًاوضع الذكاء الاصطناعي من جوجلChatGPT
متوسط التداخل بين اللغتين0.1190.351
أزواج لا تشترك في شيء11 من 2910 من 29
حصة المؤسسات، بالعربية11.2% من 25860.8% من 102
حصة المؤسسات، بالإنجليزية29.3% من 27364.6% من 130
فجوة المؤسسات18.1 نقطة3.8 نقطة

نتيجتان تصمدان. كلا المحركين يستشهد بالمؤسسات أقل حين يصل السؤال بالعربية منه حين يصل السؤال نفسه بالإنجليزية.

وفي الأسئلة نفسها وفي الأسبوع نفسه، ChatGPT مؤسسي بالعربية أكثر بكثير من جوجل: 60.8% مقابل 11.2%، بفارق 49.6 نقطة، وهو لا يزال أكبر أثر في هذه الدراسة كلها.

وقد تقلص هذا الفارق مرتين متتاليتين، من 57.4 نقطة إلى 54.8 ثم إلى 49.6. وقد سحبنا الادعاء بأنه لا يفعل سوى الاتساع حين توقف عن الاتساع أول مرة، ولن نستبدله بادعاء أنه لا يفعل سوى التضيّق.

الفجوتان تفصل بينهما 14.3 نقطة، وهي القيمة المختلفة السابعة في سبع جولات. كان هذا الفرق 15.8، ثم 10.1، ثم 14.1، ثم 4.0، ثم 9.2، ثم 11.7، ثم 14.3، على ستة وعشرة وثلاثة عشر وسبعة عشر وواحد وعشرين وخمسة وعشرين وتسعة وعشرين سؤالًا مشتركًا. والكمية التي تواصل التحرك مع العينة ليست خاصية لأي من المحركين، ولهذا فالتقسيم أدناه، لا هذا الرقم، هو ما نقدّمه كنتيجة: فرقم الفجوة الواحد متوسط مرجّح لنمطين متعاكسين، لذا تتبع قيمته مزيج أنواع الأسئلة في اللوحة.

قبل أن ننسب تحرك هذه الجولة إلى الأسئلة الأربعة الجديدة، فحصنا البديل الواضح، وهو أن لوحة جوجل ببساطة نمت تحت المقارنة.

لم يكن الأمر كذلك: فإعادة حساب أسئلة جوجل الخمسة والعشرين السابقة مقابل بيانات اليوم تعيد 11.9% بالعربية، و30.6% بالإنجليزية، وفجوة 18.7 نقطة، وهي الأرقام الثلاثة نفسها في الجولة السابقة. ثلاث جولات نظيفة متتالية، والتحرك كله يعود إلى الأسئلة الجديدة.

حصة المؤسسات، الأسئلة المشتركةجوجل، بالعربيةجوجل، بالإنجليزيةChatGPT، بالعربيةChatGPT، بالإنجليزية
10 أسئلة معلوماتية17.9% من 9554.2% من 9697.5% من 40100.0% من 46
19 سؤالًا تجاريًا7.4% من 16315.8% من 17737.1% من 6245.2% من 84

اقرأ الصفوف لا المجاميع. ففي جوجل تقع العقوبة العربية في الغالب داخل الأسئلة المعلوماتية، 36.3 نقطة هناك مقابل 8.4 في الأسئلة التجارية، لأن السؤال التجاري يحصل على إجابة تجارية في أي لغة، ولا يبقى الكثير من الحصة المؤسسية لخسارته: 7.4% و15.8%.

أما في ChatGPT فالأمر معكوس. فالأسئلة المعلوماتية يُجاب عنها مؤسسيًا باللغتين، 97.5% و100.0%، فلا يكاد يُخسر شيء هناك، وتقع عقوبته العربية على الأسئلة التجارية، 37.1% مقابل 45.2%.

لم يُضف أي سؤال معلوماتي في هذه الجولة، وخلايا ذلك الصف الأربع لم تتغير حتى في المنزلة العشرية. بينما تحركت كل خلية في الصف التجاري. وهذه ثالث مرة يتصرف فيها التقسيم تمامًا كما ينبغي لأثر المزيج أن يتصرف تحت تغيير مقصود في المزيج.

ما فعلته أسئلة هذه الجولة الأربعة الجديدة. الأربعة كلها تطلب من القارئ اختيار مقدم خدمة، وثلاثة منها تطلب شخصًا مسمّى لا مبنى: أفضل مستشفى للنساء والولادة في جدة، وأفضل طبيب جلدية في الرياض، وأفضل طبيب أسنان في جدة وتكلفة التنظيف هناك، وأفضل أخصائي ركبة في الرياض. أجاب ChatGPT عن عمليات الالتقاط الثماني كلها دون الاستشهاد بمؤسسة واحدة، في أي من اللغتين. خمسة وعشرون استشهادًا: صفحات تسويقية لمستشفيات وعيادات، وموقعان شخصيان لطبيبين، ودليلا حجز، وقائمتان لشبكات مقدمي خدمات التأمين. وفعلت جوجل الشيء نفسه تقريبًا في الأسئلة الأربعة نفسها: صفر استشهادات مؤسسية بالعربية، وواحد من خمسة عشر بالإنجليزية.

ضع ذلك بجانب أسئلة الجولة الرابعة السابقة، حيث عادت كل عملية من عمليات الالتقاط الثماني مؤسسية بنسبة مئة بالمئة، ووصل تسعة وثلاثون استشهادًا دون صفحة تجارية واحدة.

جولتان، ثماني عمليات التقاط في كلٍّ منهما، واحدة عند السقف وأخرى عند القاع، على المحرك نفسه في الأسبوع نفسه. ومعًا تشكلان أوضح دليل في هذه الدراسة على أن الحصة المؤسسية تقيس السؤال لا المحرك.

وتكشف هذه الجولة أيضًا حدًّا في مقياس الفجوة نفسه. فجوة ChatGPT في هذه الأسئلة الأربعة 0.0 نقطة، وهذا الصفر يعني أنه لم يكن هناك ما يُخسر: فمع انعدام الحصة المؤسسية في اللغتين، لا تجد الفجوة مكانًا تتحرك إليه. والفجوة الصفرية قد تعني أن اللغتين خُدمتا بالقدر نفسه من الجودة، أو أن كلتيهما خُدمتا بالكامل من قِبل من يبيعون شيئًا، ووحده المستوى يخبرك بأيّهما. ولهذا يأتي المستوى في الجدول فوق الفجوة، ولهذا لا ينبغي للقارئ أن يعدّ تضيّق الفجوة خبرًا جيدًا بحد ذاته.

أسئلة الجولة السابقة الأربعة، للاستمرارية، سألت عن أي مستشفى في جدة، وأي مستشفى في الدمام، وأي مركز طبي في جدة يُجري فحصًا شاملًا، وما الذي يقيسه فحص الفيريتين ولا يقيسه فحص الحديد. وعادت ثلاثة من الأربعة بفجوة معكوسة في ChatGPT، إذ كانت إجابته العربية أكثر مؤسسية من الإنجليزية، وهو ما لم تنتجه أي جولة قبلها.

أوضح نتيجة منفردة لا تزال في جانب جوجل. عند السؤال بالعربية عن كيفية اختلاف المختبرات السعودية في الدقة، أعادت جوجل عشرة استشهادات ليس بينها مؤسسة واحدة. والسؤال نفسه بالإنجليزية أعاد سبع مؤسسات من أربعة عشر. أي عقوبة عربية بخمسين نقطة في سؤال واحد، وهي الأكبر في الدراسة. أما ChatGPT، حين سُئل ذلك بالعربية، فاستشهد بجهة الاعتماد الوطنية والهيئة الوطنية لاعتماد المنشآت الصحية ولا شيء غيرهما.

وقد كسرت جولة سابقة النسخة المرتبة من تفسيرنا نفسه، وهذا أثمن من تأكيد آخر له. سؤالا الدقة والاعتماد يحملان في اللوحة تصنيف مقدم الخدمة ، فاحتُسبا تجاريين، لكنهما لم يتصرفا تصرفًا تجاريًا في أيٍّ من المحركين. فلكليهما إجابة مؤسسية معتمدة، هي الجهة التنظيمية. ما يتنبأ بالعقوبة العربية ليس ما إذا كان السؤال تجاريًا، بل ما إذا كانت له إجابة معتمدة، وتصنيف الفئة مجرد مؤشر تقريبي لذلك. وهذه الجولة هي النقطة نفسها من الطرف الآخر: أربعة أسئلة بلا إجابة معتمدة لم تنتج أي استشهادات مؤسسية على الإطلاق.

تقدّم ChatGPT المؤسسي بالعربية حقيقي وكبير في الأسئلة التي لها إجابة مرجعية معتمدة، حيث يلجأ إلى MedlinePlus والمعهد الوطني للسكري وأمراض الجهاز الهضمي والكلى (NIDDK) ومراكز السيطرة على الأمراض (CDC) وهيئة الخدمات الصحية البريطانية (NHS) وCleveland Clinic والجمعية الأمريكية للغدة الدرقية ومنظمة الصحة العالمية والمركز السعودي للاعتماد باللغتين. أما في سؤال إلى أين تذهب فعلًا ومن تراجع، فلا يملك تلك الميزة.

مجموعة أسئلة الشراء الآن سبعة عشر سؤالًا، وتُقرأ مؤسسية بنسبة 23.5% بالعربية مقابل 37.0% بالإنجليزية، بينما كانت أسئلة الشراء العشرة المثبتة قبل جولتين تُقرأ 30.3% و59.5%. والخليتان تتراجعان مع دخول مزيد من أسئلة مقدمي الخدمة، والإنجليزية تتراجع أسرع.

الآلية وراء النصف المعلوماتي ظاهرة في الصفوف. ففي سؤال السكري العربي استشهد ChatGPT بـ CDC وNHS، وهي صفحات موجودة بالإنجليزية فقط. وفي سؤال جرثومة المعدة العربي استشهد بالنسخة العربية من Mayo Clinic. وفي سؤالي RDW وTSH العربيين استشهد بـ MedlinePlus وCleveland Clinic، وكلتاهما صفحتان إنجليزيتان.

أما جوجل، حين سُئلت الأسئلة نفسها بالعربية، فلجأت إلى صفحات تجارية عربية، وفي RDW لجأت إلى Cleveland Clinic مقدّمة عبر وسيط الترجمة الخاص بجوجل. محرك يجيب عن السؤال العربي بترجمة مؤسسة أجنبية، والآخر بالعثور على نشاط تجاري محلي.

باتت اللغتان تسمّيان أنشطة تجارية دون ذكر مصادرها، وفي هذه الجولة فعلتا ذلك في كل عملية التقاط. عند السؤال بالعربية عن أفضل مستشفى ولادة في جدة، سمّى ChatGPT أربعة مستشفيات واستشهد باثنين. وعند السؤال بالإنجليزية عن أفضل طبيب جلدية في الرياض أوصى بطبيب واحد مع استشهاد، ثم أدرج أربع عيادات بتقييمات النجوم وعدد المراجعات دون أن يستشهد بشيء لأيٍّ منها. وسمّت إجابة طبيب الأسنان العربية أربع عيادات بتقييماتها ولم تستشهد إلا بصفحتي الأسعار. سجّلت الجولات السابقة هذا كسلوك عربي، ثم وجدته بالإنجليزية حين قُرئت الإجابات الإنجليزية بحثًا عنه. وفي جولة من أسئلة مقدمي الخدمة الخالصة، يظهر في الثماني كلها.

لم يظهر أي رابط لبيئة غير إنتاجية، للجولة الثالثة على التوالي. خمسة وعشرون استشهادًا، كلها لنطاقات إنتاجية. أما الخمسة في مجموعة البيانات، وهي بيئة اختبار لدى كلية علماء الأمراض الأمريكية، وبيئة اختبار تابعة لمجموعة الدكتور سليمان الحبيب الطبية، وشهادة نموذجية لمختبر وهمي، ونطاق فرعي تجريبي لعميل استُشهد به فوق الموقع الحي الذي ينسخه، ونطاق شبيه بشرطة لـ medlineplus.gov، فقد وصلت كلها في أسئلة عن السعر أو الدقة، حيث اضطر المحرك إلى تجاوز المؤسسات ليجد من يبيع. وهذه الأسئلة الأربعة تدور كليًا حول من يبيع ولم تنتج أيًّا منها، لذا فهذه القراءة الآن أضعف مما بدت.

لكن خللًا واحدًا في الاسترجاع تكرر، والتكرار هو ما يجعله جديرًا بالإبلاغ. ألصق ChatGPT مجددًا تسمية الإسناد «مستشفى الدكتور سليمان الحبيب» برابط يعود إلى مستشفى الدكتور سليمان فقيه، وهي مجموعة مستشفيات سعودية مختلفة ومنافسة. النطاق نفسه، والتسمية الخاطئة نفسها، للجولة الثانية على التوالي، وهذه المرة بالعربية بعد أن كانت الحالة السابقة بالإنجليزية. الوجهة صحيحة، واسم الناشر المطبوع بجانبها لمنافس، وهذا إخفاق لا يستطيع القارئ اكتشافه بفحص الرابط.

تحذيران، وكلاهما ليس صغيرًا. 29 سؤالًا، مع 102 استشهاد عربي و130 إنجليزي من ChatGPT تحت النسب المئوية، لذا فحفنة من الصفوف تحرّك أيًّا من هذه الأرقام عدة نقاط، وتقسيم الفئات يقسم هذه الأعداد الصغيرة أصلًا إلى نصفين.

وتشغيل واحد لكل أمر في جانب ChatGPT، دون ذراع تكرار تحته، لذا فرقمه 0.351 بلا أرضية تشويش: وذراع التكرار في لوحة جوجل يضع تداخل السؤال نفسه في اليوم التالي عند 0.602 بالعربية.

يتصرف رقم التداخل بشكل مختلف عن رقم المؤسسات. فمتوسط ChatGPT لا يزال قرابة ثلاثة أضعاف متوسط جوجل في الأسئلة المشتركة، 0.351 مقابل 0.119.

ومعدلات الانفصال التام، التي تساوت في الجولة الماضية عند 8 من 25 لكلٍّ منهما، افترقت مجددًا: 10 من 29 في ChatGPT مقابل 11 من 29 في جوجل. وهذا الانعكاس السادس في هذه الكمية خلال ست جولات، لذا فهو أثر مزيج أيضًا، لا اتجاه.

في السؤالين اللذين التقت فيهما اللغتان في هذه الجولة، جاء الالتقاء دون وجود أي مؤسسة. أعاد سؤال الولادة في جدة نطاقين من ثلاثة باللغتين، كلها صفحات تسويقية لمستشفيات، مقابل 0.200 في جوجل. وأعاد سؤال طبيب الأسنان في جدة نطاقين من خمسة، كلاهما دليل أسعار لعيادة، مقابل 0.000 في جوجل. وهذا هو الشكل نفسه لسؤال المركز الطبي في جدة قبل جولة، الذي بلغ 1.000 دون أي شيء مؤسسي. أما سؤالا الجلدية والعظام فلم يشتركا في شيء في أيٍّ من المحركين.

انظر إلى الأسئلة التي تنتج اتفاقًا. أسئلة الأسنان والباطنية تنتهي إلى أدلة الحجز، وهي منصات ثنائية اللغة تقدّم قاعدة بيانات واحدة للغتين. وأسئلة مختبرات جدة والاعتماد تنتهي إلى جهات اعتماد تنشر باللغتين.

والسكري ينتهي إلى خدمتين صحيتين وطنيتين لكلٍّ منهما صفحة معتمدة واحدة، والفيريتين إلى منظمة الصحة العالمية وAAFP، وسؤال الغدة الدرقية إلى NHS والجمعية الأمريكية للغدة الدرقية. وأسئلة الولادة وطبيب الأسنان والمركز الطبي تنتهي إلى الحفنة نفسها من المستشفيات الخاصة، التي تملك إجابتها باللغتين بقدر ما تملك CDC موضوع السكري.

إذن فالاتفاق بين اللغتين يتبع ما إذا كان مصدر واحد يجيب عن السؤال للجميع. ولا يتبع ما إذا كان المحرك جيدًا في العربية، ولا يشترط أن يكون ذلك المصدر مؤسسة، بل أن يكون المكان الوحيد الذي تعيش فيه الإجابة.

وللاكتمال، اللوحتان الكاملتان، اللتان تبقيان مرجّحتين بشكل مختلف وتُعدّان سياقًا لا دليلًا:

اللوحات الكاملةوضع الذكاء الاصطناعي من جوجلChatGPT
الأزواج المتطابقة4037
الاستشهادات753303
متوسط التداخل بين اللغتين0.1490.342
أزواج لا تشترك في شيء14 من 40، 35.0%14 من 37، 37.8%
حصة المؤسسات، بالعربية9.1%47.0%
حصة المؤسسات، بالإنجليزية24.0%61.2%
فجوة المؤسسات14.9 نقطة14.2 نقطة

فرق آخر يستحق الذكر، لأنه يغيّر ما قد تبنيه. فصفحات مقدمي الخدمة المملوكة لعلامات تجارية تستحوذ على 33.8% من استشهادات ChatGPT العربية عبر الذراع كله، مقابل 32.2% من الإنجليزية.

ويذهب باقي العمود العربي إلى الأدلة ومنصات الحجز بنسبة 10.6%، وشبكات مقدمي خدمات التأمين بنسبة 4.0%، ومدونات الوكالات ومزارع المحتوى بنسبة 2.6%، ومنشور واحد على وسائل التواصل، ونطاق شبيه واحد. أما الجانب الإنجليزي فالأدلة فيه بنسبة 3.3%، والتأمين 2.0%، ومدونات الوكالات ومزارع المحتوى 1.3%.

ذلك العمود المملوك لعلامات تجارية قد أُغلق الآن. كان يُقرأ 30.2% بالعربية مقابل 20.0% بالإنجليزية قبل جولتين، و31.0% مقابل 25.7% في الجولة الماضية، و33.8% مقابل 32.2% الآن: بفارق 1.6 نقطة، ضمن ما لا تستطيع هذه العينة أن تسمّيه فرقًا. وقد أُغلق لأن الرقم الإنجليزي ارتفع اثنتي عشرة نقطة في جولتين بينما ارتفع العربي ثلاثًا. ففي هذا المحرك لم تعد حصة الاستشهادات الذاهبة إلى من يبيع الشيء الذي يُسأل عنه نتيجة خاصة بالعربية، بل نتيجة تخص أسئلة مقدمي الخدمة، وهي الأسئلة التي قضينا الجولات الثلاث الأخيرة في إضافتها.

فجوة جوجل العربية تمتلئ بصفحات مقدمي الخدمة التجارية، بينما تمتلئ فجوة ChatGPT بالوسطاء. الفراغ نفسه، بمستأجرين مختلفين، وفي ChatGPT بدأ الجانب الإنجليزي يمتلئ أيضًا.

الأمر الإنجليزي لا يحصل بالضرورة على إجابة إنجليزية

هذا أكثر ما وجدناه اليوم إحراجًا، ومكانه فوق القيود لا داخلها.

لاحظنا عملية التقاط إنجليزية تجيب بالعربية، فأعدنا طرح سبعة أوامر إنجليزية وقسنا نظام الكتابة في كل إجابة. عادت أربعة من السبعة بالعربية.

السؤال، الذراع الإنجليزيلغة الإجابة
المختبرات في الدمامبالعربية
فحص CBCبالعربية
سعر فيتامين دبالعربية
أعراض جرثومة المعدةبالعربية
الفحص قبل الزواجالإنجليزية
الفيريتين مقابل الحديدالإنجليزية
أفضل مختبر في الرياضالإنجليزية

الإجابات العربية ليست حالات حدّية. فإجابة CBC تبدأ بعبارة «اختبار CBC هو اختصار لـ Complete Blood Count».

ما لا يكسره هذا. ‏ اللغة هو العمود الذي يسجّل اللغة التي طُرح بها السؤال، وهو ما قال قاموس البيانات دائمًا إنه يسجله. وكل رقم في هذه الصفحة رقم للغة الأمر ويبقى كذلك.

ما يكسره فعلًا. أي جملة في هذه الصفحة بصيغة «أعادت الإجابة الإنجليزية NHS وثلاث عيادات أمريكية» تفترض أن الذراع الإنجليزي أجاب بالإنجليزية. اقرأها على أنها «أعاد الأمر الإنجليزي» بدلًا من ذلك.

التخمين البديهي بشأن الانحياز خاطئ. قد تتوقع أن الإجابة العربية عن أمر إنجليزي ستجلب مصادر عربية وتضخّم رقم التداخل. لكنها لا تفعل. فسؤالا جرثومة المعدة وسعر فيتامين د أجابا بالعربية في هذا الفحص، وكلاهما يسجّل 0.000 مقابل توأميهما العربيين. وسؤال المختبرات في الدمام أجاب بالعربية ويسجّل 0.375، وهو أعلى زوج لدينا لمقدمي الخدمة. وسؤال الفحص قبل الزواج أجاب بالإنجليزية ويسجّل 0.357.

لغة الإجابة وتداخل المصادر لا يتسقان في أي اتجاه. والقراءة التي تصمد هي أن لغة الأمر تحرّك المصادر المسترجعة بشكل مستقل عن اللغة التي تُكتب بها الإجابة، وهو ادعاء أقوى مما يحق لنا قوله حاليًا.

أجرينا هذا الفحص بعد يوم من اللوحة، وهذا المحرك يتغير بين ليلة وضحاها، لذا تعامل مع أربعة من سبعة كدليل على أن السلوك شائع لا كمعدل ليوم 9 سبتمبر.

ثم وجدنا السبب، وهو منا. إضافة &hl=en إلى رابط البحث، التي تضبط لغة واجهة جوجل على الإنجليزية ولا تغيّر شيئًا آخر، قلبت الإجابات العربية الثلاث المختبرة كلها إلى الإنجليزية. وعادت اثنتان من الثلاث دون أي حرف عربي في الصفحة كلها.

كان متصفح الجمع مضبوطًا على واجهة جوجل بالعربية، ولم يضبط أحد المعامل hl صراحةً. لذا أمضى الذراع الإنجليزي هذه الدراسة كلها يطرح أسئلة إنجليزية على منتج مضبوط بالعربية، وفي نحو نصف الحالات عادت إليه إجابة عربية.

هذا خلل في أداتنا، لا خاصية للمحرك، ونفضّل أن نقول ذلك على أن ندع القارئ يفترض أن جوجل تقرر أن الأسئلة السعودية تستحق إجابات عربية.

الإصلاح معامل واحد في الرابط في كل عملية التقاط مستقبلية، hl=ar للذراع العربي و hl=en للإنجليزي، وهو محدد مع الأعداد الخام في data/ANSWER-LANGUAGE-CHECK.md.

ثم قسنا تكلفته، عبر اللوحة كلها لا عينة منها. إنها صغيرة، واتجاهها لم يُحسم بعد. أعدنا التقاط الذراع الإنجليزي تحت hl=en لـ 37 من الأسئلة المزدوجة الأربعين، وأعدنا حساب التداخل مقابل الذراع العربي دون تغيير.

الشريحةالأسئلة المقيّمةJ كما جُمعJ تحت hl=enالتغيير
القيمة كما أُعلنت أولًا40.1120.139+0.027
الذراع الكامل340.1520.116-0.037

أعاد أربعة وثلاثون من الـ 37 استشهادات ويمكن تقييمها. وأعادت ثلاثة إجابة كاملة دون أي سطح استشهادات، وهي مسجلة بشكل منفصل. أما الأسئلة المزدوجة الثلاثة الأخيرة فليس لها أمر إنجليزي في أيٍّ من بنوك أسئلتنا، لذا لم نلتقطها بدلًا من اختلاق أمر والتظاهر بأن الزوج متطابق.

بقي الحجم صغيرًا من أربعة أسئلة إلى 34. فالتصحيح يحرّك المتوسط بـ 0.037 مقابل رقم لوحة 0.149 وفجوة إلى أرضية التشويش تقارب 0.45. وهذه هي النتيجة: أيًّا كان ما فعلته الواجهة العربية بالذراع الإنجليزي، فهي لم تصنع الفجوة بين اللغتين، وتصحيحها لا يُغلقها.

أما الاتجاه فمسألة أخرى، ولم تحسمه 34 سؤالًا. فالتصحيح يخفض 14 سؤالًا، ويرفع 8، ويترك 12 دون تغيير. وقد مال المجموع إلى السالب منذ تجاوز الذراع نحو 20 سؤالًا، لكن الإشارة انقلبت مرة عند أربعة، والتشتت لكل سؤال واسع: سؤال ينخفض 0.667 وآخر يرتفع 0.286. اقرأ الحجم، ولن نقتبس اتجاهًا من هذا.

السؤالان صفريا التداخل هما أهم نتيجة. فكلاهما أجاب بالعربية تحت الواجهة الافتراضية، وكلاهما لم يشترك في شيء على الإطلاق مع توأمه العربي بعد التصحيح. فالأمر الإنجليزي الذي يُجاب بالعربية لا يزال يسترجع مجموعة مصادر مختلفة عن السؤال نفسه المطروح بالعربية.

ثلاثة أسباب تمنعنا من إغلاق هذا. فعمليات الالتقاط المصححة أعادت استشهادات أقل، بوسيط أربعة مقابل ستة، والمجموعة الأصغر تقلّص الاتحاد وترفع Jaccard، لذا فجزء من التحرك على مستوى الأسئلة في الاتجاهين أثر لذلك لا للواجهة. كما أن الذراع امتد عبر عدة أسابيع أمام محرك يُظهر ذراع التكرار لدينا أنه يتغير بين ليلة وضحاها، فالوقت المنقضي متداخل مع الإصلاح في كل سؤال. وثلاثة أزواج مفقودة.

أمر واحد حسمه الذراع: الإصلاح ينجح. لم تعد أي عملية من عمليات الالتقاط المصححة الـ 37 بنص إجابة عربي، مقابل ذراع إنجليزي في الموجة الأولى عاد نحو نصفه كذلك. والأحرف العربية الباقية تقع في قوائم الأنشطة التجارية المضمّنة وأسماء العيادات التي أظهرتها الإجابة، لا في نثر الإجابة أبدًا. معامل واحد في الرابط أوصل الخلل إلى الصفر وأبقاه هناك عبر 37 عملية التقاط.

ثم اصطدمت الموجة الثانية بالخلل نفسه من الجهة الأخرى، وأوقفت الجمع لتشغيل واحد. اكتشف أول تشغيل في الموجة الثانية في 10 سبتمبر أن متصفح الجمع يعيد كتابة كل رابط لجوجل قبل تحميله: فأي نطاق لجوجل يُعاد توجيهه إلى google.com.sa، و gl=sa، ويُفرض رمز موقع الرياض و hl=en على سلسلة الاستعلام. والمعامل المطلوب hl=ar يُستبدل بصمت بـ hl=en في كل محاولة، وعلى كل نطاقات جوجل الدولية، مع وضع الذكاء الاصطناعي ودونه. إذن فلغة الواجهة كانت مثبتة من المتصفح لا مختارة من البروتوكول، وكانت مثبتة على الإنجليزية بينما جرت الموجة الأولى وهي مثبتة على العربية. فتوقفنا بدلًا من خلط حالتين مختلفتين للأداة داخل العمود الذي يحمل معظم نتائج هذه الصفحة.

وتبيّن أن ذلك خاصية لمتصفح واحد لا لجوجل. واستُؤنف الجمع في اليوم نفسه في متصفح ثانٍ لا يعيد كتابة شيء: hl=ar يبقى كما هو، والنطاق يبقى www.google.com، والإجابة العربية تعود بالعربية.

كل عملية التقاط منذ تلك اللحظة تُعلن معاملها hl, gl=sa ورمز موقع الرياض نفسه صراحةً، فباتت حالة الواجهة يحددها البروتوكول بدلًا من أن تُورث من الأداة، ويُتحقق منها في كل عملية التقاط بدلًا من افتراضها. وتبقى الموجة الأولى تحت الحالة القديمة الموروثة، وذراع إعادة التقاط الأسئلة الـ 37 أعلاه هو القياس الوحيد لتكلفة تلك الحالة.

وكشف ذلك الفحص أمرًا آخر، وهو يصحح ملاحظة المنهجية لدينا. فالملحق وصف متصفح الجمع بأنه يخرج من فرنسا، وهذا صحيح بالنسبة إلى مسار الشبكة وتم التحقق منه مرتين.

لكنه ليس الصورة كاملة: فكل طلب يحمل أيضًا رمز موقع الرياض و gl=sa، لذا فالبحث نفسه محدد جغرافيًا في الرياض. وهذه هي الجغرافيا الصحيحة لهذه الدراسة، وكان ينبغي تدوينها منذ البداية.

ما لا يثبته هذا

شغّلنا أمرًا واحدًا لكل عملية التقاط في اللوحة. وهذه الأنظمة ليست حتمية، وذراع التكرار يضع الآن رقمًا لذلك: متوسط تداخل 0.602 على ثمانية أزواج عربية و0.545 على أربعة إنجليزية، بفارق يوم واحد، دون تغيير أي شيء.

هذا كافٍ لإحالة ذراع المستوى اللغوي إلى التقاعد كنتيجة صفرية، لكنه غير كافٍ لتحديد معدل تقلب للمحرك، لأن الأزواج الفردية تتراوح بين 0.231 و0.889، وثمانية أزواج لا تستطيع أن تخبرك بما يحرّك هذا التشتت.

كل زوج تكرار فترة واحدة مدتها 24 ساعة مقيسة في تاريخ واحد. وهو ليس منحنى تلاشٍ، ولا شيء هنا يقول ما إذا كانت الأسئلة نفسها ستبدو بهذا الاختلاف بفارق أسبوع أو بفارق ساعة.

ولذراع المستوى اللغوي الآن مشكلة ثانية فوق أزواجه الثلاثة. فمتوسطه يقع داخل فترة ذراع التكرار، لذا لا نستطيع فصل أثر المستوى اللغوي عن التشويش حتى من حيث المبدأ بحجم العينة هذا.

وقراءته كأثر صغير لا كنتيجة صفرية تعني قراءة التقدير النقطي وتجاهل النطاق المحيط به.

كما التُقط سؤال واحد مرتين بفارق نحو 20 دقيقة أثناء حادث في الجمع، ولم تكن الإجابتان العربيتان عن الأمر المطابق متطابقتين. وهذا الزوج موصوف في data/REPEAT-CAPTURES.md ولا يحمل رقمًا، لأن إحدى عمليتي الالتقاط فقدت استشهادات بسبب تقييد المعدل.

يستند جدول الفئات أعلاه إلى خمسة أو ستة أزواج لكل فئة، والصف المؤسسي يستند إلى زوج واحد. وعدة فترات واسعة بما يكفي لأن تعيد عينة مختلفة ترتيب وسط ذلك الجدول، وإن كان طرفاه قد صمدا عبر ثلاث جولات.

Delta Medical Laboratories عميل لدى VOCTOS، ونحن من أنتج الترتيبات التي تختبرها هذه الدراسة. وعشرون من عمليات الالتقاط العربية الـ 37 في اللوحة لم تستشهد به، وهذه العشرون موجودة في مجموعة البيانات وفي الفقرة أعلاه.

ماذا تفعل بهذا

نشر محتوى عربي ليس هو النتيجة. بل أمران أدق من ذلك.

الترتيب التقليدي يشتري لك إجابة الذكاء الاصطناعي عن «أي مختبر أستخدم»، لكنه يشتري أقل بكثير لـ «ماذا يعني هذا الفحص» أو «كم يكلّف». وهناك يتركز حجم البحث.

سؤال أعراض واحد في هذه المجموعة يحظى بـ 40,500 عملية بحث سعودية شهريًا، وحملت إجابته العربية بالكامل عيادات من خارج البلاد.

والثاني هو رقم التركّز. فمؤشر HHI البالغ 195 عبر 152 نطاقًا يعني أن الموضع العربي في الإجابة قابل للفوز به لمن ينشر صفحة عربية متماسكة، وقابل للخسارة بالطريقة نفسها.

رأس تلك القائمة لا يضم صفحة وزارية ولا ناشرًا سعوديًا ولا موسوعة، ويتغير تمامًا من سؤال إلى آخر.

أسئلة يطرحها الناس حول هذا

هل تستشهد محركات البحث بالذكاء الاصطناعي بمصادر مختلفة بالعربية عنها بالإنجليزية؟

نعم، وبأكثر مما يتوقعه معظم الناس. فعبر 40 زوجًا متطابقًا من السؤال الصحي السعودي نفسه مطروحًا باللغتين، بلغ متوسط تداخل النطاقات 0.149، ولم يشترك 14 من تلك الأزواج في أي مصدر على الإطلاق. والترتيب في لغة لا يخبرك بشيء تقريبًا عن الأخرى.

هل يجعلك التصدر في المركز الأول على جوجل مُستشهدًا بك في إجابة الذكاء الاصطناعي؟

في أقل من ثلثي الحالات في مجموعة البيانات هذه. ربطنا كل سؤال عربي بالكلمة المفتاحية في جوجل التي بُني منها وأرفقنا المركز المتتبَّع. ففي الأسئلة الـ 19 التي يكون فيها المختبر النتيجة العضوية الأولى استُشهد به في 12 إجابة عربية، أي 63.2% بفترة من 41.0 إلى 80.9. وعلى مستوى الموقع كله الأمر أضعف: فقد احتل المختبر المركز الأول في 355 من 628 كلمة مفتاحية متتبعة في أغسطس 2026، وظهر في 45.5% من الإجابات العربية الـ 44 التي التقطناها. الترتيب التقليدي والاستشهاد في الذكاء الاصطناعي أصلان منفصلان، والثاني لا يُشترى بتحسين الأول.

لماذا تستشهد إجابات الذكاء الاصطناعي العربية بصفحات تجارية بدلًا من المستشفيات والوزارات؟

لأنه في معظم الحالات لا توجد صفحة مؤسسية عربية للسؤال المطروح. فالصفحات المملوكة تجاريًا تحمل 69.3% من الاستشهادات العربية مقابل 58.2% بالإنجليزية، والمؤسسات تستحوذ على 9.1% من المجموعة العربية مقابل 24.0% من الإنجليزية. وفي أسئلة الأسعار يختفي الأثر في اللغتين، لأن أي وزارة لا تنشر تكلفة فحص.

هل الاستشهاد بك بالعربية أسهل منه بالإنجليزية؟

بناءً على هذه الأدلة، نعم. فمجموعة الاستشهادات العربية أصغر وأكثر تركّزًا، لذا تحرّك صفحة واحدة مبنية جيدًا المؤشر أكثر مما تحرّكه الصفحة نفسها بالإنجليزية. وهذه نافذة لا حالة دائمة.

ما مدى استقرار استشهادات الذكاء الاصطناعي يومًا بيوم؟

أقل استقرارًا من الترتيب. فطرح السؤال نفسه بالكلمات نفسها بعد 24 ساعة يعيد نحو 60% من النطاقات نفسها، لذا يتبدل نحو ثلث مجموعة المصادر بين ليلة وضحاها. وأي عملية التقاط منفردة لقطة عابرة، والادعاء المبني على تشغيل واحد ليس ادعاءً.

هل هذه مشكلة جوجل، أم يفعل ChatGPT الشيء نفسه؟

كلا المحركين يستشهد بالمؤسسات أقل حين يصل السؤال بالعربية، لذا فالاتجاه ليس خاصًا بجوجل. أما حجم الأثر فلا ينتقل بين المحركين وتحرّك في كل مرة نمت فيها مجموعة الأسئلة المشتركة، لذا نقدّم الاتجاه لا رقمًا ثابتًا.

كيف قيس هذا؟

وضع الذكاء الاصطناعي في جوجل وChatGPT، دون تسجيل دخول، ودون سجل محادثات، وتشغيل واحد لكل أمر، على نسخ عربية وإنجليزية متطابقة من الأسئلة نفسها. ويُتتبَّع كل استشهاد في جوجل عبر إعادة توجيهه المشفرة إلى نطاق وجهة حقيقي، لأن قراءة مصدر الصفحة وحده لا تخبرك بما يُستشهد به. وتبقى الاستشهادات التي تعذّر تتبعها في المقام. والبروتوكول الكامل في ملحق المنهجية.

هل يمكنني استخدام هذه البيانات؟

نعم. مجموعة البيانات، وسكربت التحليل، وملحق المنهجية منشورة بموجب ترخيص CC BY 4.0. أعد تشغيل البروتوكول على فئتك وأخبرنا أين أخطأنا.

استشهد بهذه الدراسة

عادل، بيشوي. ما الذي يستشهد به وضع الذكاء الاصطناعي في جوجل حين يسأل مريض سعودي بالعربية. أبحاث VOCTOS، سبتمبر 2026. https://www.voctos.com/research/arabic-vs-english-ai-citations/

مجموعة البيانات منشورة بموجب ترخيص CC BY 4.0. إن اقتبست رقمًا من هذه الصفحة، فاقتبس التاريخ معه. فالجمع مستمر والأرقام تتحرك.

الإسهامات والأعمال السابقة

الآلية التي نصفها جُمّعت من أعمال آخرين لا من أعمالنا.

تشكّل العربية ما بين 0.5 و0.6% من الويب وفق ثلاثة مقاييس مستقلة، منها ورقة Fanar 2.0 من معهد قطر لبحوث الحوسبة (QCRI)، ووجدت دراسة «All Languages Matter» أن أكثر من 70% من أفضل خمس نتائج استرجاع في RAG متعدد اللغات تأتي من الإنجليزية أو من لغة الاستعلام وحدها.

قاس Amiraz وزملاؤه خسارة استرجاع عابرة للغات بين العربية والإنجليزية تتراوح بين 13 و42% في مؤتمر ArabicNLP 2025. وأظهر Dai وزملاؤه في EMNLP 2025 أن الاستشهاد يتبع التعرف على هوية المصدر لا تقييم محتواه، وأن هذا التعرف لا ينتقل عبر اللغات.

إسهامنا هو القياس نفسه، مأخوذًا من داخل منتج حي، بالعربية، على أسئلة مؤرخة، مع إرفاق كل صف خام ليتمكن أي أحد من إعادة العدّ.

المراجع

أعمال سابقة تستند إليها هذه الدراسة

  1. Fanar 2.0، معهد قطر لبحوث الحوسبة. العربية نحو 0.5 إلى 0.6% من محتوى الويب.
  2. All Languages Matter: التوليد المعزز بالاسترجاع متعدد اللغات. أكثر من 70% من أفضل خمس نتائج استرجاع في RAG متعدد اللغات تأتي من الإنجليزية أو من لغة الاستعلام وحدها.
  3. Amiraz وزملاؤه، ArabicNLP 2025. خسارة استرجاع عابرة للغات بين العربية والإنجليزية من 13 إلى 42%.
  4. Dai وزملاؤه، EMNLP 2025. الاستشهاد يتبع التعرف على هوية المصدر لا تقييم محتواه، والتعرف لا ينتقل عبر اللغات.

دراسات القطاع التي لا تغطي هذا المجال

  1. Profound. ‏3.25 مليار استشهاد، و14 دولة، ومزيج المنصات لا لغة المصدر.
  2. Temso. سبع لغات، والعربية مستبعدة.
  3. Weglot. أربع لغات، ليس بينها العربية.

هذه الدراسة

  1. data/citations-master.csv. صف لكل حدث استشهاد، منشور بترخيص CC BY 4.0.
  2. data/citations-chatgpt.csv و -round2.csv. ذراع ChatGPT، محفوظ منفصلًا حتى لا يُجمع أي رقم لجوجل معه.
  3. METHOD-APPENDIX.md. البروتوكول، ونمطا فقدان البيانات مع أعدادهما، وقيد المُرمِّز الواحد.

الإصدار التالي

ذراعا المستوى اللغوي والتكرار موجودان كلاهما ومعروضان أعلاه. جرى ذراع التكرار في 10 سبتمبر عبر ثلاث عشرة عملية التقاط بلغتين وأعاد اثني عشر زوجًا صالحًا، وهو ما كان كافيًا لتحويل نتيجة المستوى اللغوي إلى نتيجة صفرية.

ما لم يستطع فعله هو تفسير سبب تراوح الأزواج بين 0.231 و0.889. وهذا يحتاج إلى مزيد من الأسئلة لكل فئة، وإلى فترة ثانية، لنتمكن من التمييز بين خاصية على مستوى السؤال وخاصية على مستوى الزمن.

المحرك الثاني متاح، والوصول إليه تطلب تصحيحًا واحدًا نفضّل نشره على دفنه. فـ Perplexity يرفض الإجابة دون حساب، وBrave Search يُخفي وجهات استشهاداته، ومن هذين الإخفاقين كتبنا أنه لا يوجد محرك مجهول الهوية يكشف وجهات مقروءة. وقد نُشر ذلك الادعاء في نسخة سابقة من الملحق.

وكان خاطئًا. فـ ChatGPT يجيب دون تسجيل دخول، بالعربية، مع استشهادات، ويحمل كل وجهة كنص صريح في خاصية JSON على زر الاستشهاد. وهو أسهل في القراءة من جوجل. ولم يختبره أحد.

ما احتاجته الموجة الثانية لم يكن الوصول، بل الأسئلة العشرين نفسها على المحركين في الأسبوع نفسه، لتتوقف المقارنة أعلاه عن كونها لوحتين وتصبح اختبارًا مضبوطًا واحدًا. وباتت خمسة وعشرون سؤالًا مشتركة الآن، وهذه المقارنة هي ما يعرضه القسم أعلاه.

ما لا يزال يحتاجه هو ذراع تكرار في جانب ChatGPT. فكل رقم لـ ChatGPT في هذه الصفحة تشغيل واحد لكل أمر، لذا لا توجد تحت أيٍّ منها أرضية تشويش. وهذا محدد في .autonomous/arabic-citation-study/deferred.md ولم يُلتقط بعد.

إن لم تكن فئتك الرعاية الصحية، فقد لا ينتقل شيء من هذا، ونفضّل أن تختبره على أن تفترضه. فمجموعة البيانات وسكربت التحليل وملحق المنهجية كلها موجودة في هذا المجلد.

إن أردت تطبيق هذا على فئتك وسوقك، فهذا ما تفعله خدمة GEO لدينا. وإن فضّلت التحقق من عملنا أولًا، فروابط الصفوف الخام موجودة أعلاه، ويسعدنا حقًا أن نُصحَّح.


ملاحظة المحرر، حُدّثت في 10 سبتمبر 2026. أُغلق بندان. مؤهلات بيشوي عادل وsameAs مأخوذة الآن من صفحة الفريق على voctos.com ومثبتة في schema.json.

مقارنة المنافسين مسحوبة من Semrush على قاعدة البيانات السعودية، بتاريخ 10 سبتمبر: Delta في الترتيب 348 بـ 37,224 كلمة مفتاحية عضوية و35,266 كلمة مفتاحية في AI Overviews، ووريد في 778، وألفا في 1,239، والبرج في 613.

سُحبت أرقام تتبع Delta مجددًا في 11 سبتمبر من ملف ترتيب العميل، وتُقرأ الآن 355 من 628 في المركز الأول و453 ضمن أفضل ثلاث نتائج، بتاريخ أغسطس 2026. أما الزوج السابق لشهر يوليو، 197 من 326 و240 ضمن أفضل ثلاث، فتعذّر إعادة إنتاجه من ذلك الملف واستُبدل بدلًا من ترحيله.

الربط لكل سؤال مبني الآن. data/stem-keywords.csv يربط 26 من أسئلة اللوحة العربية الـ 47 بكلمتها المفتاحية المصدر ومركزها المتتبَّع، و rank_carry.py يحسب الانتقال حسب نطاق المركز. والأسئلة الـ 16 التي لم تُربط بعد هي أسئلة «أفضل X» في الموجة الثانية، التي وُلّدت من شبكة قطاعات ومدن ولم تكن لها كلمة مفتاحية مصدر قط.

يبقى بند واحد مفتوحًا. فملف التتبع لا يضم عمود سبتمبر، وخاصية Search Console التي نملكها لهذا العميل لا تغطي إلا مجلد المدونة الفرعي، لذا فالترتيبات في ذلك الجدول تسبق عمليات الالتقاط بنحو أسبوعين. وانتقلت كلمة مفتاحية واحدة في المجموعة من المركز الأول إلى الخامس خلال تلك النافذة، وهذا حجم الخطأ الذي يُدخله ذلك. وتصدير لشهر سبتمبر يُغلقه.

خذ الدراسة معك

ملف PDF مصمم للنتائج والرسوم البيانية والمنهجية. اترك بياناتك وسيُنزَّل فورًا.

نستخدمها لنرسل إليك الموجة التالية ولا شيء غير ذلك. أو نزّله دون ترك بياناتك.

لا تفوّت فرصة
جعل موقعك أكثر ظهورًا!

استشارة أولية و
تدقيق للوضع الحالي

مجانًا
قدّم طلبًا
المقال السابق
هل أعجبك المقال؟
شارك:

اقرأ أيضًا

  • Svg
    مقال

    سحابة الوسوم في SEO: ما هي وكيف تستخدمها

  • Svg
    مقال

    ما هي الصفحات المكررة ولماذا تُعدّ خطيرة؟

  • Svg
    مقال

    لماذا لا يزال الذكاء الاصطناعي يصف علامتك التجارية القديمة: شرح تاريخ انقطاع المعرفة

  • Svg
    مقال

    العوامل السلوكية في SEO: ما هي وكيف تحسّنها

  • Svg
    مقال

    روابط JavaScript تُخفي مواقع الشرق الأوسط وشمال أفريقيا عن ChatGPT وClaude

  • Svg
    مقال

    VOCTOS ضمن أفضل شركات SEO وPPC وSEM في مصر على Clutch لعام 2026

  • Svg
    مقال

    عوامل الترتيب التجارية: القائمة الكاملة

  • Svg
    مقال

    وسم Title: ما هو وكيف تكتبه

نتائج حقيقية

المزيد من النجاحات
شعار معامل دلتا الطبية

SEO وGEO لـ Delta Medical Labs

Svg GEO
SEO وGEO لـ Delta Medical Labs

أكثر من مليون زيارة عضوية شهريًا، 159,200 كلمة مفتاحية في الترتيب، 5,570 صفحة يستشهد بها الذكاء الاصطناعي، و 1,186 ترتيبًا في المركز الأول بالسعودية.

شعار VPNly

SEO عربي وGEO ومقالات ضيفة لـ VPNly

Svg SEO
SEO عربي وGEO ومقالات ضيفة لـ VPNly

65 ألف زيارة عضوية شهرية في الذروة، 55 مقالًا ضيفًا، و 149 صفحة يستشهد بها الذكاء الاصطناعي.

شعار Ogaei

SEO وGEO لـ Ogaei Virtual Care

Svg GEO
SEO وGEO لـ Ogaei Virtual Care

من 3 إلى 7,931 نقرة عضوية شهريًا خلال 7 أشهر، أكثر من 2.9 مليون ظهور، و أكثر من 40 كلمة مفتاحية في أفضل 10 نتائج على جوجل.

شعار Eduverse

SEO لـ Eduverse

Svg SEO
SEO لـ Eduverse

12× زيادة في زيارات البحث خلال 10 أشهر، 45% من الكلمات المستهدفة في أفضل 5 نتائج، و 55% في أفضل 10 نتائج.

يثق بنا

Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg
Svg

حدّثنا عن مشروعك

* حقول إلزامية

يجب ألا يتجاوز حجم الملف 2 ميجابايت. الصيغ المدعومة: docx وdoc وpdf وxlsx وxls