
الذكاء الاصطناعي لا يذكر تقييمك، بل يضع الحد عند 4.5
من بين 3,600 إجابة ذكاء اصطناعي، ذكرت إجابة واحدة فقط تقييم نشاط تجاري. وضع Gemini للعميل حدًا 67 مرة: غالبًا 4.5 نجوم و50 مراجعة.
67
إجابة من Gemini من أصل 1,800 تعطي العميل حدًا للتقييم أو لعدد المراجعات
في هذا المقال
الإجابة المختصرة: من بين 3,600 إجابة من ChatGPT وGemini في أربع دول، ذكرت إجابة واحدة فقط تقييم النجوم لنشاط تجاري سمّته. لكن Gemini أعطى العميل حدًا أدنى في 67 إجابة: صفِّ الخريطة عند 4.5 نجوم، واحتفظ فقط بالأنشطة التي لديها 50 مراجعة على الأقل. فعل ChatGPT ذلك مرة واحدة. يتركز هذا الحد في فرنسا والبرازيل، وفي المهن التي لا يسمّي فيها الذكاء الاصطناعي أحدًا: الكهربائيون والسباكون وفنيو التدفئة والأقفال. المساعد لا يمنحك درجة. إنه يخبر عميلك بأي تقييم يستبعد.
1
إجابة من ChatGPT من أصل 1,800 تفعل الشيء نفسه
4.5
قيمة النجوم في الحد في 50 من أصل 70 مقطعًا تذكر حدًا
لا يقرأ مراجعاتك بدلًا من العميل. يخبره أيها يتجاوز.
ما الذي قسناه
دراساتنا الأربع، أُعيدت قراءتها في 30 سبتمبر 2026: أسئلة المشتري نفسها ("أفضل الكهربائيين في بيلو هوريزونتي"، "سبّاك جيد في ليون") طُرحت على ChatGPT (gpt-4o-mini) وGemini عبر واجهاتهما البرمجية، دون بحث على الويب، في الولايات المتحدة (جُمعت في 13 سبتمبر 2026) والمملكة المتحدة (31 يوليو) وفرنسا (30 يوليو) والبرازيل (6 أغسطس). 3,600 إجابة، 1,800 لكل محرك. بحثنا في كل إجابة عن تقييم مكتوب بالأرقام ("4.8 نجوم"، "4.5/5") أو عدد مراجعات ("أكثر من 50 مراجعة")، وقرأنا كل مقطع وُجد. اختُبرت أدوات الرصد مسبقًا على صيغ حقيقية بالإنجليزية والفرنسية والبرتغالية، بما فيها صيغ لا يجب أن تُحتسب ("تحقق من المراجعات"، "مفتوح من 9 إلى 5"). ثم صُنّف كل مقطع: تصنيف رسمي (فندق أربع نجوم، نجمة ميشلان، 29 إجابة، استُبعدت)، أو تقييم نشاط مسمّى، أو نصيحة للعميل. الحد هو نصيحة تضع حدًا أدنى: "4.5 فأكثر"، "50 مراجعة على الأقل".
| الإجابات | تعطي حدًا | النسبة | أي قاعدة برقم | "كثرة المراجعات تتفوق على العلامة الكاملة" | |
|---|---|---|---|---|---|
| Gemini, الولايات المتحدة | 436 | 2 | 0.5% | 3 | 0 |
| Gemini, المملكة المتحدة | 488 | 10 | 2.0% | 11 | 0 |
| Gemini, فرنسا | 462 | 25 | 5.4% | 42 | 9 |
| Gemini, البرازيل | 414 | 30 | 7.2% | 52 | 11 |
| ChatGPT، أربع دول | 1,800 | 1 | 0.1% | 5 | 0 |
الحد 4.5 نجوم، وغالبًا 50 مراجعة
عندما تذكر الإجابة حدًا أدنى للتقييم، يكون 4.5 نجوم في 50 من أصل 70 مقطعًا. يظهر حد أعلى، 4.8، اثنتي عشرة مرة، معظمها في فرنسا والبرازيل؛ والعلامة الكاملة 5.0 أربع مرات، كلها في البرازيل. أما عدد المراجعات، فـ50 هو الرقم الأكثر ذكرًا، في 21 مقطعًا؛ وتضعه الإجابات البرازيلية أدنى، عند 10 أو 20 مراجعة، في 10 مقاطع. و20 إجابة من Gemini، كلها فرنسية أو برازيلية، تصوغ القاعدة نفسها: نشاط بتقييم 4.5 على 200 مراجعة أجدر بالثقة من نشاط بتقييم 5.0 على ثلاث. تُعامل العلامة الكاملة على عدد قليل من المراجعات كإشارة تحذير، لا كنقطة قوة.
| الحد الأدنى للتقييم | المقاطع |
|---|---|
| 4.5 | 50 |
| 4.8 | 12 |
| 5.0 | 4 |
| 4.0 / 4.2 / 4.7 | 4 |
حيث لا يسمّي أحدًا، يسلّم مرشِّحًا
لا يتوزع الحد عشوائيًا. الكهربائيون والسباكون وفنيو التدفئة والأقفال والغاز يمثلون 47 من أصل 68 إجابة تذكر حدًا؛ والكهربائيون البرازيليون وحدهم 13. هذه هي المهن التي يرفض فيها المساعدون تسمية نشاط بعينه أكثر من غيرها ويوجهون العميل إلى منصة بدلًا من ذلك (بالنسبة إلى السبّاك، الجواب منصة). المرشّح يحل محل الاسم: "افتح خرائط Google، وابحث في حيّك، واحتفظ بمن يتجاوز 4.5 مع عشرات المراجعات". في الولايات المتحدة يكاد هذا النمط لا يوجد: 3 إجابات من أصل 872.
ماذا يعني ذلك إن كنت صاحب النشاط
العميل الذي يتبع هذه النصيحة يرى تقييمك قبل اسمك. بتقييم 4.4 نجوم، أو 4.9 على اثنتي عشرة مراجعة، تخرج من القائمة التي يبنيها، أيًّا كان ما قالته الإجابة عنك. تنتج عن القياس ثلاثة أمور. عدد المراجعات مهم بقدر المتوسط: الإجابات تفضّل صراحة 200 مراجعة بتقييم 4.5 على بضع مراجعات بتقييم 5.0، لذا فطلب مراجعة من كل عميل راضٍ أثمن من حماية علامة كاملة. الحد عند 4.5، فالسؤال المفيد هو كم يفصلك عنه، لا هل تقييمك "جيد". وبعض هذه الإجابات يطلب من العميل قراءة أحدث المراجعات ومراجعات النجمة الواحدة، والتحقق مما إذا كان النشاط قد ردّ: الشكوى التي بلا رد يقرؤها بالضبط العميل الذي أرسله الذكاء الاصطناعي. لا شيء من هذا يجعلك تُسمّى؛ إنه يمنع استبعادك بعد الإجابة.
ما الذي لا يثبته هذا القياس
- هذه إجابات النماذج عبر واجهاتها البرمجية، دون بحث على الويب: الطريقة التي يسأل بها تدقيقنا. مع تفعيل البحث، قد تعرض التطبيقات بطاقات خرائط بالتقييمات الفعلية، وهذا القياس لا يراها.
- أربع دراسات جُمعت بين 30 يوليو و13 سبتمبر 2026، بمرور واحد لكل سؤال. تغيّرت النماذج منذ ذلك الحين، ولا شيء هنا يقيس هذا الانجراف.
- 68 إجابة تذكر حدًا قاعدة صغيرة: 3.7% من إجابات Gemini، وبضع إجابات لكل مهنة ومدينة. النمط واضح حسب الدولة والمحرك؛ أما رقم مهنة منفردة فليس كذلك.
- جرى الفصل بين الحد والنصيحة والتصنيف بقواعد، ثم قُرئ كل مقطع. قد تقع صيغة حدّية على الجانب الخطأ من قاعدة؛ تغيّرت أعداد الدول ببضع وحدات بين مرورينا، ولم يتغير الترتيب.
- لا شيء هنا يبيّن كم عميلًا يطبّق المرشّح فعلًا. يقول القياس ما ينصح به المساعد، لا ما يفعله العملاء.
الأسئلة الشائعة
هل يخبر ChatGPT أو Gemini عملائي بتقييمي؟
ما التقييم الذي أحتاجه ليوصي الذكاء الاصطناعي بنشاطي؟
من أين تأتي هذه الأرقام؟
مقال اليوم، عبر البريد
رسالة واحدة يوميًا على الأكثر. إلغاء الاشتراك بنقرة واحدة. لا يُستخدم عنوانك إلا لهذا. الخصوصية