Eco-GEO: هل نكمل الأدلة أولاً أم نوسّع المحتوى؟ نموذج ميزانية مشروط ب80 ساعة لفريق صغير في الجمال والعناية الشخصية
لفريق صغير يملك بالفعل صفحات مُستشهَد بها في إجابات AI، ويستطيع التحقق المستقل، تقارن هذه المقالة، ضمن ميزانية واحدة قدرها 80 ساعة، بين استكمال الأدلة القائمة وتوسيع المحتوى الجديد. تُعالَج الأخطاء الجسيمة أولاً بصورة مشتركة؛ وحدود مجمع الأسئلة الاختياري يمكن أن تغيّر ترتيب الخيارين، في حين قد تدفع ساعات القياس وحدّ الحد الأدنى للزيادة القرار نحو إيقاف التوسيع. جميع القيم أرقام افتراضية توضيحية، مع قاعدة اختيار موحّدة ودفتر مغلق وست حالات قابلة لإعادة الحساب؛ ويجب فصل النتائج المتوقعة عن القياس اللاحق، فلا تُعدّ أثراً محققاً.
أولاً: الحكم الجوهري — هذه الميزانية تشتري عدداً قابلاً للتحقق، لا «أيّهما أولاً»
نقدّم الحكم أولاً، مع توضيح شروط الانطباق: الجمال والعناية الشخصية، ومرحلة استكشاف PMF، وفريق قادر على استثمار 80 ساعة عمل مشروع خلال 6 أسابيع، ووجود مجموعة قائمة من الصفحات المملوكة سبق أن استُشهد بها في إجابات AI، ووجود شخص ثانٍ يستطيع التحقق المستقل من إجابات AI. في هذا الإطار، تقول هذه المقالة: بعد التصحيح المشترك، سواء أكان الخيار هو استكمال الأدلة أم توسيع المحتوى، يجب أولاً استبعاد الخيارات التي لا تبلغ الحدّ، ثم مقارنة الزيادة التنفيذية بين الخيارات الممكنة. وحدّ مجمع الأسئلة الاختياري |S_X| يمكن أن يعكس ترتيب المعدلات؛ والحدّ G وساعات التنفيذ H_exec يمكن أن يستبعدا خيارات ويدفعا القرار نحو إيقاف التوسيع. وكلاهما يغيّر القرار، وليس كلاهما قادراً على جعل الخيار البطيء يتجاوز السريع. أما لماذا لا تدخل معالجة الأخطاء الجسيمة في الترتيب، فلأنها تكلفة مقدّمة يجب أن يدفعها المساران معاً، وهي في الدفتر نفسه تقدّم المساهمة ذاتها في الزيادة التنفيذية للخيارين، فتُطرح وتتلاشى؛ وعدد الأخطاء يغيّر الحيّز الممكن عبر H_exec، وقد يؤثر في القرار بصورة غير مباشرة، لكن مجرّد وجود أخطاء لا يمنح A أولوية.
ما يتغيّر هنا هو حبيبية الموافقة على الميزانية: لا ينبغي الموافقة على «هل نبدأ بـ A أم B»، بل ينبغي حجز القياس والإصلاح المقدّم المشترك ضمن إجمالي 80 ساعة نفسه، وقبول أن الدورة الأولى لا تنفّذ إلا خياراً رئيسياً واحداً. وهناك ثلاث حالات لعدم الانطباق: إذا لم تُظهر بيانات الإسناد المملوكة أي أثر لجلسات قادمة من واجهات AI، فالقرار المطلوب هو هل تُستثمر هذه ال80 ساعة في GEO، وهذه المقالة لا تجيب عن ذلك؛ وإذا كانت الفئة لا تكاد تتضمن ادعاءات الفعالية وبيانات سلامة المكوّنات (مثل أدوات ومستلزمات التجميل)، فمجمع الأخطاء الجسيمة يقترب من المجموعة الفارغة، ويسقط الجزء الأول من سلسلة القسم الثالث، وينبغي المقارنة مباشرة بحدّي المجمع والحدّ الأدنى وفق القسمين الخامس والثامن؛ وإذا لم يكن لدى الفريق شخص ثانٍ قادر على التحقق المستقل، فكل الأعداد في هذه المقالة غير قابلة للجمع، ولا ينطبق الإطار.
- الإصلاح مقدّم مشترك، وليس خياراً. عندما توجد في خط الأساس أخطاء جسيمة تتضارب مع الأدلة الرسمية، تكون ساعات الإصلاح متساوية بين A وB؛ واحتسابها ميزةً لـ A يبالغ منهجياً في تقدير A، ويجعل الاجتماع يتنازع على مقام خاطئ. لذلك تقيس هذه المقالة ناتج الإصلاح R وتبلّغ عنه منفصلاً، ولا تدمجه في الزيادة التنفيذية لأي طرف.
- القرار محدود بقيودين قابلين للملاحظة: حدّ المجمع والحدّ الأدنى/ساعات التنفيذ. داخل النموذج، إذا اشترك الخياران في H_exec نفسه ولم يكن حيّز التأثير محدوداً، فإن الترتيب يتدهور بالفعل إلى مقارنة مقدارَي p_A وp_B — وهذا افتراض بنيوي مصرّح به في هذه المقالة، وليس اكتشافاً. أما ما ليس بديهياً فيأتي من قيدين قابلين للعدّ: |S_X| يُبطل المعدل المرتفع على مجمع صغير؛ وG وH_exec يُخرِجان المعدل المنخفض مباشرةً عند نقص الساعات. والحالة 3 في الجدول 3 يحكمها قاعدة المجمع، والحالة 5 يحكمها المعدل، فالقاعدتان تتعايشان ولا تحلّ إحداهما محل الأخرى.
- ميزانية القياس هي عنق الزجاجة الحقيقي للفريق الصغير. جولة أخذ عينات واحدة من 40 سؤالاً × 2 منصتين تكلّف نحو 8 ساعات عمل للفريق؛ ويحتاج A/B/S إلى أربع نقاط مراقبة، أي 32 ساعة، وهي 40% من 80 ساعة. وإذا ارتفعت ساعات عمل الفريق لكل وحدة من 0.1 ساعة إلى 0.15 ساعة، تقلّصت ساعات التنفيذ المتاحة لكل من A وB معاً إلى 28 ساعة، ووقع الزيادة المتوقعة لكليهما دون الحدّ، وفي هذه المدخلات التوضيحية ينبغي إيقاف التوسيع والاحتفاظ بالمراقبة والتصحيح الضروري.
إعلان عن أساس الأرقام: في ما يأتي، وخلافاً لما يحمل إشارة إلى مصدر، جميع الأرقام هي افتراضات توضيحية أو قيم اختبار مقترحة من وضع هذه المقالة، وليست معياراً قطاعياً ولا نتائج قياس؛ ويجب معايرة الحدّ G من W المقاس في T0a/T0b لهذه العلامة.
ثانياً: تثبيت القواعد مسبقاً — الوحدات والتجميع والمقام والجامعون
إذا لم يكن العدّ قابلاً للتكرار، صارت كل الجداول اللاحقة مجرد زينة. لذلك نثبّت ستة أشياء أولاً.
- اللوحة: تثبيت 40 سؤالاً مستهدفاً (المكوّنات، الفعالية، حالات الاستخدام، السلامة، الفئات المستهدفة، إلخ)، دون تغيير طوال الجولة.
- الوحدة: 1 سؤال × 1 منصة = 1 استعلام ومراجعة، أي 80 وحدة في الجولة.
- أهلية مستوى المنصة: أن تتضمن إجابة المنصة 1 استشهاد على الأقل يشير إلى أصل مملوك للعلامة (صفحة على نطاق مملوك أو صفحة حساب رسمي للعلامة)، وأن تكون كل الادعاءات الوقائعية في تلك الإجابة عن العلامة متوافقة مع الأدلة الرسمية، وألا تتضمن ادعاءً يتعارض مع أنظمة السوق المعنية.
- أهلية مستوى السؤال: أن تكون 1 منصة على الأقل من المنصتين مؤهلة على مستوى المنصة، وألا تتضمن المنصتان معاً خطأً جسيماً. ووحدة العدّ هي «السؤال»، والمقام ثابت عند 40.
- الخطأ الجسيم e_severe: ادعاء يتضارب مع الأدلة الرسمية (مثل وصف التسجيل/الإدراج بأنه موافقة)، أو ادعاء متجاوز؛ ووحدة العدّ هي «السؤال» أيضاً.
- قيمة التذبذب W: عدد الأسئلة التي انقلبت حالتها في ما يتعلق بأهلية مستوى السؤال بين T0a وT0b (بالأسئلة). يُبلَّغ بالعدد مباشرة، ولا يُحوَّل إلى نسبة، ولا يُستدل منه على دلالة إحصائية.
وتُشتقّ ثلاث كميات أخرى كذلك من جرد خط الأساس: حدّ المجمع |S_A| = عدد الأسئلة التي ما زالت غير مؤهلة في T1، وللصفحات المستشهَد بها القائمة فيها فجوة أدلة يمكن تحسينها بالاستكمال؛ |S_B| = عدد الأسئلة المستهدفة التي ما زالت غير مؤهلة في T1، ولا يوجد لها إطلاقاً محتوى مملوك للعلامة يمكن الاستشهاد به. والمجمعان في هذا النموذج متنافيان، ولا يشملان أسئلة مؤهلة في T1، لذلك لا يجوز أن يتجاوز مجموعهما 40 ناقص q1؛ p_X = الزيادة الحدّية في الأسئلة المؤهلة من T1 (بعد الإصلاح، قبل التنفيذ) إلى T2 (اليوم 14 بعد التنفيذ)، مقسومةً على ساعات التنفيذ التي يستهلكها الخيار. ويُجمع ذلك بأن يضع مراجعان مدرَّبان على مقياس موحّد التصنيفات كلٌّ على حدة، ويُحال الخلاف إلى شخص ثالث للبتّ؛ وتُنفَّذ كل جولة في اليوم نفسه من الأسبوع نفسه وفي الفترة نفسها، بكلمات استعلام مطابقة تماماً لخط الأساس، مع حفظ لقطات الإجابات والطوابع الزمنية. وضبط التحيّز بثلاثة أمور: عدم المقارنة في الأسبوع نفسه الذي يُحدَّث فيه نموذج المنصة؛ وعدم خلط معياري حكم على السؤال نفسه؛ وعدم استبدال أسئلة اللوحة لأن النتائج غير مواتية.
ثالثاً: سلسلة الآلية، وشروط تحقق كل خطوة فيها
السلسلة هي: ترصد المراقبة الأساسية خطأً جسيماً → يظهر ذلك الخطأ في إجابات AI التي تستشهد بالعلامة → يبني المستخدم إدراكاً على المعلومات الخاطئة → ترتفع مخاطر الثقة والامتثال وتنخفض قابلية مقارنة العملاء المحتملين → فلا يستطيع توسيع التغطية إثبات عائد بالمعيار نفسه. وفي هذه السلسلة، الجزء الأول وحده واقعة تشغيلية، أما الأجزاء الأخرى فمختلفة الطبيعة.
يتطلب تحقّق الجزء الثاني أن تستشهد الإجابة فعلاً بصفحة مملوكة للعلامة. ويوفّر AI Performance من Bing أربعة عناصر: إجمالي الاستشهادات، ومتوسط عدد الصفحات المستشهَد بها، وgrounding queries، وعدد الاستشهادات على مستوى الصفحة [S5]؛ ومنها أن قيوداً من نوع «لا يعني الترتيب أو السلطة» واردة في النص الأصلي ملحقةً على التوالي بـ «متوسط عدد الصفحات المستشهَد بها» وبمؤشر الاستشهاد على مستوى الصفحة، أما إجمالي الاستشهادات فلا يقول إلا «لا يعني الموضع والعرض داخل إجابة معينة»، وgrounding queries مجرد عيّنة من نشاط الاستشهاد الكلي. وتوسيع إخلاء المسؤولية الخاص بمؤشر واحد ليصبح إخلاءً لطقم القواعد كله خطأ إسناد شائع [S5].
يتطلب الجزء الثالث أن يكون الخطأ قابلاً للتحقق من دليل خارجي. يوضّح S2 أن تسجيل منشآت مستحضرات التجميل وإدراج المنتجات «ليس إجراء موافقة ولا أداة ترويج»، وأن FDA لا تصدر أي شهادة امتثال [S2]؛ ويُظهر S4 أن الاتحاد الأوروبي يطلب تعيين شخص مسؤول، وإكمال تقرير سلامة المنتج قبل الطرح، والإبلاغ المركزي، ويضع معايير مشتركة للادعاءات [S4]. لذلك فإن «قول AI إن العلامة حصلت على موافقة FDA» خطأ جسيم قابل للتحقق — وهذا استنتاج من هذه المقالة، لا نتيجة مصدر، وحدّ انطباقه سياق الولايات المتحدة والاتحاد الأوروبي، ولا يساوي القواعد الصينية، ولا يثبت تكرار حدوث ذلك الخطأ.
أما الجزء الرابع فيجب تقييده بشرط: توسيع التغطية يضخّم الخطأ في حالة واحدة فقط — أن تتبع المحتويات الجديدة مسار إنتاج المحتوى نفسه المستخدم في الصفحات القديمة (بالنقص نفسه في التحقق الوقائعي المستقل ومراجعة الادعاءات)، وأن تشترك الأسئلة المغطّاة مع الصفحات الخاطئة القائمة في مصادر الأدلة نفسها. وإذا سلك المحتوى الجديد مسار تحقق مستقلاً، فهذا الادعاء لا يصح، وتصبح تكلفة B أساساً تأخير فهرسة الصفحات الجديدة وتغيّر معيار القياس، لا انتشار الخطأ. ولا توجد أي علاقة مقاسة بين الإجابة والشراء أو ترك بيانات الاتصال، فلا تفترض هذه المقالة حجمها، ولا تضرب عدد الاستشهادات في أي معامل لتحويله إلى إيراد. وأقوى تفسير بديل هو أن المستخدم يصحّح بنفسه بعد دخوله صفحة العلامة، فيكون ضرر الإجابة الخاطئة مهملاً. وطريقة الاختبار الوحيدة هي تجميع الجلسات القادمة من واجهات AI بحسب «إجابة صحيحة/خاطئة» ومقارنة السلوك داخل الموقع، وهذا اختبار لا يمكن إنجازه في 80 ساعة، لذلك تتعامل هذه المقالة مع تصفير الأخطاء كشرط دخول (قيد)، لا كادعاء ROI.
رابعاً: ما يمكن أن يدعمه كل نوع من المصادر الأربعة، وما لا يمكن أن يدعمه
التجربة المضبوطة (S3). أجرت تلك الدراسة مقارنة وجهاً لوجه في إعداد توليد معزّز بالاسترجاع من مصدرين مضبوطين: يُعطى لكل سؤال مصدران مرشحان يختلفان في سمة واحدة فقط، ويُسجَّل أيّهما يُستشهَد به أولاً؛ وبُنيت 18 سمة محتوى و4,320 حالة سيناريو—سؤال، وأُجريت 252,000 تجربة عبر ستة نماذج، واستُبدل اسم العلامة بلقب خيالي لاستبعاد تحيّز الألفة [S3]. وتوضح ملاحظة الجدول أن OR > 1 يعني تفضيلاً للنسخة المتوقع فوزها، وأن الخط العريض يعني p < 0.05، مع الإبقاء في الوقت نفسه على علامات تحذير التقارب الخاصة بـ Hessian المنحل والملاءمات الشاذة. وفي صفوف «مع دليل vs بلا دليل» و«واثق vs غامض» و«محايد vs ترويجي»، كانت قيم خلايا النماذج الستة جميعاً أكبر من 1 [S3]؛ لكن هذه النافذة أبقت تحذير التقارب، فلا تحكم هذه المقالة على الدلالة خليةً خلية، ولا تنسب قيمة عمود معيّن إلى نموذج معيّن بوصفها نتيجة عامة لتلك السمة. وما يمكن أن تدعمه جملة واحدة فقط: في ظروف مضبوطة، يكون المحتوى الأكثر اكتمالاً في الأدلة، والأكثر ثقة في التعبير، وغير الترويجي أكثر احتمالاً للاستشهاد به أولاً. وهو نسبة أرجحية، لا احتمال استشهاد، ولا زيادة بنقاط مئوية؛ كما أن الإعداد يغذّي النموذج بمصدرين مرشحين، وليس بيئة فهرسة حقيقية.
وثائق المنصات (S1، S5). يوضّح S1 أنه لكي تصبح الصفحة رابطاً داعماً في AI Overviews أو AI Mode، يجب أن تكون مفهرسة وأن تظهر بصيغة مقتطف في بحث Google، و«لا توجد متطلبات تقنية إضافية غير ذلك»؛ وسياسات البحث وممارسات SEO الأساسية تنتمي إلى معايير وممارسات أوسع، وليست حدّ دخول تقنياً إضافياً تفرضه ميزات AI [S1]. وتذكر الوثيقة نفسها أن النقرات القادمة من صفحات نتائج تتضمن AI Overviews «أعلى جودة» (يمكث المستخدم في الموقع مدة أطول)، وهذا وصف منصة لا قياس علامة؛ وقد يستغرق الزحف والتحديث من عدة أيام إلى عدة أشهر [S1]. وتوضح أيضاً أن ظهور ميزات AI والنقرات عليها تُحتسب ضمن إجمالي الزيارات تحت نوع البحث «Web» في Search Console [S1]، وبناءً عليه تقترح هذه المقالة Search Console أداة مراقبة تكميلية؛ وهذا استنتاج تشغيلي، وليس خطة المراقبة الوحيدة التي يحددها المصدر، ولا يمكن فصل زيارات ميزات AI مباشرةً من ذلك التجميع. ويعطي S5 أساس عدّ الظهور وقيوده بنداً بنداً. ولا يمكن استخدام الاثنين إلا لتصميم المراقبة، لا لإثبات الأثر.
الوثائق التنظيمية (S2، S4). تقدّم معياراً لما يُعدّ خطأً جسيماً قابلاً للتحقق، وينطبق في سياق الولايات المتحدة والاتحاد الأوروبي، ولا يصلح مباشرةً كقاعدة صينية. وهناك مقايضة مقصودة: عدد المنشآت المسجلة (16,398) وعدد المنتجات المدرجة (1,298,361، البيانات حتى 2026/6/30) اللذان يوردهما S2 إحصاء امتثال، وليس مبيعات أو طلباً أو عدد علامات [S2]، ولا تأخذه هذه المقالة مقاماً لحجم السوق أو لأثر GEO.
نموذج القرار الذي بنته هذه المقالة (وليس مصدراً). فالحدود والساعات والحالات في الأقسام من الخامس إلى الثامن يضعها المؤلف كلها، لعرض الصيغ والعتبات الشرطية؛ ويمكن للقارئ استبدالها بقياس علامته وإعادة الحساب، لكنها لا تشكّل ادعاءً عن وقائع خارجية.
خامساً: إطار المقارنة — الحدّ → حدّ المجمع → الترتيب
الصيغ والقيم الآتية كلها من نموذج قرار وضعته هذه المقالة، وليست معياراً قطاعياً، ويجب استبدالها بقياس هذه العلامة. الثوابت: اللوحة 40 سؤالاً، والوحدة = سؤال × منصة، والجولة 80 وحدة؛ وتُحتسب ساعات عمل الفريق لكل وحدة بـ 0.1 ساعة (أي مجموع 4 دقائق للتصنيف المستقل + 2 دقيقتين للمراجعة وقسمة البتّ من شخص ثالث، وهي ساعات مجمّعة للفريق؛ وإذا فُهمت خطأً على أنها 0.1 ساعة لكل من المراجعين الاثنين، بطلت كل الأرقام، انظر القسم العاشر).
- أخذ عينات الجولة الواحدة: H_pass = 40 × 2 × 0.1 = 8 ساعات
- نقاط المراقبة في A/B/S: T0a (خط الأساس)، T0b (إعادة قياس خط الأساس، بفاصل ≥7 أيام)، T1 (بعد الإصلاح، قبل التنفيذ)، T2 (اليوم 14 بعد التنفيذ) → H_meas = 4 × 8 = 32 ساعة
- نقاط المراقبة في C (إيقاف التوسيع): T0a وT0b، ثم جولة إعادة قياس حالة T0c، بمجموع 24 ساعة. ويظل C مطالباً بمعالجة الأخطاء الجسيمة المعروفة، لكنه لا ينفّذ A/B، ولا يضع زوج قياس تنفيذ T1/T2 قابلاً للمقارنة؛ وقد يكون T0c قد تأثر بالتصحيح، فلا يصلح خط أساس غير متدخّل. والجولات الثلاث أقل من A/B/S بجولة، أي توفير 8 ساعات
- الإصلاح المقدّم المشترك: H_fix = 2 × e_severe ساعة
- ساعات التنفيذ: تحت A/B/S، H_exec = 80 − 32 − 2 × e_severe = 48 − 2 × e_severe؛ وتحت C، يُستخدم أولاً 2×e_severe ساعة لتصحيح العبارات الخاطئة أو إزالتها مؤقتاً، وتكون الساعات المُحوَّلة 56−2×e_severe. وإذا كانت هذه القيمة سالبة، فخطة ال80 ساعة غير قابلة للتنفيذ، ويجب على المسؤول إعادة إعداد ميزانية التصحيح الضروري أولاً، ولا يجوز أن يكون استمرار نشر الصفحات الخاطئة طريقةً لتوفير الساعات
- الحدّ: يثبّت هذا النموذج G = 3 أسئلة، وهو مجرد اتفاق توضيحي للقرار. يُستخدم T0a/T0b أولاً للحصول على W؛ وإذا كان W ≥ 3، فلا تعتبر هذه الدورة أن 3 أسئلة كافية لتمييز التذبذب الطبيعي، فيُوقف المقارنة ويُحوَّل إلى C. وإذا كان W < 3، تستخدم القواعد الآتية. وينبغي للمشروع الفعلي أن يحدد الحدّ وطريقة معالجة التذبذب قبل التنفيذ، ولا أن يرفع G لاحقاً للحفاظ على نتيجة معينة؛ ولا يوجد هنا ضمان دلالة إحصائية
- زيادة التنفيذ للخيار: ΔQ_X = min(p_X × H_exec, |S_X|)، وحدتها «سؤال». وهي الزيادة الناتجة عن التنفيذ، ولا تشمل الجزء الذي حوّله الإصلاح المشترك من أسئلة ذات خطأ جسيم إلى مؤهلة؛ ويُسجَّل ذلك الجزء باسم R، ويُقاس من T1 − T0a منفصلاً ويُبلَّغ عنه منفصلاً. والحدّ يقع على ΔQ_X فقط، لا على R
تصنيف الحدّ بثلاث درجات (معيار واحد، يسري في هذا القسم والقسم الثامن والجدول 3):
- دون الحدّ: ΔQ_X < G → غير قابل للتنفيذ في هذه الدورة.
- قريب من الحدّ (مستوفٍ): G ≤ ΔQ_X < G + 1 → مستوفٍ، لكن يجب التحقق منه بالقياس في T2؛ وإذا كانت الزيادة المقاسة في T2 < G، تعود الدورة التالية إلى C.
- مستوفٍ بوضوح: ΔQ_X ≥ G + 1.
ويغطي القرار الحالات كلها بالترتيب: تُعالَج الأخطاء الجسيمة المعروفة أولاً؛ وإذا تعذّر إكمال المعالجة الضرورية ضمن الميزانية، يُوقف هذا الاختبار وتُعاد الميزانية. ثم يُفحص W: إذا كان W ≥ 3، يُختار C. ثم يُفحص H_exec: إذا كان H_exec ≤ 0، يُختار C. وفي الحالات الباقية، يُفحص بنداً بنداً شرطا |S_X| ≥ G وΔQ_X المتوقع في النموذج ≥ G؛ وإذا لم يتحقق أي منهما، فذلك الخيار غير ممكن. وإذا كان الخياران غير ممكنين، يُختار C؛ وإذا كان خيار واحد ممكن، يُختار؛ وإذا كانا ممكنين، يُقدَّم صاحب ΔQ المتوقع الأكبر في النموذج؛ وعند التساوي التام فقط يُختار A وفق اتفاق مسبق، لأن تقدّم معالجة الصفحات القائمة أسهل في التحقق المباشر، بينما تأخذ الصفحات الجديدة وقتاً في الزحف والتحديث [S1]. وقاعدة التعادل هنا اتفاق تشغيلي في هذه المقالة، وليست نتيجة مصدر. والقرب من الحدّ يظل ممكناً، ويجب التحقق منه في T2، ولا يُضاف فرع ضمني من نوع «إذا كان الفرق أقل من 1 سؤال يُختار A». وبالنسبة إلى فريق لا يثق بمدخلات النموذج ولا يستطيع تقدير p، فهذه مجرد مثال شرطي، ولا يجوز أن يحكم بالجدول 3 على الأفضلية الواقعية، بل يختار C أو يصمّم تجربة مقارنة قابلة للقياس.
ولماذا ليس هذا متطابقة؟ لأن الخيارين، إذا كان حيّز تأثيرهما غير محدود واشتركا في H_exec نفسه، يتحول الترتيب بالفعل إلى مقارنة مقدارَي p_A وp_B — وهذا بناء نموذجي، لا اكتشاف، وقد كتبته هذه المقالة صراحةً كافتراض. أما ما ليس بديهياً فيأتي من قيدين: أولهما حدّ المجمع |S_X| الذي يُبطل المعدل المرتفع على مجمع صغير؛ وثانيهما الحدّ G وH_exec اللذان يُخرِجان المعدل المنخفض مباشرةً عند نقص الساعات. وكلاهما قابل للعدّ في خط الأساس، وكل منهما قادر بمفرده على تغيير النتيجة. ومن ذلك قاعدتان قابلتان لإعادة الحساب: قاعدة المجمع — إذا كان |S_X| < G، فلا يمكن تجاوز الحدّ في هذه الدورة مهما ارتفع المعدل؛ وقاعدة الساعات — إذا كان p_X ≤ 0، لا يمكن لهذا الحل أن يبلغ حداً موجباً، فيُستبعد مباشرةً، ولا يُحسب G/p_X؛ وإذا كان p_X > 0، فإن H_exec < G/p_X يعني تعذّر تجاوز الحدّ. وبالعكس مرة: إذا سُمّي أبطأ معدل موثوق p_min (يُؤخذ توضيحياً 0.05)، فإن أي خيار معدله ≤ p_min يحتاج H_exec ≥ 3/0.05 = 60 ساعة ليمكن أن يتجاوز الحدّ؛ ودفتر الأساس في هذه المقالة لا يملك عند e_severe = 2 سوى 44 ساعة، لذلك لا يمكن أن يتجاوز الحدّ إلا خيار معدله p_X ≥ 3/44 ≈ 0.068. وقد حلّت هاتان القاعدتان محل عتبتين في المسودة القديمة بلا مصدر: «فجوة الأدلة ≥30%» و«H_exec ≥30 ساعة»، وهما مستنتجتان عكسياً من الحدّ والساعات، ويمكن للقارئ إعادة حسابهما ببيانات علامته.
سادساً: المقايضات الحقيقية للخيارات الأربعة
الخيارات الأربعة كلها مقيّدة بإجمالي 80 ساعة. ويُقارَن A/B على اللوحة نفسها ونافذة المراقبة نفسها ونقطة بداية T1؛ أما S فيُجرى كتجربة منقسمة على نصف اللوحة، وC يوقف التوسيع، لذلك لا يمكن للاثنين أن يتنحّلا منزلة نتائج A/B الكاملة في الجدول 3. والعمود المفتاحي في الجدول 1 هو «العمل المؤجَّل» — فهو يكتب ما تُخلي عنه الميزانية نفسها كأشياء قابلة للعدّ، لا كمشاعر.
| الخيار | شرط الانطباق (قابل للملاحظة) | مؤشر التحفيز | شدة الموارد | العمل المؤجَّل | شرط التوقف/التوسيع |
|---|---|---|---|---|---|
| A: الإصلاح + استكمال أدلة الصفحات المستشهَد بها القائمة | توجد للصفحات المستشهَد بها القائمة قائمة بفجوات الأدلة، و|S_A| ≥ G | |S_A| ≥ G؛ ΔQ_A ≥ G؛ تصحيح الأخطاء مقدّمة مشتركة لـ A/B | 32 ساعة قياس + 2×e إصلاح + كل H_exec إلى A | تغطية أسئلة جديدة وإنتاج محتوى IP للمؤسس | الزيادة المقاسة في T2 بعد تنفيذ A < G → إيقاف التوسيع للمراجعة؛ وإذا كان مجمع A دون G، لا يُنتقل إلى B إلا إذا كان B ما زال ممكناً والتقدير موثوقاً، وإلا C |
| B: توسيع محتوى جديد بعد الإصلاح | توجد مجموعة أسئلة مستهدفة بلا أي محتوى للعلامة، وΔQ_B ≥ G (p_B تقدير قبلي) | |S_B| ≥ G؛ ΔQ_B ≥ G؛ تصحيح الأخطاء مقدّمة مشتركة لـ A/B | 32 ساعة قياس + 2×e إصلاح + كل H_exec إلى B | استكمال أدلة الصفحات القائمة ومراجعة الاتساق بين الصفحات | الزيادة المقاسة في T2 بعد تنفيذ B < G → إيقاف التوسيع للمراجعة؛ وإذا كان مجمع B دون G، لا يُنتقل إلى A إلا إذا كان A ما زال ممكناً والتقدير موثوقاً، وإلا C |
| S: تقسيم مقترن إلى نصفين، ومقارنة في النافذة نفسها | يجب الحصول في هذه الدورة على أدلة قابلة للمقارنة للمسارين، مع قبول أن لكل ذراع H_exec/2 فقط | تتطابق النصفان في حالة الأهلية الأساسية وفي تركيب |S_A|/|S_B| | 32 ساعة قياس + 2×e إصلاح + تقسيم H_exec بالتساوي (عند e = 2، لكل ذراع 22 ساعة) | حجم الذراع الواحدة: لكل ذراع نصف الساعات فقط، وتنخفض الزيادة المتوقعة في النموذج؛ ويجب إعادة معايرة حدّ كل ذراع | إذا تجاوزت ذراع واحدة الحدّ → توسيعها في الدورة الثانية؛ وإذا لم تتجاوز الذراعان → C |
| C: إيقاف التوسيع والمراقبة وتصحيح الأخطاء | اللوحة غير مبنية، أو الساعات غير كافية، أو التذبذب كبير | H_exec ≤ 0، أو W ≥ 3، أو لم يتجاوز A/B حدّ المجمع والزيادة، أو لا يوجد تقدير موثوق لـ p | ثلاث جولات أخذ عينات 24 ساعة + 2e ساعة للتصحيح الضروري، وتحويل 56−2e؛ وإذا كان 2e > 56 فالميزانية غير قابلة للتنفيذ | كل أعمال المحتوى والاستكمال | تُعاد المقارنة بعد أن تصبح W وe_severe و|S| قابلة للقياس |
لا يضع الجدول 1 ترتيباً إضافياً: بعد التصحيح المشترك، وعند W < 3 وH_exec > 0، إذا كان A وحده ممكناً يُختار A، وإذا كان B وحده ممكناً يُختار B؛ وإذا كانا ممكنين، تُقارن الزيادة المتوقعة ΔQ بالمعيار نفسه، ويُقدَّم الأكبر، وعند التساوي التام يُختار A. ولا يؤثر e_severe إلا في التكلفة المشتركة والساعات المتبقية، ولا يجوز كتابته على أنه «إذا وُجد خطأ وجب اختيار A، وإذا لم يوجد خطأ جاز اختيار B». وإذا وجب مقارنة المسارين في الفترة نفسها، يمكن اختيار S، بتقسيم اللوحة الثابتة إلى نصفين متقابلين وتقسيم ساعات التنفيذ بالتساوي؛ ويضحي S بحجم كل ذراع وبالاستثمار، ويجب إعادة معايرة الحدّ للنصفين، ولا يجوز أن يُدَّعى مباشرةً أن مثال A/B الكامل قد تحقق من S. وإذا لم يكن هناك مدخل معدل موثوق ولا قبول لتقدير قبلي، يُختار C أو يُعدّ مخطط تلك التجربة أولاً.
تكلفة الفرصة ثنائية الاتجاه وقابلة للعدّ. باختيار A: يُتخلى عن تغطية أسئلة جديدة وعن أصول IP للمؤسس، والثمن أن |S_B| لا يُستهلك إطلاقاً في هذه الدورة، وبحساب الدورة 6 أسابيع، تتأخر ساعات B الـ44 (عند e = 2) دورة كاملة، وتبقى تلك الأسئلة خلالها بلا محتوى مملوك للعلامة. باختيار B: يُتخلى عن استكمال أدلة الصفحات القائمة، والثمن أن الصفحات في قائمة |S_A| تظل تنافس على الاستشهاد بشكل أضعف، وأن موعد ظهور الصفحات الجديدة غير قابل للتحكم (يشير S1 إلى أن الزحف والتحديث قد يستغرقان من عدة أيام إلى عدة أشهر) [S1]. باختيار S: يُتخلى عن حجم الذراع الواحدة، ووفق p_A = 0.09 وp_B = 0.05 التوضيحيين، تكون الزيادة المتوقعة لكل ذراع من ساعات 22 هي 1.98 و1.10 على التوالي، وكلتاهما دون الحدّ 3 في المثال الكامل؛ وهذا لا يستلزم احتمالاً للاستيفاء الفعلي. وثمن S تقليص حجم كل ذراع مقابل مراقبة قابلة للمقارنة في النافذة نفسها. باختيار C: يُتخلى عن كل تحسينات المحتوى، ويُقابل ذلك بخط أساس صالح وW وقائمة أخطاء. وإذا لم يكن في T0a أي استشهاد بالعلامة، فهذا لا يعني إلا أن خط الأساس الحالي صفر، ولا يثبت أن الإنتاج الحدّي أدنى؛ وعلى الفريق أن يتحقق أولاً مما إذا كان المحتوى قابلاً للقراءة، وهل للوحة طلب، ووجود أساس لتقدير المعدل، ومع غياب الأساس تؤجل المقارنة.
سابعاً: إغلاق دفتر ال80 ساعة بنداً بنداً
يتخذ الدفتر e_severe = 2 مثالاً (افتراض توضيحي). وقاعدة الإغلاق أن لكل ساعة مصيراً: عند اختيار C تُسجَّل الساعات غير المستخدمة صراحةً باعتبارها «محوَّلة»، ولا يجوز أن تُحتسب التكلفة على كل الساعات وفي الوقت نفسه تُحسب السعة المحوَّلة عائداً من GEO؛ وتُحتسب تكلفة العمل المقدّم المشترك وناتجه مرة واحدة لكل من A وB، دون دعم خفي.
| بند ساعات العمل | الساعات | الصيغة الحسابية | هل يتغير بتغير الخيار؟ | الناتج أو الشرح |
|---|---|---|---|---|
| T0a أخذ عينات خط الأساس | 8 | 40 × 2 × 0.1 | مشترك | q_base، e_severe، |S_A|، |S_B| |
| T0b إعادة قياس خط الأساس (≥7 أيام) | 8 | كما في T0a | مشترك | W (عدد الأسئلة التي انقلبت حالتها المؤهلة) |
| الإصلاح المقدّم المشترك | 4 | 2 × e_severe | مشترك | إصلاح كل الأخطاء الجسيمة؛ والناتج R = q1 − q_base، يُسجَّل منفصلاً |
| T1 أخذ عينات بعد الإصلاح وقبل التنفيذ | 8 | كما في T0a | مشترك | خط الأساس الذي تبدأ منه الزيادة الحدّية، وهو أيضاً نقطة قياس R |
| ساعات التنفيذ (A أو B؛ وS لكل ذراع 22) | 44 | 80 − 32 − 4 | يتغير بتغير الخيار | في A/B تُستثمر بند واحد فقط هذه الدورة؛ ويقسم S الساعات الـ44 بالتساوي |
| T2 أخذ عينات في اليوم 14 بعد التنفيذ | 8 | كما في T0a | مشترك | نقطة نهاية الزيادة الحدّية، مع إعادة فحص تصنيف الحدّ |
| ساعات غير مستخدمة/محوَّلة | 0 | 80 − 32 − 4 − 44 | — | عند اختيار C تكون 56−2e ساعة؛ وعند e = 2 تكون 52 ساعة، ويُسجَّل مصيرها بنداً بنداً |
| المجموع | 80 | 8+8+4+8+44+8 | — | مغلق |
يجب كتابة ثلاث معالجات حدّية في الخطة. أولاً، لا يُنسب R إلى أي خيار: فالإصلاح المقدّم المشترك يحوّل الأسئلة ذات الأخطاء الجسيمة إلى مؤهلة، وتُسجَّل هذه الزيادة في R، ويُبلَّغ عنها للمدير منفصلة، لكنها لا تدخل في ΔQ_A أو ΔQ_B، وإلا وقع تلوّث في المعيار من نوع «كلما كان الإصلاح أعمق بدا A أفضل»؛ ولأن T1 يؤخذ بعد الإصلاح وقبل التنفيذ، يكون R والزيادة التنفيذية قابلين للفصل على مستوى القياس. ثانياً، عند نفاد حيّز الإصلاح: إذا ظهر خطأ جسيم جديد أثناء التنفيذ، تُقدَّم أولاً تصحيح العبارات الخاطئة أو إزالتها مؤقتاً، ويُخصم من H_exec بواقع 2 ساعة/سؤال توضيحياً، وتُعاد كل الخيارات إلى الحساب. وإذا نقصت الساعات، يُوقف التوسيع وتُعاد ميزانية المعالجة الضرورية، ولا يجوز الاكتفاء بالمراقبة مع استمرار نشر خطأ معروف؛ وعندها لا يصلح الاستمرار في الاستناد إلى مثال ال80 ساعة الأصلي للادعاء بأن المشروع ممكن. ثالثاً، السعة المحوَّلة لا تُحسب ناتجاً: فالساعات المحوَّلة لا تدخل في بسط جانب العائد، ولا تُعدّ تكلفة GEO، بل تُترك أثراً في جدول الميزانية فقط، تجنباً لاحتساب التعطيل استثماراً.
ثامناً: الحالات ونقاط الانعكاس وتصنيف الحدّ بثلاث درجات
جميع الأرقام في الجدول الآتي افتراضات توضيحية، وليست معياراً قطاعياً، وتُستخدم فقط لعرض الصيغ والعتبات الشرطية واتجاه الانعكاس. ويُؤخذ الحدّ موحّداً G = 3، بافتراض W = 1 وإنجاز التصحيح المشترك الضروري؛ وفي T1 أصبح q1 = 10 أسئلة مؤهلة، وثمّة 20 سؤالاً تنتمي إلى S_A و10 تنتمي إلى S_B، والمجمعان متنافيان. وكل قيم p مدخلات توضيحية قبلية، لذلك تكون الدرجات الثلاث: ΔQ < 3 دون الحدّ، و3 ≤ ΔQ < 4 قريب من الحدّ (مستوفٍ)، وΔQ ≥ 4 مستوفٍ بوضوح. وΔQ قيمة متوقعة في النموذج؛ أما القياس فلا يكون إلا عدداً صحيحاً، ويجب الفصل بينهما.
| الحالة | H_exec (ساعة) | |S_A|/|S_B| (سؤال) | p_A/p_B (سؤال/ساعة) | ΔQ_A | ΔQ_B | تصنيف الحدّ بثلاث درجات | القرار وأساسه |
|---|---|---|---|---|---|---|---|
| 1 الأساس: e = 2 | 44 | 20/10 | 0.09/0.05 | 3.96 | 2.20 | A قريب من الحدّ (مستوفٍ)؛ B دون الحدّ | A: الخيار الوحيد المستوفي في هذه الدورة، ويجب التحقق منه بالقياس في T2 |
| 2 تغيير p_B = 0.10 فقط | 44 | 20/10 | 0.09/0.10 | 3.96 | 4.40 | A قريب من الحدّ؛ B مستوفٍ بوضوح | B: 4.40 > 3.96، انعكاس المعدل |
| 3 نسبةً إلى الحالة 2، تغيير |S_B| = 2 فقط | 44 | 20/2 | 0.09/0.10 | 3.96 | 2.00 | A قريب من الحدّ؛ B مُستبعد بقاعدة المجمع (|S_B| < 3) | A: |S_B| دون الحدّ، فمهما ارتفع المعدل يصبح غير ممكن |
| 4 |S_A| = 2، والباقي كما في الحالة 1 | 44 | 2/10 | 0.09/0.05 | 2.00 | 2.20 | A دون الحدّ (ومُستبعد بقاعدة المجمع)؛ B دون الحدّ | C: لا خيار مستوفٍ، وتؤجَّل كل إجراءات المحتوى |
| 5 نسبةً إلى الحالة 2، تغيير e = 0 فقط | 48 | 20/10 | 0.09/0.10 | 4.32 | 4.80 | كلاهما مستوفٍ بوضوح | B: تكبر ساعات التنفيذ، ويفوز الأعلى معدلاً |
| 6 نسبةً إلى الحالة 2، تغيير e = 24 فقط | 0 | 20/10 | 0.09/0.10 | 0 | 0 | لا ساعات تنفيذ (48 − 2 × 24 = 0) | C |
وبإعادة كل بند إلى الصيغة الأصلية للتحقق: الحالة 2 تغيّر p_B فقط نسبةً إلى الحالة 1، والحالة 3 تغيّر مجمع B فقط نسبةً إلى الحالة 2؛ وكل مقارنة تغيّر متغيراً واحداً، ويبقى H_exec = 44، وΔQ_A = min(0.09×44, 20) = 3.96 دون تغيير؛ وفي الحالة 3، ΔQ_B = min(0.10×44, 2) = 2.00، دون الحدّ، والاتجاه موافق لقاعدة «المجمع قبل مقارنة المعدل». والحالة 4 تغيّر |S_A| فقط: ΔQ_A = min(0.09×44, 2) = 2.00 < 3، وفي الوقت نفسه |S_A| = 2 < 3 يُستبعد بقاعدة المجمع، وΔQ_B = min(0.05×44, 10) = 2.20 < 3، فلم يبلغ أي من الخيارين الحدّ، لذلك يُختار C، لا «فوز A». والحالة 5 تغيّر e فقط نسبةً إلى الحالة 2: H_exec = 48، وΔQ_A = 4.32 وΔQ_B = 4.80. والحالة 6 تغيّر e فقط نسبةً إلى الحالة 2: H_exec = 0، ولا خيار ممكن. ومن ذلك نحصل على نقطتي انعكاس مختلفتين، وهما الجزء الأكثر فائدة في هذا الإطار: حدّ إمكان B هو p_B ≥ G/H_exec = 3/44 ≈ 0.068؛ وحدّ تفوق B على A، حين لا يقيّد المجمع، هو p_B > p_A = 0.09. وفي الفترة الدقيقة [3/44, 0.09] يكون B ممكناً لكن يجب أن يُختار A؛ و0.068 مجرد تقريب عشري، و0.068×44 = 2.992 لا يبلغ 3، ويجب في الحكم الفعلي استخدام القيمة غير المقربة.
ويجب معالجة الأعداد الصحيحة والقياس منفصلين. فالجدول 3 يقارن القيم المتوقعة في النموذج لخطتين، ولا يجوز تقريبها ثم اختيار الخطة، ولا خلط توقع A البالغ 3.96 مع قياس B البالغ 3. والزيادة الصافية المقاسة في اللوحة الثابتة هي عدد الأسئلة المؤهلة في T2 ناقص عدد الأسئلة المؤهلة في T1، وقد تكون سالبة أو صفراً أو عدداً صحيحاً موجباً؛ والتوقع 2.20 لا يعني أن القياس لا يمكن أن يكون إلا 2 أو 3، بل قد يكون أعلى. وبالنسبة إلى الخيار المنفَّذ فعلاً، إذا كانت الزيادة المقاسة < 3 فهي دون الحدّ التوضيحي، وإذا كانت = 3 فهي قريبة من الحدّ، وإذا كانت ≥ 4 فهي مستوفية بوضوح؛ وهذه التصنيفات ليست فترات ثقة. والدورة الأولى تنفّذ A أو B فقط، لذلك لا يمكن مراقبة الزيادة المضادة للخيار الآخر في النافذة نفسها. وإذا أريدت المقارنة في الدورة التالية، فيجب وجود تجربة مقترنة بالمعيار نفسه أو تقدير قبلي محدَّث بشفافية، مع الإفصاح عن النقطة الزمنية وتغيرات العينة، ولا يجوز إعلان فوز خيار غير منفَّذ استناداً إلى مراقبة واحدة. ويجب تسجيل أي انخفاض في المراقبة أو زيادة صفرية أو تذبذب مستمر، دون قصّ القيم السالبة إلى صفر لتجميل الناتج.
حساب مؤشر واحد مع الصيغة وعرض الحساسية (افتراضات توضيحية، ليست معياراً قطاعياً). المؤشر المستخدم للإبلاغ إلى الإدارة هو «الزيادة في الأسئلة المؤهلة على مستوى السؤال مقابل ميزانية 80 ساعة» = (R + ΔQ_X)/80، وحدته سؤال مؤهل/ساعة. المدخلات: e_severe = 2 → H_exec = 44؛ p_A = 0.09 → ΔQ_A = 3.96؛ R = 2: يُفترض توضيحياً q_base = 8 وq1 = 10، لذلك R = 10−8 = 2. وe_severe يُعدّ أصلاً بالأسئلة، فلا يجوز ضربه في «كم سؤالاً يؤثر فيه كل خطأ». وR فرق ملاحظة بين نقطتين زمنيتين، وقد يتأثر فعلاً بالتذبذب الطبيعي، ولا يساوي تلقائياً أثراً سببياً للتصحيح. النتيجة: (2+3.96)/80 = 0.0745. وتحليل حساسية واحد: إذا كانت ساعات عمل الفريق لكل وحدة 0.15 ساعة لا 0.1 ساعة، يصبح H_pass = 12، وH_meas = 48، وH_exec = 80 − 48 − 4 = 28، وΔQ_A = min(0.09×28, 20) = 2.52 < 3، فلم يبلغ A الحدّ؛ ومع إبقاء p_B = 0.05 من الحالة 1، تكون زيادة B المتوقعة 0.05×28 = 1.40، وهي أيضاً دون الحدّ، فيُحوَّل إلى C. وعندئذ تكون جولات C الثلاث 36 ساعة، والتصحيح الضروري 4 ساعات، والمحوَّل 40 ساعة، بمجموع 80 ساعة؛ وC لا يملك زوج قياس تنفيذ T1/T2، فلا ينطبق عليه مؤشر A/B المذكور.
وثمّة ثلاث نقاط عن هذا المؤشر يجب مواءمتها مع القسم السابع: أولاً، المقام 80 ساعة يشمل الساعات المحوَّلة، وبحسب قاعدة الإغلاق لا تنتج الساعات المحوَّلة ناتجاً من GEO، ولا تدخل في بسط جانب العائد، لذلك يُقرأ هذا المؤشر على أنه «الزيادة في الأسئلة المؤهلة مقابل ميزانية 80 ساعة»، لا «معدل الناتج لكل ساعة مستثمرة»؛ ثانياً، هذا المؤشر معرّف فقط للخيارات التي جرى فيها الإصلاح وقياس T1 (A/B/S)، أما C فيظل يصحّح لكنه لا يضع زوج قياس تنفيذ T1/T2 قابلاً للمقارنة، ولا يمكن فصل R والزيادة التنفيذية بالطريقة نفسها، فلا ينطبق المؤشر؛ ثالثاً، المقام هو دائماً إجمالي ميزانية 80 ساعة، ولا يجوز ضرب عدد الاستشهادات في أي معامل لتحويله إلى إيراد أو عميل محتمل.
تاسعاً: مسار التنفيذ — المسؤول والنافذة الزمنية والمؤشرات وشروط التوقف
الأسابيع الستة جدول توضيحي، وليست نتيجة بحث. وإن قسمة 80 ساعة على 6 أسابيع، أي نحو 13.3 ساعة/أسبوع، ليست إلا سعة متوسطة، ولا تضمن تساوي الحمل كل أسبوع: فلكي يُحصَل على T2 «بعد 14 يوماً من التنفيذ» في نهاية الأسبوع السادس، يجب أن تُنجَز إجراءات المحتوى قبل نهاية الأسبوع الرابع. وعلى المسؤول أن يتأكد من القدرة على تركيز 72 ساعة في الأسابيع الأربعة الأولى، مع حجز 8 ساعات لجولة القياس الأخيرة على حدة؛ وإذا تعذّر ذلك، تُمدَّد نافذة المشروع، ولا يجوز تأخير التنفيذ إلى الأسبوع الخامس ثم الادعاء في الأسبوع السادس بأن المراقبة استمرت 14 يوماً كاملة. وإذا كانت السعة 7 ساعات أسبوعياً فقط، فمجموع ساعات العمل وحده يحتاج إلى نحو 12 أسبوعاً على الأقل، مع التحقق من الفاصل بين خطوط الأساس وانتظار المراقبة. وتثبّت هذه المقالة 40 سؤالاً، ولا تحافظ على الحدّ الأصلي وحدّ المجمع بتقليص اللوحة مؤقتاً.
- الأسبوع 1 (بقيادة مسؤول العلامة ومشاركة مسؤول المحتوى): أخذ عينات T0a لمدة 8 ساعات، وإخراج q_base، وe_severe، و|S_A|، و|S_B|.
- الأسبوع 2: إعادة قياس T0b لمدة 8 ساعات، وإخراج W. وإذا كان W ≥ 3، يُحوَّل إلى C، مع الاحتفاظ أولاً بساعات التصحيح الضروري وإعادة قياس الحالة، وتحويل البنود الأخرى.
- الأسبوعان 2–3 (مسؤول المحتوى + مراجعان): الإصلاح، 2 × e_severe ساعة؛ وإذا كان 48−2×e_severe ≤ 0، تُرتَّب ساعات التصحيح الضروري وإعادة قياس الحالة وفق دفتر C؛ وإذا تجاوز C أيضاً 80 ساعة، يُوقف هذا الاختبار وتُعاد الميزانية.
- الأسبوع 3: أخذ عينات T1 لمدة 8 ساعات، وإخراج q1 وR = q1 − q_base، ويُبلَّغ عن R منفصلاً.
- الأسبوعان 3–4: التنفيذ، بتوجيه H_exec إلى الخيار المختار وفق قواعد القسم الخامس (وإذا اختير S، فلكل ذراع النصف).
- اليوم 14 بعد انتهاء التنفيذ في نهاية الأسبوع الرابع (مسؤول العلامة): أخذ عينات T2 لمدة 8 ساعات، وحساب الزيادة المقاسة للخيار المنفَّذ، وإعادة الفحص وفق القسم الثامن؛ ولا يجوز أن تتنحّل زيادة خيار غير منفَّذ منزلة قياس الفترة نفسها.
معيار جمع المؤشرات (يجب أن يستطيع شخص آخر إعادة إنتاج كل مؤشر): عدد الأسئلة المؤهلة على مستوى السؤال — البسط هو عدد الأسئلة من أصل 40 التي تحقق «منصة واحدة على الأقل مؤهلة على مستوى المنصة ولا خطأ جسيم في المنصتين»، والمقام 40 سؤالاً، ووحدة العينة استعلام واحد لكل سؤال في كل منصة، والجامعان مراجعان اثنان، والنافذة هي اليوم 14 بعد التدخل. e_severe — البسط هو عدد الأسئلة التي فيها خطأ جسيم، ويجب أن يشير الحكم إلى مصدر رسمي (مثل S2 أو S4 أو الأنظمة المحلية)، ويؤكده شخصان مستقلان. W — عدد الأسئلة التي انقلبت حالتها المؤهلة بين جولتين، والمقام أيضاً 40 سؤالاً. |S_X| — يُعدّ مباشرةً من قائمة الأسئلة المجرودة في T0a. ويضم هذا النمط من أخذ العينات 80 وحدة «سؤال × منصة» في الجولة الواحدة، أي 160 وحدة في جولتين؛ وهذا الحجم وحده لا يكفي للحكم فيما إذا كان فارق 2–3 أسئلة يتجاوز التذبذب الطبيعي؛ وينبغي الإبلاغ بالعدد الخام وبـ W. ولا تجري هذه المقالة اختباراً إحصائياً، ولا تدّعي دلالة، ويُستخدم الحدّ كاتفاق قرار فقط.
الاستمرار والتوقف وتعديل الحدّ: إذا بلغت الزيادة المقاسة في الخيار المنفَّذ G وكان التصحيح المشترك قد اكتمل، فيمكن طلب مراجعة الدورة التالية أو توسيعها، دون ادعاء تفوق على خيار غير منفَّذ؛ وإذا لم تبلغ G، يُوقف التوسيع وتُفحص الأسباب والميزانية، ثم يُقرَّر هل تُجرى تجربة مقارنة. ويجب عند اكتشاف أي خطأ جسيم تصحيحه أو إزالته مؤقتاً فوراً، لا انتظار جولتين متتاليتين؛ وإذا تعذّر ذلك، يُوقف هذا الاختبار وتُعاد ميزانية المعالجة الضرورية. وإذا كان مجمع ما دون G، فذلك الخيار غير ممكن في الدورة الحالية، ويجب إعادة عدّ المجمع في الدورة التالية، ولا يجوز التعميم الدائم. وعند W ≥ 3 تُوقف مقارنة الأفضلية وتُتّبع خطة C في المراقبة والتصحيح.
عاشراً: التفسيرات المعارضة والافتراضات وشروط الدحض
أقوى تفسير معارض هو: أن الفريق الصغير محدود الميزانية، فيتخطى 32 ساعة قياس ويضع الساعات مباشرةً في IP المؤسس وأسئلة شائعة جديدة، ليدخل مجمع الاستشهاد بسرعة أكبر بفعل الحداثة. صحيح أن S3 يورد في صف «طابع زمني جديد vs طابع زمني قديم» قيماً أكبر من 1 لكل النماذج [S3]، لكن ذلك تفضيل في إعداد مضبوط بمصدرين، ولا يشمل تأخير الفهرسة الحقيقي ولا عدم يقين الإدراج. وثمن تخطي القياس هو عدم القدرة على إسناد التغير إلى المحتوى الجديد أو إلى انزلاق الصفحات القديمة الطبيعي، وبالتالي عدم القدرة على الإجابة عن السؤال الأهم لدى المدير: ماذا اشترى هذا المال. والتفسير المعارض الثاني هو: أن تصفير الأخطاء غير مهم، والمستخدم يصحّح بنفسه؛ وطريقة الاختبار في القسم الثالث، ولا يمكن إنجازها في 80 ساعة، لذلك تتعامل هذه المقالة معه كشرط دخول فقط.
الافتراضات والقيود والدحض/شروط البطلان:
- افتراضات بنيوية (من وضع النموذج، ليست نتائج): العلاقة بين ΔQ وH_exec خطية؛ وp_X مستقل عن حجم الاستثمار ولا يوجد عائد متناقص؛ وA وB لا يتداخلان على لوحة الأسئلة الـ40 نفسها؛ ويشترك الخياران في H_exec نفسه وخط الأساس نفسه؛ ولا توجد في نافذة المراقبة البالغة 14 يوماً عوامل إرباك مثل تحديث نموذج المنصة أو الموسمية أو تغيرات الحملات؛ واللوحة تمثل حيّز الأسئلة المستهدف. وإذا اختل أي شرط من ذلك، فقد يصبح ترتيب p_A وp_B غير مستقر، وتبطل نتيجة الجدول 3 تبعاً لذلك.
- الجزء المتدهور في النموذج مصرّح به: عندما لا يكون حدّ المجمع قيداً فعلياً ويشترك الخياران في H_exec نفسه، فإن ΔQ_X = p_X × H_exec، ويكون الترتيب مكافئاً لمقارنة p_X، وهو تطابق جبري؛ ولا تعتبره هذه المقالة اكتشافاً، وقيمة الإطار في القيدين القابلين للعدّ (قاعدة المجمع وقاعدة الساعات) وفي اتفاق الترتيب.
- الدورة الأولى لا تستطيع إثبات المعدل بنفسها: فـ A/B ينفّذ مساراً واحداً فقط في المرة، وقيمة p في الدورة الأولى تقدير قبلي مصرّح به؛ ويبني الجدول 3 عليه حساباً شرطياً. أما S فينقسم داخل اللوحة الثابتة، ويضحي بحجم كل ذراع وساعاتها للحصول على مراقبة في الفترة نفسها، وليس ميزانية إضافية من العدم. ومن لا يقبل التقدير القبلي لا يستطيع إلا فحص المجمع والميزانية الكلية، ولا يمكنه حساب G/p عند p مجهول أو ادعاء استيفاء الزيادة؛ وعليه أن يتحول إلى C أو يصمم تجربة مقارنة أولاً.
- طبيعة الأرقام: 80 ساعة، و8 ساعات للجولة الواحدة، و0.1 ساعة ساعات فريق مجمّعة لكل وحدة، و2 ساعة لكل خطأ جسيم، والحدّ الأدنى لـ G وهو 3، ونطاقا الدرجتين G وG+1، وقيم p_A وp_B، وR = 2، كلها افتراضات توضيحية أو قيم اختبار مقترحة، وليست معياراً قطاعياً، ويجب استبدالها بقياس الدورة الأولى لهذه العلامة. ويجب معايرة G بـ W، فهو ليس ثابتاً لا يتغير بتغير المقياس.
- حدود المصادر: S1 وS5 وثيقتا منصات تصفان الوظائف وأساس العدّ لكنهما لا تعدان بأثر؛ وS3 تجربة مضبوطة بمصدرين، وليست بيئة ميدانية، وبعض الملاءمات فيها تحمل تحذير تقارب، ولا يمكن في هذه النافذة تأكيد دلالتها، ونسبة الأرجحية فيها لا تساوي احتمال استشهاد ولا زيادة بنقاط مئوية؛ وS2 وS4 نظمان أمريكي وأوروبي، ولا يساويان المتطلبات الصينية؛ وإحصاءات التسجيل والإدراج في S2 إحصاء امتثال، لا مبيعات ولا طلباً ولا عدد علامات.
- فجوة الأدلة: لا يوجد خط أساس قطاعي في الجمال والعناية الشخصية لاستشهادات AI وأخطائها، ولا علاقة تحوّل مقاسة من الاستشهاد إلى عميل محتمل أو إيراد. ولا تعد هذه المقالة بـ ROI، ولا تضمن الإدراج، ولا تفترض أي وزن لخوارزمية منصة أو آلية ترتيب. والمراجعة البشرية ذاتية، ولم يُجرَ اختبار اتساق (مثل عدم حساب κ)، ولا يُدَّعى وجود دلالة إحصائية.
- شروط الدحض: إذا لم يتغير عدد الأسئلة المؤهلة بعد استكمال الأدلة، يلزم إضعاف الحكم على أثر هذا الإجراء، لكن عدم التغير مرة واحدة لا يدحض S3 نفسه؛ وإذا وُجدت أدلة قابلة للمقارنة تدعم ارتفاع p_B، فيجب أيضاً تأكيد المجمع وحدّ الميزانية قبل اختيار B؛ وإذا ظل W ≥ G مدة طويلة، تُوقف مقارنة A/B وتُكتفى بالمراقبة؛ وإذا اشترك استكمال أدلة A وإصلاح الأخطاء في الصفحات نفسها وتعذّر فصلهما عند T1، فإن مقدمة «طرح المقدّم المشترك وتلاشيه» لا تصح، ويجب قياس الناتج الكامل للمسارين كل على حدة والإبقاء على H_fix.
- نطاق الانطباق: ينطبق هذا الإطار فقط على توزيع الموارد الذي هدفه الحالي «الحصول على استشهادات AI مؤهلة قابلة للتحقق»؛ وإذا تغير الهدف إلى ظهور العلامة أو الزيارات الطبيعية للموقع، وجب استخدام مؤشرات ومعيار مقارنة مختلفين.
نصيحة مباشرة لمسؤولي العلامة والنمو: وزّعوا التمويل على مراحل ضمن إجمالي 80 ساعة نفسه. وافقوا أولاً على قياس T0a/T0b، والتصحيح الضروري، وT1، مع حجز 8 ساعات لـ T2؛ ثم قرروا إطلاق ميزانية تنفيذ A/B بناءً على حدّ المجمع المتحقق منه، وتقدير قبلي شفاف، والساعات المتبقية. وعند غياب p موثوق، تُوقف المقارنة، ولا يجوز ادعاء الحصول قبل التنفيذ على «معدل مقاس في الدورة الأولى». وبعد اكتمال تنفيذ الدورة الأولى ومرور 14 يوماً كاملة، تُستخدم الأعداد الفعلية في مراجعة الدورة التالية. وما يُسلَّم إلى المدير هو أعداد قابلة للتحقق، وبنود تخٍّلٍّ واضحة، وقواعد توقف؛ ويظل التراكم المركّب للعلامة افتراضاً تشغيلياً في انتظار الاختبار.
المصادر والمنهجية
يستند هذا التحليل إلى النصوص المسترجعة من المصادر العامة أدناه. يميز المقال بين الحقائق الخارجية والاستنتاجات التحليلية والافتراضات التوضيحية، ضمن حدود السوق والعينة والتاريخ.
- [S1] AI Features and Your Website | Google Search Central | Documentation | Google for Developers — Google Search Central · تاريخ الاطلاع 2026-09-20
- [S2] Registration & Listing of Cosmetic Product Facilities and Products — US Food and Drug Administration · تاريخ الاطلاع 2026-09-20
- [S3] What Gets Cited: Competitive GEO in AI Answer Engines — arXiv authors · تاريخ الاطلاع 2026-09-20
- [S4] Legislation — European Commission · تاريخ الاطلاع 2026-09-20
- [S5] Introducing AI Performance in Bing Webmaster Tools Public Preview — Microsoft Bing · تاريخ الاطلاع 2026-09-20