كل المهارات

/baseline

مجموعةيقيس أين يقف الناس قبل بناء أي شيء

قِس أين تقف المجموعة فعلًا قبل أن تبني أي شيء

متى تلجأ إليها

شيء ما على وشك أن يُبنى أو يُشترى — وبدون قياسٍ قبليّ لن يستطيع أحد إثبات أنه نجح.

المعاملات

اذكر ما تشاء منها في رسالتك الأولى. لكل واحد قيمة افتراضية، فبإمكانك ألّا تذكر شيئًا. ولا يغيّر أيٌّ منها ما يُعدّ نجاحًا.

صيغة الإثبات
written artifact (افتراضي) · physical demonstration · live interaction · decision under uncertainty
سقف الجهد
an hour (افتراضي) · a day · a week
  1. 1انسخ المستند الكامل أدناه
  2. 2الصقه في ChatGPT أو Claude أو Gemini
  3. 3أجب عن أسئلته — واحدًا تلو الآخر
  4. 4اخرج بمستند مكتوب: قياس نقطة البداية

نحو 10–15 دقيقة من اللصق إلى قياس نقطة البداية مكتمل.

خصّصها — 4 أسئلةنزّل الحزمة

تعمل في ChatGPT وClaude وGemini

المهارة

/baseline — قم بقياس الوضع الحالي للأشخاص قبل أن تبدأ

لك: الصق هذا المستند بالكامل في ChatGPT أو Claude أو Gemini — إلى جانب خريطة النتائج (Outcomes Map) الخاصة بك من /to-outcomes إذا كانت لديك واحدة — ثم اضغط على إرسال. عشرون دقيقة من التصميم الآن هي السبب في قدرتك على إثبات أي شيء لاحقاً: بدون نقطة بداية، لا يوجد لاحقاً. ستحصل على خطة تقرير خط الأساس (Baseline Report): قياس صغير وصادق يمكنك تنفيذه بالفعل هذا الأسبوع. كل ما هو أسفل هذا الخط هو تعليمات للذكاء الاصطناعي.


أنت تقوم بتشغيل /baseline، وهي مهارة من مكتبة تصميم التعلم في Testudy. مهمتك: تصميم قياس لخط الأساس — حيث يقف الجمهور اليوم بشأن الأمور التي من المفترض أن يغيرها التعلم — ومنح المستخدم كل ما يلزم لتنفيذه: الطريقة، والأداة، ونموذج التقرير الذي تدرج فيه النتائج.

فرضيتك، والتي يمكنك التصريح بها: لا يكاد أحد يضع خط أساس، ولهذا السبب لا تستطيع إدارة التطوير والتعلم (L&D) إثبات أي شيء أبداً. المعيار ليس الدقة الأكاديمية. المعيار هو رقم أساسي قابل للدفاع عنه ويمكن لنفس الطريقة إنتاجه مرة أخرى بعد ذلك. الصغير القابل للتكرار يتفوق على الشامل الذي لا يُنفذ أبداً.

ما قد يكون المستخدم قد قدمه لك

  • مستند ## Outcomes Map — produced by /to-outcomes: النتائج هي أهداف القياس الخاصة بك، حرفياً. لا تقم بإعادة اشتقاقها أو صياغتها. تخبرك خطوط الأدلة (Evidence) الخاصة به بالآثار القابلة للملاحظة للبحث عنها.
  • مستند ## Draft Playbook — produced by /extract، ويفضل أن يحمل سطر حالة مراجع من قبل خبير (EXPERT-REVIEWED): خطوات الدليل الخاص به هي أهداف القياس الخاصة بك — قس ما إذا كان الناس يستطيعون القيام بها بالفعل اليوم. الخطوات التي لا تزال تحمل علامات [CHECK: …] غير مؤكدة؛ لا تقس بناءً عليها، وقم بتسميتها في سطر التحذير الخاص بالتقرير بدلاً من ذلك.
  • لاشيء: قم بتشغيل الاستيعاب أدناه.

إذا كانت الأداة موجودة بالفعل — استبيان، أو نموذج، أو مقياس تقدير تشغله المنظومة بالفعل — فاقتبس سيقان الأسئلة الخاصة بها حرفياً في التقرير، تماماً كما يراها المجيبون. لا تقم أبداً بتحريف الساق إلى ما تعتقد أنه يقيسه: المقياس المقدم بعبارة "ما مدى ثقتك في..." يقيس الثقة المبلغ عنها ذاتياً، مهما كان المعنى الذي يفضله القارئ. إذا كان فهمك لما يلتقطه المقياس يختلف عما تطلبه الساق حرفياً، فاطبع الاثنين معاً وسمِّ الاختلاف كقيود — البديل هو ادعاء واثق حول البيانات لا تدعمه الأداة.

المعايير — كلها اختيارية. يجوز للمستخدم ذكر أي منها في رسالته. كل منها له افتراضي؛ وإذا لم يتم تقديم أي منها، فاعمل على الافتراضات دون سؤال. لا تستجوب المستخدم أبداً بحثاً عن المعايير.

  • وضع العرض (demonstration mode)written artifact (افتراضي) · physical demonstration · live interaction · decision under uncertainty. هذا يوجه اختيار الطريقة في الخطوة 2: يفضل written artifact تدقيق منتج العمل؛ بينما يجبر physical demonstration و live interaction عادةً مهمة ملاحظة، نظراً لعدم وجود أثر مكتوب لأخذ عينات منه.
  • سقف الجهد (effort ceiling) — ساعة · يوم · أسبوع (افتراضي: ما يذكره المستخدم في الاستيعاب). قلل حجم العينة والدقة لتناسبه، ولا تقلل أبداً من صدق الطريقة.
  • إذا كان العمل عملياً بشكل واضح أو تعارفياً ولم يتم ذكر أي وضع،
  • اسأل مرة واحدة قبل اختيار الطرق: تدقيق منتج العمل مستحيل حيث لا يترك العمل أي أثر مكتوب، والافتراض هناك بصمت ينتج عنه قياس للشيء الخطأ.
  • إذا طلب المستخدم أنماط التعلم (بصري، سمعي، حركي)، فارفض في جملة واحدة واعرض البديل في نفس اللحظة — السؤال المفيد
  • ليس كيف يفضل شخص ما تلقي المعلومات بل كيف يتم إثبات كفاءته، وهو ما يحدده وضع العرض. لا تترك الرفض معلقاً أبداً؛ الرفض المجرد يُقرأ على أنه ازدراء لاهتمام عملي حقيقي.
  • إذا لم يتم لصق خريطة نتائج ولم يكن لدى المستخدم واحدة، فلا ترسلهم
  • بعيداً باسم ملف: قل إنك في خطوة الصورة قبل البدء، وأن ما ينقصك هو قائمة قصيرة بما يجب أن يكون الناس قادرين على فعله، وأنه يمكنك إما أخذ تلك القائمة أو بناء قائمة تقريبية هنا في خمسة أسئلة. ثم قم بتشغيل الاستيعاب.
  • لا يجوز لأي معيار أن يستبدل الكفاءة المبلغ عنها ذاتياً بكفاءة مثبتة، أو يجعل الطريقة غير قابلة للتكرار.

العملية

الخطوة 1 — الاستيعاب (intake). تخطَّ كل ما يجيب عليه بالفعل مستند ملصق. سؤال واحد لكل رسالة — أبداً قائمة مرقمة من الأسئلة، أبداً سؤالين مدمجين في دور واحد. بحد أقصى 5: ما الذي يجب أن يكون الناس قادرين على فعله (إذا لم يتم لصق خريطة)؛ كم عدد الأشخاص ومدى إمكانية الوصول إليهم؛ ما هي الآثار التي يتركها العمل بالفعل (تذاكر، مستندات، تسجيلات، تعليقات مراجعة)؛ ما هو الجهد الذي يمكن للمستخدم إنفاقه بصدق على هذا — ساعة، يوم، أسبوع؛ هل هناك احتمال لأن يعترض أحد على قياسه؟ المواضيع هي أرضية يجب تغطيتها، وليست استبياناً للإرسال — اطرحها واحدة تلو الأخرى.

الخطوة 2 — اختيار الطرق (choose methods). لكل نتيجة (أو النتائج الـ 3-5 الأهم، إذا كانت الخريطة طويلة)، اقترح أرخص طريقة تعطي رقماً قابلاً للتكرار، مستمدة من:

  • تدقيق منتج العمل (Work-product audit) — قم بمعاينة القطع الأثرية الموجودة (تذاكر، مستندات، كود، مكالمات) وقم بتقييمها مقابل قاعدة تقييم بسيطة. وعادة ما تكون الأفضل: لا يتم أخذ وقت أحد والبيانات موجودة بالفعل.
  • مهمة ملاحظة (Observed task) — عينة صغيرة من الناس تقوم بمهمة نموذجية واحدة؛ يقوم شخص ما بتقييمها مقابل قاعدة التقييم.
  • نبض المدير (Manager pulse) — يقوم المدراء بتقييم فرقهم مقابل عبارات النتائج. رخيصة، متحيزة، صادقة إذا تم تصنيفها؛ تستخدم عندما لا يناسبها شيء أفضل.
  • تقرير ذاتي (Self-report) — الملاذ الأخير، وفقط لحقائق "هل سبق لك / كم مرة"، وليس أبداً لـ "ما مدى جودتك".

اذكر المقايضة لكل خيار في سطر واحد. حذر مرة واحدة، بوضوح، إذا دفع المستخدم نحو الكفاءة المبلغ عنها ذاتياً: فلن تنجو من الاحتكاك بالقيادة.

الخطوة 3 — بناء الأداة (build the instrument). للطرق المختارة، أنتج المواد الفعلية: قاعدة التقييم (3 مستويات لكل نتيجة — لا يستطيع بعد / جزئياً / يستطيع — كل مستوى موصوف بشكل قابل للملاحظة)، تعليمات أخذ العينات ("اسحب آخر 20 تذكرة أغلقت بواسطة وكلاء مختلفين")، والسيناريو أو الرسالة التي يتم تشغيلها بها. قاعدة عدم الكشف عن الهوية: يتم الإبلاغ عن النتائج بشكل إجمالي، وليس أبداً كترتيب مع الأسماء — قل ذلك في المواد نفسها.

القطعة الأثرية (The artifact)

## Baseline Report — produced by /baseline

**Measuring against:** <the Outcomes Map, or the intake answers>
**Status: DESIGNED — awaiting data** <flips to MEASURED once results are in>
**Constraints inherited:** <promises and limits carried in from upstream — confidentiality, scope, fixed tools or formats — copied forward verbatim, or "None stated".>
**Last reconciled:** <what this was last checked against, and when. If a decision has moved since, this document is stale until re-emitted.>

### What we're measuring, and how
| Outcome | Method | Sample | Effort |
<one row per measured outcome>

### The rubric
<per outcome: the three observable levels>

### How to run it
<numbered steps someone could follow this week, including the sampling
instruction and any message/script to send>

### Results
<empty at design time. When data arrives: per outcome, the distribution
across the three levels, the sample size, and one honest caveat line.>

### Read-out
<empty at design time. When data arrives: 3 sentences max — where people
are, where the gap is biggest, what that implies for the learning design.>

السطر الأول من المستند هو بالضبط ## Baseline Report — produced by /baseline — حرفياً، لا يُعاد صياغته أبداً: المهارات اللاحقة تتعرف على المستند من خلال هذا السطر.

إذا عاد المستخدم إلى الدردشة ببيانات تم جمعها، فاملأ Results و Read-out، واقلب سطر الحالة، وأعد إصدار التقرير بأكمله.

القيود والتقادم (Constraints and staleness)

قاعدتان تنطبقان على كل مستند تصدره هنا، لأن السلسلة تكون صادقة فقط بقدر ما ينجو من كل قفزة.

القيود تسافر. أي شيء وعد به المستند المنبع أو حظره ملزم لهذا المستند، ويجب إعادة بيانه في Constraints inherited بدلاً من افتراض أنه تم تذكره. الحالة الأكثر أهمية: تقرير خط الأساس الذي تم جمعها تحت وعد بعدم الكشف عن الهوية يحمل هذا الوعد في كل ما مشتق منه — قد لا تسمي الأفراد، أو ترتبهم، أو تعين أدواراً يمكن للإجابات الفردية وحدها تحديدها، بغض النظر عن مدى فائدة ذلك. إن إكسار وعد السرية مستندين في الإنابة لا يزال كسراً له، والشخص الذي قطع الوعد ليس في الغرفة ليلاحظ.

قل متى يتحرك القرار. إذا قام المستخدم بتغيير شيء تم حسمه بالفعل منبعياً — النطاق، أو التنسيق، أو الأدوات، أو من هو الجمهور، أو ماจะเป็น التقييم — فلا تكتب النسخة الجديدة بهدوء. سمِّ المستندات السابقة التي أصبحت الآن قديمة، وقم بإدراجها، وأخبر المستخدم بإعادة تشغيل المهارة المتأثرة وإعادة إصدارها. ثم قم بتحديث Last reconciled. النص المنبع القديم هو الفشل الذي لا يلاحظه أحد، لأن كل مستند فردي لا يزال يقرأ بشكل جيد.

شريط الجودة — تحقق قبل الإصدار

  • يتم ملء Constraints inherited، ويتم تكرار أي وعد بالسرية أو النطاق من المنبع هنا بدلاً من افتراضه. إذا تحرك قرار خلال هذه الجلسة، يتم تسمية المستندات التي تبطلها.
  • كل نتيجة مقاسة تأتي حرفياً من الخريطة، أو خطوات الدليل المراجعة، أو إجابات المستخدم.
  • كل طريقة تنتج رقماً يمكن لنفس الطريقة إعادة إنتاجه بعد شحن التعلم — إذا تعذر تشغيلها مرتين، فهي ليست خط أساس.
  • مستويات قاعدة التقييم هي سلوكيات قابلة للملاحظة، وليست صفات ("يكتب ملخص التصعيد بدون مساعدة"، وليس "مهارات تصعيد جيدة").
  • يحترم إجمالي الجهد ما قال المستخدم إنه يمكنه إنفاقه. التصميم الذي لن يقوم بتشقلبه لا يساوي شيئاً؛ قل ما قمت بقطع لتناسبه.
  • تقول المواد، بوضوح، أن النتائج مجمعة فقط.

التسليم (Hand-off)

فوراً بعد القطعة الأثرية، في نفس الرسالة، اختم بهذا التوجيه بالضبط:

انسخ تقرير خط الأساس وقم بتشغيله قبل بناء أي محتوى — إنه صورة ما قبل البدء، وهي لا تعمل إلا إذا تم التقاطها أولاً. عندما تكون مستعداً لتصميم الفحص الذي سيأخذه الناس بعد التعلم، ابدأ دردشة جديدة باستخدام مهارة /assess والصق هذا التقرير (وخريطة النتائج الخاصة بك) فيه — قياس ما بعد بالمعيار نفسه هو ما يجعل المقارنة قابلة للدفاع عنها.

مثال حقيقي

تشغيل فعلي لهذه المهارة — الحوار والمستند الذي أنتجته — لتحكم على ما ستحصل عليه قبل أن تمضي الدقائق العشر.

تشغيل حقيقي لأداة /baseline، مع تنقيح خفيف — المحادثة أدناه حدثت هكذا تماماً.

الذكاء الاصطناعي: دعنا نعدّ خط الأساس الخاص بك ليكون لديك "صورة قبلية" موثوقة يمكن لقسم التعلم والتطوير (L&D) الدفاع عنها لاحقاً.

(ملاحظة: إذا كانت لديك خريطة مخرجات من /to-outcomes، الصقها هنا. وإن لم تكن، فلا تقلق أبداً.)

لبدء مرحلة جمع البيانات: ما هو الأمر الأساسي الذي يجب أن يكون بمقدور الأشخاص فعله بعد هذا التعلم والذي لا يستطيعون فعله بشكل موثوق اليوم؟

المستخدم: يحتاج الوكيل إلى كتابة حالات التصعيد بطريقة يمكن للمستوي الثاني (Tier 2) التعامل معها دون طرح أسئلة، وحل طلبات الاسترداد العادية دون مساعدة.

الذكاء الاصطناعي: هذا يمنحنا سلوكين واضحين للغاية وقابلين للملاحظة لنرتكز عليهما.

السؤال التالي: تقريباً كم عدد الوكلاء الذين نتحدث عنهم، ومدى سهولة التواصل معهم (مثلاً: كلهم على Slack، موزعون عالمياً، وغالباً بشكل غير متزامن)؟

... تستمر المحادثة — 3 تبادلات أخرى — ثم يكتب الذكاء الاصطناعي المستند:


Baseline Report — produced by /baseline

Measuring against:

  1. Agents write escalations tier 2 can act on without questions.
  2. Agents resolve standard refunds unaided.

Status: DESIGNED — awaiting data

What we're measuring, and how

OutcomeMethodSampleEffort
1. Write Tier 2-ready escalationsWork-product auditLast 30 escalated tickets (15 per auditor)3 hours total
2. Resolve standard refunds unaidedWork-product auditLast 30 closed refund tickets (15 per auditor)3 hours total

(ملاحظة: مع 6 ساعات من الجهد المشترك بينك وبين زميلك، يمكنك بسهولة سحب وتقييم عينة إجمالية من 30 تذكرة—15 لكل مخرج—مما يمنحك خط أساس قوي إحصائياً لفريق مكون من 30 عضواً).

The rubric

Outcome 1: Tier-ready escalations

  • Level 1 (Can't yet): التصعيد يفتقر إلى السياق الرئيسي (مثل: خطوات العميل التي تم اتخاذها بالفعل، أو رموز الخطأ، أو تفاصيل الحساب)، مما يتطلب من المستوي الثاني (Tier 2) طرح أسئلة متابعة قبل التحقيق.
  • Level 2 (Partly): التصعيد يحتوي على معظم المعلومات الضرورية، لكنه ينقصه تفصيل بسيط واحد أو يتطلب تفسيراً خفيفاً من المستوي الثاني (Tier 2).
  • Level 3 (Can): التصعيد شامل ومنظم ويحتوي على كل السياق السجلات وخطوات استكشاف الأخطاء وإصلاحها الضرورية؛ ويمكن للمستوي الثاني (Tier 2) التصرف فوراً دون طرح أسئلة.

Outcome 2: Standard refund resolution

  • Level 1 (Can't yet): طلب الاسترداد يتطلب موافقة المشرف، أو يتم معالجته بمبلغ غير صحيح، أو يفتقر إلى ملاحظات السياسة/التوثيق المطلوبة.
  • Level 2 (Partly): طلب الاسترداد صحيح وموافق للسياسة، لكنه يتطلب توقيع مشرف أو يحتوي على تصنيف/ملاحظات غير مكتملة للتذكرة.
  • Level 3 (Can): طلب الاسترداد صحيح تماماً وموافق للسياسة ومصنف بشكل صحيح ومعالج بالكامل دون أي مساعدة من البداية إلى النهاية.

(قاعدة عدم الكشف عن الهوية: سيتم تسجيل جميع النتائج والإبلاغ عنها بشكل مجمع على مستوى الفريق/الدفعة فقط. سيتم إزالة أسماء الوكلاء الأفراد من ورقة التدقيق قبل التقييم. لن يتم نشر أي تصنيفات تحمل أسماء أبداً).

How to run it

  1. Pull the samples (30 mins):
    • في Zendesk، قم بتصدير آخر 30 تذكرة حيث الحالة = مُصعَّدة إلى المستوى الثاني (Escalated to Tier 2) (تم إنشاؤها خلال الـ 30 يوماً الماضية).
    • قم بتصدير آخر 30 تذكرة حيث كان القالب/الوسم (macro/tag) هو استرداد قياسي (Standard Refund) والحالة = تم الحل (Solved) (تم إنشاؤها خلال الـ 30 يوماً الماضية).
    • قم بإزالة أسماء الوكلاء وقم تعيين معرف عشوائي لكل تذكرة (التذكرة 1 إلى 30 لكل فئة).
  2. Split the work (15 mins):
    • قم بتقسيم جدول البيانات: تأخذ أنت التذاكر من 1 إلى 15 للفئتين؛ ويأخذ زميلك التذاكر من 16 إلى 30.
    • فحص المعايرة: قم بتقييم أول تذكرتين معاً للتأكد من أنك وزميلك متوافقان حول ما يشكل المستوى 1 مقابل المستوى 2 مقابل المستوى 3.
  3. Score the artifacts (4 hours total / 2 hours each):
    • راجع كل تذكرة مقابل المعيار أعلاه وسجل النتيجة (1، أو 2، أو 3) في متتبع مشترك.
  4. Calculate the baseline (1 hour):
    • احسب النسب المئوية لكل مستوى (مثلاً: X% في المستوي 1 حالياً، Y% في المستوي 2، Z% في المستوي 3) لتحديد أرقام خط الأساس الخاصة بك.

Results

(فارغ وقت التصميم. عند وصول البيانات: لكل مخرج، التوزيع عبر المستويات الثلاثة، وحجم العينة، وسطر تحذيري واحد صادق).

Read-out

(فارغ وقت التصميم. عند وصول البيانات: 3 جُمل كحد أقصى — أين يتواجد الأشخاص، وأين تقع الفجوة الأكبر، وماذا يعني ذلك لتصميم التعلم).


احتفظ بهذه، لا تلصقها فحسب.

المكتبة كاملة كمجلّد تحمّله أداتك بالاسم.

نزّل الحزمة
  1. 01فُكّ ضغط التنزيل.
  2. 02انسخ محتوى مجلّد `skills/` إلى `.claude/skills/` داخل مشروعك (أو إلى `~/.claude/skills/` لتكون متاحة في كل مكان).
  3. 03شغّل Claude Code. كل مهارة تُحمَّل بالاسم — اطلب `/start` فتعمل.
  4. 04الصق موادّك في الرسالة نفسها؛ فالمهارة تقرأها قبل أن تسأل أي شيء.

القاعدة الوحيدة التي تربطها ببعضها

كل مهارة تنتهي بمستند يحمل عنوانه الأول اسمها — «## Outcomes Map — produced by /to-outcomes». بهذا السطر تتعرّف المهارة التالية على ما لصقته. أبقِه، والصق المستندات كاملة.

هذه النسخة مكتوبة للجميع.

نسختك ستعرف مجالك وقيودك ومفرداتك. أربعة أسئلة، فتعرف عالمك.

خصّصها لوضعي

التالي في المسار

عند الانتهاء، انسخ قياس نقطة البداية الذي أُنتج وابدأ به المهارة التالية.