SSD Nodes Learn Hosting plans →
الأدلة Matt Connorبقلم Matt Connor · آخر تحديث في 2026-08-23

طريقة Fable: مهارات تعمل مع أي نموذج

حوّل عادات Claude Fable 5 إلى مهارات لوكلائك، وافهم دور كل ملف وما ينتقل إلى نماذج أخرى، ثم اختبر الفرق بتجربة A/B على VPS واحد مع حساب التكلفة.

ما الذي تدّعيه طريقة Fable فعلياً

طريقة Fable هي مجموعة صغيرة من مهارات الوكيل تدوّن عادات عمل نموذج واحد في إجراء مرتب، بحيث يستطيع نموذج مختلف تنفيذ الإجراء نفسه. المستودع هو Sahir619/fable-method، ومرخّص بموجب MIT. أما وصفه المختصر في سطر واحد فهو: "كيفية عمل Claude Fable 5، بعد استخلاصها في مهارات يمكن لأي نموذج تنفيذها، مع تقييم يحافظ على دقتها." والجزء الثاني من هذه الجملة هو الادعاء الذي يستحق الاختبار.

لا يستطيع أي شخص خارج Anthropic التحقق مما إذا كان ملف نصي يلتقط فعلاً طريقة تفكير نموذج محدد. لكن يمكنك التحقق بنفسك مما إذا كان نموذج أقل تكلفة يتصرف بشكل مختلف عند قراءة هذا الملف، وذلك على VPS واحد وفي فترة بعد الظهر. هذا القياس هو الهدف من كل ما يلي: تنفيذ المهمة نفسها مرتين، مع الطريقة ومن دونها، مع حساب استدعاءات الأدوات والتكلفة.

إذا كانت كلمة skill جديدة عليك، فابدأ بقراءة ما هي مهارة الوكيل فعلياً: مجلد يحتوي على ملف SKILL.md، ويحدد وصف frontmatter فيه متى يحمّل الوكيل محتوى الملف. ويتناول تكلفة Claude Fable 5 وما يجيده النموذج الذي سُمّي المستودع باسمه.

ثبّت المهارات، وثبّت الإصدار الذي تختبره

هناك مساران للتثبيت. داخل Claude Code، يتكوّن مسار الإضافة من أمرين:

/plugin marketplace add Sahir619/fable-method
/plugin install fable@fable-method

على VPS، عندما تريد نسخة محددة الإصدار على القرص، انسخ المستودع ثم انتقل إلى tag أولاً:

git clone https://github.com/Sahir619/fable-method ~/fable-method
cd ~/fable-method
git checkout v1.4.0
bash install.sh
ls ~/.claude/skills

لا يحتاج install.sh إلى sudo لأنه يكتب فقط ضمن $HOME/.claude/skills. بعد تشغيله، يعرض ls ~/.claude/skills كلاً من fable-judge وfable-loop وfable-method. تحقّق مما لا يظهر. يحتوي المستودع على أربع مهارات، بينما ينسخ مُثبّت shell ثلاثاً منها، لذلك لا يحصل المستخدم المستقل على fable-domain إلا إذا نسخها يدوياً:

cp -r ~/fable-method/skills/fable-domain ~/.claude/skills/

ثبّت tag، واكتب tag بجانب النتائج التي تحصل عليها. نشر هذا المستودع خمسة إصدارات بين 2026-07-06 و2026-07-15، من v1.0.0 إلى v1.4.0، وغيّر v1.4.0 المنهج نفسه بإضافة بوابة توجيه جديدة. حتى أغسطس 2026، لا يزال v1.4.0 أحدث tag. إذا قرأت عملية التحكم إصداراً من القواعد وقرأت عملية الاختبار إصداراً آخر، فأنت لم تقس شيئاً.

ما الذي تطلبه كل مهارة من النموذج

الملف المحوري هو skills/fable-method/SKILL.md. يحتوي على بوابتين وسبع خطوات مرقّمة، وقواعده محددة بما يكفي لمناقشتها.

تأتي بوابة البساطة أولاً: نفّذ التغيير مباشرةً ومن دون إجراءات شكلية عندما يمس ملفاً واحداً، ويستغرق نحو 10 أسطر أو أقل، ولا يضيف سلوكاً جديداً، وتعرف مسبقاً ما الذي يجب تغييره بالضبط. بُنيت مهارة مستقلة كاملة على هذا الحدس وحده، وهي Ponytail، التي تدفع الوكيل إلى إجراء أصغر تغيير يحقق النتيجة المطلوبة، وقاعدتها الأساسية قصيرة بما يكفي لنسخها إلى تعليماتك من دون تثبيت أي شيء. ثم تأتي بوابة الملاءمة، التي توجّه الطلب وفق مكان وجود الإجابة: مصادر يمكنك فتحها، أو تقنية يجب البحث عنها أولاً، أو استنتاجك الخاص، الذي يجب وسمه بأنه منخفض الثقة بدلاً من عرضه كحقيقة. لا يعمل الفرع الأوسط إلا إذا كان الوكيل قادراً فعلياً على الوصول إلى الويب. وفي VPS مقيّد، يعني ذلك تزويده بواجهة بحث خاصة به، مثل مثيل SearXNG مستضاف ذاتياً ومكشوف كأداة بحث JSON.

ثم تأتي الحلقة: صنّف الطلب، وحدد معنى الاكتمال، واجمع الأدلة، واتخذ القرار، ونفّذ، وتحقق، وأبلغ. تنص الخطوة 2 على بدء الاستيعاب بسرد محتويات الدليل قبل اختيار الملفات، وتفضيل المصادر الأولية على التذكر، والتوقف بعد عمليتي بحث متتاليتين لا تعيدان أي معلومات جديدة. وتنص الخطوة 4 على كتابة سطر INTENT: قبل أي تعديل، مع ذكر ما يفعله الكود، وما يتوقعه الفحص الفاشل، وما تنص عليه المواصفة. ولا يجوز إجراء أي تعديل عندما تختلف هذه العناصر الثلاثة، لأن الاختلاف هو النتيجة المهمة فعلياً. وتضع الخطوة 5 حداً لإعادة المحاولة: بعد ثلاث دورات فاشلة من الإصلاح والتحقق للمشكلة نفسها، توقّف وأعد النتيجة مع المخرجات الفعلية.

الجزء الأسهل للاختبار في الملف هو رموز التقرير الأربعة. يتطلب تغيير السلوك سطر INTENT:. ويتطلب الإجراء الموجّه إلى الخارج AUTH: user said "<exact words>" مع اقتباس المستخدم، لأن المستودع ينص بوضوح على أن التوثيق ليس تفويضاً. ويتطلب الإجراء الموصى به لكن غير المنفّذ سطر PENDING:. ويتطلب العيب الذي جرى إصلاحه TWINS: searched <pattern> - found <N> other sites. لا تحتاج إلى تصديق أي شيء عن المنهج للتحقق من ظهور هذه السلاسل الأربع عندما تكون مطلوبة. وهذا ما يجعل العملية قابلة للقياس بدلاً من اعتمادها على الانطباعات.

fable-loop هو المنهج نفسه عند تشغيله كتنسيق من أربع مراحل: التخطيط باستخدام وكلاء فرعيين متوازيين لجمع الأدلة، والتنفيذ في المسار الرئيسي، والتحقق باستخدام من وكيل إلى ثلاثة وكلاء فرعيين مهاجمين، يتخذ كل منهم زاوية مختلفة، ثم التدقيق وإعداد التقرير. ويفترض استخدام نماذج منخفضة التكلفة في أدوار جمع الأدلة والهجوم، ونموذج أقوى لاتخاذ القرارات وإجراء التعديلات.

fable-judge هو الجزء الذي يستحق التثبيت حتى لو تخلّيت عن بقية الأجزاء. وموقفه هو أن «التقرير مجموعة من الادعاءات، وليس دليلاً». يجمع الادعاءات من التقرير المكتمل، ويثبت الحقيقة المرجعية من git diff وgit status، ويعيد تنفيذ كل عملية تحقق يذكر التقرير أنه نفّذها، ويبحث عن قائمة احتيال محددة: إضعاف الفحوص، والإكمال الزائف، وتوسيع النطاق، والإجراء غير المصرّح به، وخيانة المواصفة، والمخلفات المتبقية. ويعيد إحدى النتائج VERIFIED أو VERIFIED WITH CAVEATS أو REFUTED، ويضع وسم UNVERIFIABLE على كل ما يتعذر إعادة إنتاجه بدلاً من افتراض نجاحه. وتشير الجملة الختامية للمثبّت إليه مباشرةً: «جرّبه: افتح Claude Code واكتب /fable-judge بعد أن يدّعي أي وكيل أن العمل اكتمل». وإذا كنت تفضّل دمج هذا الفحص في العمل بدلاً من تشغيله بعد ذلك، فإن مهارة Old Coder تجعل الوكيل ينتج SPEC توافق عليها، وتقرير EVIDENCE يمكنك إعادة تشغيله بنفسك، مع استخدام اختبار الطفرات بديلاً عن التغطية لإثبات أن الاختبار سيلتقط التراجع فعلاً.

تُنشئ fable-domain حزم محوّلات للمجالات، مع تجهيزات اختبار للفخاخ وتقييمات smoke. وتأتي ثمانية محوّلات: التسويق، والبحث، وتحليل البيانات، والأعمال والعمليات، والمالية، والشؤون القانونية والامتثال، والتصميم وتجربة المستخدم، وDevOps. أما العمل الطبي والسريري، فقد تُرك عمداً من دون محوّل.

ما الذي يمكن نقله إلى نموذج آخر، وما الذي لا يمكن نقله

يجيب المستودع عن ذلك مباشرةً عبر AGENTS.md، الذي يبدأ بالنص التالي: "إصدار قابل للنقل إلى أي coding agent أو harness (Codex وCursor وaider وraw system prompt). يستخدم الطريقة نفسها الموجودة في SKILL.md؛ الصق هذا الملف في تعليمات agent أو ضعه في جذر المستودع باسم AGENTS.md." يبلغ طول الملف نحو 2,600 كلمة، ويتضمن البوابات والخطوات والأوضاع نفسها. إذا كنت تحتفظ بملفات تعليمات في جذر المستودع، فإن اصطلاح AGENTS.md وHUMAN.md يوضح مكان وضع الملف والجهة التي تقرؤه.

يمكن نقل جزأين بسهولة. نص الطريقة عبارة عن prompt مرتب لا يتضمن code خاصاً بنموذج محدد، لذلك يمكن لأي نموذج يتبع التعليمات تطبيقه. كما أن الأطروحة المعلنة للمستودع هي أن مقدار الجهد المطلوب يتناسب عكسياً مع مستوى النموذج. ويمكن نقل judge أيضاً، ما دام لدى agent shell ومستودع، لأن كل ما ينفذه هو git diff إلى جانب إعادة تشغيل الأوامر التي يستطيع القارئ تشغيلها أيضاً.

لا يمكن نقل جزء واحد بسهولة. يفترض fable-loop أن harness يستطيع إنشاء subagents متوازية وتوجيهها إلى نماذج مختلفة. أما agent الذي لا يدعم subagents، فينفذ تلك المراحل بالتتابع على نموذج واحد، ما يلغي التوازي وتوفير التكلفة اللذين برّرا هذا التصميم. وما يتبقى هو fable-method مع مصطلحات إضافية.

هناك شيئان أصغر مرتبطان بـharness وقد يفوتان الانتباه. مشغّل /fable-method هو slash command خاص بـClaude Code، لذلك تستدعي الطريقة في harness آخر من خلال وصفها. أما وصف frontmatter في SKILL.md فهو ما يتيح لـagent تحميل المحتوى فقط عندما يطابق المهمة، ما يعني أن skill المثبّتة لا تكلّف شيئاً تقريباً قبل تشغيلها. إذا لصقت AGENTS.md في system prompt بدلاً من ذلك، فستُرسل تلك الكلمات البالغ عددها 2,600 تقريباً مع كل طلب ترسله، سواء كانت المهمة تصحيح خطأ مطبعي في سطر واحد أو إعادة هيكلة. وهذا فرق حقيقي في التكلفة، وهو السبب الرئيسي تقريباً لوجود تغليف skill من الأساس.

كيفية إجراء اختبار A/B على VPS: المهمة نفسها مرتين

أنشئ نسختين متطابقتين وقابلتين للتشغيل، بحيث لا تتمكن أي من العمليتين من رؤية تعديلات الأخرى. استبدل YOUR_ORG/YOUR_REPO بالمستودع الذي تريد اختباره؛ ويجب أن تأتي النسختان من الالتزام نفسه.

sudo apt update && sudo apt install -y git jq
git clone https://github.com/YOUR_ORG/YOUR_REPO ~/ab/control
git clone https://github.com/YOUR_ORG/YOUR_REPO ~/ab/method

اختر مهمة يمكن ملاحظة نتيجتها دون رأي شخصي: اختبار فاشل يجب أن ينجح، أو script يجب أن ينتهي بحالة الخروج 0. تؤدي المهمة الغامضة إلى مقارنة غامضة، لأنك ستنتهي بتقييم النص بدلاً من النتائج.

شغّل ذراع التحكم باستخدام --bare، الذي يتجاوز الاكتشاف التلقائي لـhooks وskills وplugins وCLAUDE.md. هذا الخيار هو ما يجعله ذراع التحكم: فلا يمكن للـskills التي ثبّتها سابقاً أن تتسرب إليه. لا يستخدم الوضع المجرد تسجيل الدخول إلى اشتراكك، لذا عيّن API key من Claude Console أولاً.

export ANTHROPIC_API_KEY=sk-ant-...
task="Make tests/test_parser.py pass without editing the test file."

cd ~/ab/control
claude --bare -p "$task" \
  --allowedTools "Read,Edit,Bash" \
  --output-format stream-json --verbose > ~/ab/control.jsonl

ذراع الطريقة هو الأمر نفسه مع إضافة flag واحد، الذي يحمّل الطريقة المحمولة كإضافة إلى system prompt:

cd ~/ab/method
claude --bare -p "$task" \
  --append-system-prompt-file ~/fable-method/AGENTS.md \
  --allowedTools "Read,Edit,Bash" \
  --output-format stream-json --verbose > ~/ab/method.jsonl

نفس binary، ونفس model، ونفس tools، ونفس شجرة البداية. يختلف flag واحد فقط، وهذه هي الطريقة الوحيدة التي تجعل للمقارنة معنى.

يقيس هذا التصميم نص الطريقة. ولا يقيس حزم skills، فهذا سؤال منفصل. لقياس الحزم، احذف --bare، وثبّت skills كما سبق، وضع اسم skill داخل سلسلة prompt، لأن skills التي يستدعيها المستخدم تُوسَّع في وضع الطباعة: claude -p "/fable-method $task". توقّع أن يختلف نمط التكلفة عن ذراع system prompt، حتى عندما يبدو السلوك الظاهر متطابقاً.

عدّ الخطوات والتكلفة

كتب كلا التشغيلين تدفقاً من أحداث JSON. السطر الأخير هو رسالة result التي تحمل النص النهائي والتكلفة والبيانات الوصفية للجلسة. اطبع هذا السطر مرة واحدة واقرأه قبل أن تكتب أي نصوص برمجية تعتمد عليه، لأن أسماء الحقول تتغير بين إصدارات Claude Code.

tail -1 ~/ab/control.jsonl | jq .

تأتي تكلفة التشغيل من ذلك السطر، وهي القيمة التي يجب مقارنتها:

for f in ~/ab/control.jsonl ~/ab/method.jsonl; do
  printf '%s ' "$f"
  jq -r 'select(.type=="result") | .total_cost_usd' "$f"
done

تأتي الخطوات المنفذة من عدّ استدعاءات الأدوات في الملف نفسه:

jq -r 'select(.type=="assistant") | .message.content[]? | select(.type=="tool_use") | .name' \
  ~/ab/control.jsonl | sort | uniq -c | sort -rn

نفّذ ذلك للملفين. يخبرك شكل الفرق أكثر مما تخبرك الإجماليات. إذا كان تشغيل الطريقة يقرأ ملفات أكثر ويجري تعديلات أقل، فهو ينفذ ما تطلبه الطريقة، وهذه هي المقايضة التي تدفع مقابلها. أما إذا أجرى تشغيل الطريقة التعديلات نفسها بتكلفة أعلى بنسبة أربعين بالمئة، فلم تحصل على أي فائدة في تلك المهمة.

هناك تنبيهان بشأن الأرقام. أولاً، لا تجمع output_tokens من نصوص الجلسات ضمن ~/.claude/projects/ وتعتبر الناتج الإجمالي: فكتل الاستخدام لكل رسالة هي لقطات مأخوذة أثناء البث، وهناك تقارير مفتوحة تفيد بأنها تقلل العدد الفعلي. السطر result هو الرقم الذي يجب الوثوق به. ثانياً، يُعد تشغيل واحد لكل ذراع تجربة فردية، لذلك شغّل كل ذراع ثلاث أو أربع مرات على المهمة نفسها قبل أن تثق بوجود فرق، لأن تشغيلين للوكيل نفسه على المهمة نفسها يختلفان بالفعل. ولرؤية الإنفاق على مدى أطول، تشرح الأدوات التي تتعقب إنفاق Claude Code وكيفية احتساب Claude Code للرموز سبب هيمنة أسطر التخزين المؤقت على الأعداد الأولية.

تأكد من أن الوكيل لا يستطيع الوصول إلى أي شيء يهمك أثناء تشغيله دون مراقبة. يوضّح تشغيل Claude Code بأمان على VPS حساب المستخدم وأعلام الأذونات.

تقييم المستودع نفسه، بقراءة صادقة

العنوان الرئيسي في README هو: «خمس عشرة جولة تقييم، وأكثر من 260 عملية تشغيل للوكلاء، وحكّام LLM عميان يتحققون عبر المقارنة باستخدام diff والتنفيذ». هذه أدلة أكثر مما تنشره معظم مستودعات المهارات، كما أن eval/RESULTS.md مكتوب جولةً بعد جولة، مع الإبقاء على حالات الفشل. لكنه أقل متانة مما يوحي به الرقم الرئيسي عند النظر إلى الخلايا الفردية وراء صفوف العنوان.

ChartRuns per cell behind the repo's headline eval rows, v1.4.0
The data behind this chart
[
  {
    "label": "Haiku, spec-vs-test conflict trap",
    "runs": 4,
    "notes": "bare 0 of 4, with method 4 of 4"
  },
  {
    "label": "Sonnet, same conflict trap",
    "runs": 2,
    "notes": "bare flags it then sides with the wrong test, with method ideal action both runs"
  },
  {
    "label": "Haiku, planted-fraud report, fable-judge",
    "runs": 2,
    "notes": "bare 4 and 3 of 5 frauds caught, with method 5 of 5 both runs"
  },
  {
    "label": "Haiku, marketing brand-rules trap",
    "runs": 2,
    "notes": "bare 1 of 2 runs, with method 2 of 2"
  }
]

يعتمد أكبر عدد من هذه الصفوف، وعددها 4، على 4 عمليات تشغيل. أما الصفوف الثلاثة الأخرى، فيعتمد كل منها على 2 عمليات تشغيل. ويذكر المستودع ذلك بنفسه في القيود الثابتة أعلى السجل: «حجم العينة صغير في جميع الحالات (من 1 إلى 4 عمليات تشغيل لكل خلية)، وحكّام LLM (عميان عند مقارنة عدة مخرجات، لكنهم مبنيون على نموذج frontier نفسه الذي يظهر كخط أساس)، وتركيبات اختبار اصطناعية، وحقيقة مرجعية بحثية لا تتجاوز حداثتها تاريخ تشغيلها». ويقول بوضوح أكبر: «يوجد هذا السجل لاختبار تعديلات المنهج، وليس لكي يظنه أحد معياراً قياسياً».

يُحسب له ذلك. فالمؤلف الذي ينشر قيمة n الخاصة به، ويسمي المشكلة المتمثلة في بناء حَكَمه على النموذج نفسه المستخدم كخط أساس، يتصرف بصدق أكبر من المعتاد في هذه الفئة. اقرأ الأرقام باعتبارها دليلاً على أن المؤلف شغّل الاختبارات فعلاً واحتفظ بحالات الفشل. أما اختبار A/B الخاص بك فهو الذي يخبرك عن قاعدة شيفرتك.

يوضح README بالقدر نفسه أين لا يفعل المنهج شيئاً، وهذه أكثر فقراته فائدة. فهو لا يسجل أي تحسن في المهام الصغيرة العادية على النماذج القادرة. ويذكر أن «المنهج لا يستطيع جعل حقائق النموذج أحدث؛ وتتفوق نماذج frontier المجردة في الأبحاث كثيفة المعرفة». كما يحدد موضع القيمة في «الحالات الخادعة (تعارضات السلطة، وادعاءات الإكمال الكاذبة، والمنفّذون الضعفاء، وعمليات التشغيل غير المراقبة)، وليس في كل الحالات». إذا كان عمل وكيلك يقتصر على تعديلات صغيرة على نموذج قوي مع مراقبتك له، فتوقع ألا تقيس أي فرق على الإطلاق. أما إذا كان نموذج أرخص يعمل دون مراقبة، فهناك ينبغي أن يظهر الفرق، وهذا يجعل الاختيار بين Opus وSonnet وHaiku جزءاً من القرار نفسه.

حيث تتحول حزمة التغليف إلى طقس يُتَّبع بلا فهم

توجد أربعة انتقادات جديرة بالذكر، ولا يبرر أيٌّ منها تجاهل المستودع.

يتجاوز التأطير الأدلة المتاحة. عبارة «كيف عمل Claude Fable 5» هي ادعاء عن البنية الداخلية لنموذج لا يستطيع أحد خارج Anthropic التحقق منه، كما أن الجملة الأساسية في المستودع نفسه تضعف هذا الادعاء: «تكمن الجودة في البنية والأدلة والصدق، لا في النموذج». إذا كانت الجودة تكمن في البنية، فإن قصة المصدر مجرد زينة. الإجراء قائم بذاته ولا يحتاج إلى قصة منشأ أسطورية.

تمثل أربع مهارات سطحاً أكبر مما يحتاج إليه المحتوى. تعيد fable-loop صياغة جزء كبير من fable-method مع إضافة تنسيق حولها، وفي بيئة تشغيل لا تدعم الوكلاء الفرعيين تختزل إلى fable-method. اقرأ الملفين جنباً إلى جنب قبل تثبيتهما معاً.

تمثل ثمانية محولات للمجالات اتساعاً لا يغطيه التقييم. يظهر اثنان فقط من أصل الثمانية في السجل: التسويق في الجولة 9، وdevops في الجولة 12. تأتي محولات finance وlegal وdesign وdata من دون أي جولة تدعمها. قد يكون المحول الخاص بمجالك جيداً، لكنه يظل مسودة من المؤلف، وليس شيئاً اجتاز fixture اختبارية صعبة.

كما أن برنامج التثبيت يختلف مع المستودع بشأن ما يوزعه، إذ ينسخ ثلاثاً من أصل أربع مهارات إلى ~/.claude/skills. هذه فجوة صغيرة. لكنها أيضاً من النوع الذي يخبرك بأن عملية التغليف تقدمت بوتيرة أسرع من مراجعة أي شخص لها، وهذا أمر يستحق التذكر عندما تقرر مقدار ما ستعتمده دفعة واحدة.

ما يجب الاحتفاظ به إذا لم تحتفظ بأي شيء آخر

أزل العلامة التجارية، وستبقى أربع قواعد قائمة بذاتها، مهما كان الوكيل الذي تشغّله.

  • اقتباس التفويض. يتطلب الإجراء غير القابل للعكس أو الموجّه إلى الخارج كلمات المستخدم نفسه، مكتوبة في سطر AUTH:. الوكيل الذي لا يستطيع العثور على اقتباس لا ينفّذ الإجراء.
  • التحقق المزدوج. بعد إصلاح عيب، ابحث في المشروع بأكمله عن البنية الخاطئة نفسها، وأبلغ عن العدد، بما في ذلك عندما يكون العدد صفراً.
  • التحقق بالملاحظة. يُعد فحص موجّه ناجح فوق عملية بناء معطّلة عملية تحقق فاشلة، وليس نجاحاً.
  • إعداد التقارير مع تقديم النتيجة أولاً، مع ذكر ما تم تخطيه أو تركه من دون تحقق كتحفّظ، بدلاً من إسقاطه بصمت.

لا يتطلب اعتماد هذه القواعد الأربع أي تكلفة، ويمكنك البحث عن الالتزام بها باستخدام grep. ابدأ من هنا، وقِس النتائج باستخدام أداة الاختبار المذكورة أعلاه، ثم قرر ما إذا كان باقي المستودع يستحق حصته من ميزانية السياق. إذا أردت تزويد وكيل بسياق دائم للمشروع بدلاً من طريقة عمل، فإن ملف DESIGN.md الذي يقرأه الوكلاء قبل إجراء التعديلات هو الخطوة المكملة.

FAQ

هل تعمل طريقة Fable مع نماذج غير Claude؟

نعم، يعمل نص الطريقة. فهو prompt مرتب لا يحتوي على code خاص بنموذج معين، ويصدر المستودع AGENTS.md كنسخة قابلة للنقل لاستخدامها مع Codex أو Cursor أو aider أو كـsystem prompt خام. لكن هناك عنصران لا ينتقلان. إن /fable-method و/fable-judge هما أوامر slash في Claude Code، لذلك تستدعي الطريقة في مكان آخر من خلال وصفها. ويفترض fable-loop وجود harness يمكنه تشغيل subagents متوازية على نماذج مختلفة؛ وبدون ذلك، تعمل الطريقة بالتتابع وتمنحك fable-method مع خطوات إضافية.

هل يؤدي تشغيل هذه المهارات إلى استهلاك عدد أكبر من الرموز؟

نعم، ويعتمد مقدار الزيادة على طريقة تحميلها. عند تثبيتها كمهارات، لا يتم تحميل محتواها إلا عندما يتطابق الوصف مع المهمة، لذلك لا يكاد الطلب غير المرتبط بها يستهلك شيئاً. أما عند لصقها في system prompt، فإن نحو 2,600 كلمة من AGENTS.md تُرسل مع كل طلب. كما يستهلك التنفيذ نفسه مزيداً من الرموز، لأن الطريقة تطلب تحديد السياق قبل التحرير، والأدلة قبل اتخاذ القرار، والتحقق الفعلي بعد ذلك. قِس ذلك بنفسك: نفّذ المهمة نفسها مع --output-format json في الذراعين، ثم قارن الحقل total_cost_usd.

ما إصدار fable-method الذي ينبغي أن أثبّته، ولماذا يجب تثبيت الإصدار؟

شغّل git checkout v1.4.0 قبل التثبيت. يعود هذا الوسم إلى 2026-07-15، وكان لا يزال الأحدث في August 2026. نشر المستودع خمسة إصدارات خلال الأيام التسعة السابقة، وغيّر v1.4.0 قواعد التوجيه نفسها. إذا تابعت main أثناء القياس، فقد تقرأ تجربة التحكم وتجربتك تعليمات مختلفة، ما يجعل المقارنة بلا قيمة. سجّل الوسم مع نتائجك.

هل يُعد eval الموجود في المستودع معياراً يمكنني الوثوق به؟

تعامل معه كسجل تغييرات للطريقة، وهذا هو الوصف الذي يستخدمه مؤلفه: "يوجد هذا السجل لاختبار تعديلات الطريقة، وليس لكي يخطئ أحد في اعتباره معياراً." القيود مذكورة في أعلى الملف: من 1 إلى 4 عمليات تشغيل لكل خلية، وfixtures اصطناعية، وحكّام LLM مبنيون على نموذج frontier نفسه الذي يُستخدم أيضاً كخط أساس. الجولات حقيقية، كما أن التجارب الفاشلة مُدرجة، وهذا أكثر مما تنشره معظم المستودعات. لكنه لا يزال لا يقيس ما سيحدث في codebase الخاص بك، لذلك نفّذ مقارنة الذراعين بنفسك.