→ المدونةأدلة عملية

كم يكلّف وكيل الذكاء الاصطناعي فعليًا في المهمة الواحدة

احسب تكلفة وكيل الذكاء الاصطناعي لكل مهمة: اربط الإنفاق المبلَّغ عنه بمفتاح المهمة، واقسمه على العمل المنجز لا على المحاولات، ثم اقرأ الناتج بصدق.

The Taskfolk team

11 د قراءة12 مشاهدةحُدِّث في

XLinkedIn

تضاعفت فاتورة وكلائك ثلاث مرات الشهر الماضي، والفاتورة سطر واحد: مبلغ وتاريخ، ولا شيء يخبرك إن كان المال قد ذهب إلى إعادة كتابة صفحة الدفع أم إلى وكيل أمضى تسع ساعات في إعادة تسمية التصنيفات.

رؤية الإنفاق سهلة، أما نسبته إلى عمل بعينه فهي الجزء الصعب، وهو بالضبط ما يطلبه القسم المالي. تستطيع أن تسحب أرقام يوليو لـ ‏Claude Code وCursor وCopilot من ثلاث لوحات تحكم خلال عشر دقائق، ثم تعجز عن قول ما الذي حصلت عليه مقابلها.

لنبدأ بالتحيّز: أنا أعمل على ‏Taskfolk، وربط الإنفاق بالعمل هو الجزء الذي يتولاه. جلسة عمل الوكيل مرتبطة بمفتاح المهمة، فيتجمّع الإنفاق تلقائيًا لكل وكيل ولكل تذكرة دون أن تخترع نظام وسوم. لكنه لا يرى فاتورة مزوّدك، وسأقول أين يؤلم ذلك. أما ما يتقاضاه مزوّد الأداة مقابل ذكائه الاصطناعي فله مقال آخر. هنا نتحدث عن إنفاق وكيلك أنت.

كم يُفترض أن تكلّف المهمة الواحدة

ابدأ برقم من خارج فريقك، وإلا فلن يكون لديك ما تقيس عليه رقمك.

تنشر ‏Anthropic أرقام استخدام ‏Claude Code: نحو 13 دولارًا لكل مطوّر في اليوم النشط، و150 إلى 250 دولارًا لكل مطوّر شهريًا، مع بقاء 90% من المستخدمين تحت 30 دولارًا في اليوم النشط (تم التحقق في 26 يوليو 2026). والصفحة نفسها تنبّه إلى أن إجمالي /usage يُحسب محليًا من قوائم الأسعار وقد "يختلف عن فاتورتك الفعلية". أما فرق الوكلاء فتغيّر المعادلة: لكل عضو نافذة سياق خاصة به، فتنمو الرموز (tokens) مع حجم الفريق.

هذه أرقام لكل مطوّر، وتحويلها إلى رقم لكل مهمة ليس عملية قسمة. ثماني تذاكر مغلقة في أسبوع بمعدل 13 دولارًا يوميًا لا تعني 8 دولارات للتذكرة إن كانت ثلاث منها التذكرة نفسها، جُرّبت ثلاث مرات.

تكلفة المهمة بلا مقام لا تعني شيئًا

اقسم الإنفاق على عدد المحاولات تحصل على رقم مُجامل، لأن المحاولات الفاشلة تكلّف مالًا أيضًا.

المعادلة ليست من عندنا: استقر المجال على تكلفة التشغيل مقسومة على معدل النجاح، وهي معادلة صحيحة. ما يجعلها موجعة هو اختبار ‏AA-Briefcase من ‏Artificial Analysis، وهو 91 مهمة معرفية طويلة المدى غير منشورة، نقلته ‏LangWatch في يوليو 2026: النموذج المتصدّر يكلّف نحو 31 دولارًا للمهمة، ويستوفي كل بنود التقييم في 3% منها فقط، أي أن تكلفة النتيجة الصحيحة تمامًا تقترب من 1000 دولار. والفارق في تكلفة المهمة بين النماذج المختبَرة يتجاوز 800 ضعف.

وتخمّن الفرق معدلات نجاحها، وتخمّنها بسخاء. قياسات ‏LinearB لعام 2026، المنشورة في مارس من 8.1 مليون طلب سحب (PR) لدى 4800 فريق في 42 دولة، وجدت أن 32.7% من طلبات السحب المكتوبة بمساعدة الذكاء الاصطناعي دُمجت خلال 30 يومًا، مقابل 84.5% من تلك التي كتبها بشر. وتجاوزت تلك الطلبات 400 سطر عند الشريحة المئوية 75 مقابل 157 سطرًا، وانتظرت أول مراجعة نحو 5.25 ضعف المدة. أما الطلبات التي كتبها الوكلاء بالكامل فجاءت قرب 290 سطرًا، دون نشر معدل دمج منفصل لها، فقِس معدلك بنفسك.

إن كان معدل الدمج الحقيقي عندك الثلث، فالقسمة على المحاولات تعطيك رقمًا أقل من الحقيقة بثلاثة أضعاف.

الجلسات تعطيك ثلاث فئات لا فئتين، والفئة الوسطى هي موضع الخلاف.

flowchart TD
  A["Agent session ends"] --> B{"Terminal state"}
  B -->|"done or review"| C{"PR link, comment or activity row"}
  B -->|"failed or cancelled"| E["Bucket 3: cost, no outcome"]
  C -->|"yes"| D["Bucket 1: cost with a trace"]
  C -->|"no"| F["Bucket 2: flagged unverified"]
  D --> G["Denominator: completed tasks"]
  E --> H["Numerator only"]
  F --> H

يضع ‏Taskfolk علامة على كل جلسة بحالة قيد المراجعة أو منجزة، إن كانت مرتبطة بمهمة، ولا تحمل رابطًا خارجيًا، ولم يترك فيها ذلك الوكيل سجل نشاط ولا تعليقًا على تلك المهمة بين بدء الجلسة ونهايتها. وثلاثة أشياء تُبطل هذه العلامة: تعليق، أو رابط طلب السحب، أو عمل لا يراه المتتبّع أصلًا. تعامل مع الفئة الثانية كطابور مراجعة لا كحكم نهائي، ومقال إدارة فريق من وكلاء الذكاء الاصطناعي يتوسّع في الحالات.

قائمة الجلسات في مركز الوكلاء: ست جلسات بشارات حالة تقرأ تحتاج مدخلات، متعثرة، قيد المراجعة، معلّقة، قيد التشغيل، ومنجزة، كل واحدة بجانب مفتاح مهمة.

كل رقم هنا يبلّغ عنه الوكيل نفسه

الوكيل ينفق من حساب مزوّده هو. و‏Taskfolk لا يشغّل النموذج إطلاقًا، فلا يستطيع قراءة فاتورتك ولا إيقاف تشغيلة تحرق المال. كل رقم بالدولار هنا رقم أبلغ عنه وكيل عن نفسه، والواجهة تقول ذلك في كل موضع يظهر فيه رقم.

وأدوات المزوّد نفسه لها الشكل ذاته. ‏Claude Code يحسب إجمالي الجلسة محليًا من قوائم الأسعار، ولذلك فهو "لا يعكس الأسعار الترويجية ولا الخصومات التعاقدية وقد يختلف عن فاتورتك الفعلية". حتى الشركة التي تشغّل النموذج تقدّر من قائمة أسعار.

أين تنظر ما الذي يخبرك به ما الذي يعجز عنه
لوحة تحكم المزوّد (Anthropic، OpenAI) الدولارات المفوترة، لكل مفتاح أو لكل مستخدم أي تذكرة، وأي مشروع
بوابة نماذج لغوية (Helicone، LiteLLM، Portkey) إنفاق كل طلب يمرّ عبرها أي شيء لا يمرّ عبرها
إدارة تكاليف الذكاء الاصطناعي من DX فواتير المزوّدين عبر Claude وCursor وCopilot، موزّعة على الفرق، مع تكلفة تقديرية لكل طلب سحب التذكرة. وحدته هي طلب السحب لا المهمة
جلسات الوكلاء في Taskfolk دولارات يبلّغ عنها الوكيل مرتبطة بمفتاح مهمة، لكل وكيل ولكل جلسة فاتورة مزوّدك الفعلية

إن كنت تحتاج إلى تسوية فواتير ثلاث أدوات وربطها بالفرق، فـ‏DX يفعل ذلك ضمن عقد مؤسسي، و‏Taskfolk لا يفعله. وإن كنت تريد رقمًا بالدولار بجانب ‏WEB-39 في متتبّع بثلاثة دولارات للمقعد، فالمقايضة تسير في الاتجاه المعاكس.

كيف توصّل التبليغ، ولماذا تريد قيمة null

التبليغ طلب POST واحد في كل دورة، وكل نداء يضيف فرقًا إلى إجمالي الجلسة. أرسل cost_usd حين يعطيك إياه الـ SDK، وأرسل الرموز مع اسم النموذج حين لا يعطيك.

curl -X POST https://taskfolk.ai/api/v1/workspaces/acme/agent-sessions/ses_9f21/usage \
  -H "Authorization: Bearer tfk_live_a1b2..." \
  -H "Content-Type: application/json" \
  -d '{"tokens_in": 84210, "tokens_out": 6180, "cached_tokens": 512000,
       "cost_usd": 0.4137, "model": "claude-sonnet-4-6"}'
await fetch(
  "https://taskfolk.ai/api/v1/workspaces/acme/agent-sessions/ses_9f21/usage",
  {
    method: "POST",
    headers: {
      Authorization: "Bearer tfk_live_a1b2...",
      "Content-Type": "application/json",
    },
    body: JSON.stringify({
      tokens_in: 84210,
      tokens_out: 6180,
      cost_usd: 0.4137,
      model: "claude-sonnet-4-6",
    }),
  },
);
import requests

requests.post(
    "https://taskfolk.ai/api/v1/workspaces/acme/agent-sessions/ses_9f21/usage",
    headers={"Authorization": "Bearer tfk_live_a1b2..."},
    json={
        "tokens_in": 84210,
        "tokens_out": 6180,
        "cost_usd": 0.4137,
        "model": "claude-sonnet-4-6",
    },
)
{
  "id": "ses_9f21",
  "issue_key": "WEB-39",
  "model": "claude-sonnet-4-6",
  "tokens_in": 84210,
  "cost_usd": 0.4137,
  "usage_reports": 1
}

اسم النموذج وحده مرفوض: لا بد من وجود واحد على الأقل من tokens_in أو tokens_out أو cached_tokens أو cost_usd.

flowchart TD
  R["Usage report arrives"] --> C{"cost_usd present"}
  C -->|"yes"| V["Stored verbatim, source reported"]
  C -->|"no"| M{"Model string in the rate table"}
  M -->|"yes"| E["Estimated from tokens"]
  M -->|"no"| N["Tokens recorded, cost stays null"]

أي قيمة cost_usd مبلَّغ عنها، صفرًا كانت أو أكثر، تتقدّم دائمًا وتُخزَّن كما أُرسلت حرفيًا. وإلا فالدولارات تأتي من جدول أسعار مدمج مفتاحه اسم النموذج بحروفه، مع تسعير المدخلات المخزّنة مؤقتًا بعُشر سعر المدخلات.

اسم النموذج الذي يبلّغ عنه الوكيل المدخلات لكل مليون المخرجات لكل مليون
claude-haiku-4-5 $1 $5
claude-sonnet-4-6 $3 $15
claude-opus-4-8 $5 $25
claude-fable-5 $10 $50
gpt-4o $2.50 $10
gpt-4o-mini $0.15 $0.60
o3 $2 $8
o4-mini $1.10 $4.40

الفجوات في هذا الجدول تقول أكثر مما تقوله صفوفه. فهرس المزوّدين يغطي تسعة أنواع، منها ‏Gemini CLI وDeepSeek وKimi وCodex وCursor، بينما جدول الأسعار يغطي مزوّدَين اثنين. أبلغ عن رموز بنموذج غير مدرج فيه، فيحتفظ ‏Taskfolk بالرموز ويترك التكلفة null، لأن قراءة 0 دولار حين تكون الحقيقة مجهولة أسوأ من ألا تقرأ شيئًا. سطر واحد في حلقة تشغيل وكيلك يحسم الأمر: أرسل cost_usd بنفسك، فالـ SDK لديك يعيد بيانات الاستخدام مع كل استجابة أصلًا.

من الجلسات إلى رقم لكل تذكرة

اربط الجلسة بمهمة عند بدئها، فيصير الربط استعلامًا واحدًا.

curl -s "https://taskfolk.ai/api/v1/workspaces/acme/agent-sessions?issue_key=WEB-39" \
  -H "Authorization: Bearer tfk_live_a1b2..." \
  | jq '[.data[].cost_usd] | add'

لنقل إن ‏WEB-39 استهلكت ثلاث جلسات: اثنتان فشلتا بتكلفة 0.41 و0.88 دولار، وواحدة انتهت برابط طلب سحب بتكلفة 2.10 دولار. التذكرة كلّفت 3.39 دولار، لا 2.10. وداخل المهمة تحمل كل جلسة شارة تكلفة، وبجانبها معدل الاستهلاك في الدقيقة، ويعرض تلميح الشارة الرموز والنموذج وراء الرقم.

والآن السبرنت. أربعون جلسة على اثنتين وعشرين تذكرة، 61.40 دولارًا مبلَّغًا عنها، وأربع عشرة تذكرة منجزة بأثر واضح ورابط طلب سحب. لكل محاولة يصير الرقم 1.54 دولار، ولكل تذكرة منجزة يصير 4.39 دولار، أي ثلاثة أضعاف تقريبًا، والرقم الثاني هو الذي تذكره أمام غيرك.

الشريط الجانبي في صفحة المهمة، وفيه لوحة نشاط الوكيل تعرض جلسة ‏Claude Code بحالة منجزة بجانب شارة حمراء تقول غير موثّقة.

قارن ذلك بتكلفة شخص. استعمل تكلفة الساعة المحمّلة عندك؛ لنفترض 85 دولارًا للساعة، أي راتب أساسي 136,000 دولار بمعامل تحميل 1.3 على 2080 ساعة. بهذا السعر تشتري 4.39 دولار ثلاث دقائق من وقت مهندس، فتبدو كل تذكرة تقريبًا صفقة رابحة.

وهي ليست كذلك، وهذا ما تغفله المقالات التي تحسب الرموز وحدها. طلب سحب الوكيل لا يُدمج قبل أن يراجعه إنسان، وهذه الطلبات طويلة وتنتظر طويلًا. أربعون دقيقة من مهندس أول تحوّل التذكرة إلى 4.39 دولار من الرموز ونحو 57 دولارًا من المراجعة. تخفيض 4.39 دولار مع ترك 57 دولارًا على حالها رافعة خاطئة بمرتبة كاملة، ولهذا تحدّد صياغة التذكرة الفاتورة أكثر مما يحددها النموذج. وهناك مقال كامل عن كتابة تذاكر يستطيع الوكيل إنهاءها فعلًا، وحين يكتمل عندك جانب التكلفة، يبقى النصف الآخر من الجواب: هل وفّر وكلاؤك وقتًا حقًا.

حين يكلّف وكيل واحد ثلاثة أضعاف البقية

ثلاثة أسباب، بترتيب ما يستحق الفحص أولًا.

اختيار النموذج أولًا. الفارق البالغ 800 ضعف ليس خطأً مطبعيًا، ولوحة التكلفة حسب النموذج تحسمه في ثوانٍ. والمتّهم المعتاد وكيل تُرك على نموذج متقدّم ليرتّب التصنيفات.

حجم السياق ثانيًا. وثّقت ‏TrueFoundry حالة مؤسسة من خمسين مهندسًا خفضت إنفاقها الشهري على الوكلاء من 8400 دولار إلى أقل من 800 بعد أن تتبّعت 92% من تكلفة خط المعالجة إلى خطوة واحدة: دليل أمني بحجم 50,000 رمز يُحقن في كل طلب سحب، ثم وضعت أمامه ذاكرة تخزين دلالية. المتوسط لكل مطوّر يخفي هذا كله، ولا يظهر إلا حين تجمّع الإنفاق حسب الجهة التي تنفق.

التذكرة ثالثًا. النطاق الغامض يولّد استكشافًا، والاستكشاف يولّد إعادة محاولات، وإعادة المحاولات بسط بلا مقام. والجلسة الجارية التي تمضي ثلاثين دقيقة بلا نبضة تظهر بحالة متعثرة، وغالبًا ما تكون وكيلًا مدفوع الأجر لا يصل إلى شيء، ومقال كيف تعرف أن وكيلك عالق يتناول هذه الإشارة.

جدول الوكلاء المتصلين يعرض أربعة وكلاء مع مزوّد كل منهم، ومن ربطه، وحالته، وآخر وقت نشاط، ومفتاح API مختصر.

ملاحظة واحدة على صفحة التجميع: سلسلة الإنفاق اليومي وتفصيل التكلفة حسب النموذج يأتيان من مخزن التحليلات، ويصيران فارغين إن تعذّر الوصول إليه، أما التكلفة حسب الوكيل فتأتي من صفوف الجلسات وتظهر دائمًا. والصفحة تصرّح بأيّهما تعذّر بدل أن تعرض مخططًا فارغًا بلا تفسير.

سقف ينبّه ولا يوقف شيئًا

يمكن أن يحمل كل وكيل سقف إنفاق، يضبطه مالك الوكيل أو مسؤول مساحة العمل من قائمة الوكيل، ويُقرأ عبر API باسم spend_cap_usd. وحين تتجاوز التكلفة التراكمية المبلَّغ عنها هذا السقف يصل إشعار إلى المالك داخل التطبيق. ينطلق الإشعار مرة واحدة لكل تجاوز، ويعود جاهزًا للانطلاق من جديد إن غيّرت السقف، ويكتب سجل تدقيق.

ونص المنتج نفسه هو النسخة الصادقة: "هذا تنبيه لا حد صارم: ‏Taskfolk لا يشغّل النموذج، فلا يمكنه إيقاف الإنفاق." الرموز تُفوتر على حساب مزوّدك عبر عملية تعمل على حاسوبك أو في نظام التكامل المستمر لديك. وأي متتبّع يدّعي أنه قادر على إيقافها يكذب.

ما الذي لا يفعله هذا كله

الأرقام المبلَّغة ذاتيًا قد تكون خاطئة، أو غائبة أصلًا. الوكيل الذي لا ينادي نقطة الاستخدام أبدًا يترك جلسات بلا تكلفة، ولا يوجد تصميم منتج يصلح وكيلًا يرفض التبليغ.

لا يوجد سجل عمل مفصّل. تتبّع الوقت هو ثلاثة أرقام مجمّعة على المهمة: تقدير، ومقدار مستهلَك، ونسبة إنجاز. بلا كشوف وقت لكل مدخلة، ولا سجلات بدء وإيقاف، ولا أسعار فوترة، ولا تصدير. ومقال تتبّع الوقت على المهام يعرض النطاق الحقيقي.

بطاقة الوقت في المهمة: تقدير 80 ساعة مقابل 36 ساعة مستهلكة، مع مؤشري الميزانية والإنجاز عند 45%.

تظهر التكلفة لكل وكيل ولكل جلسة، ولا توجد صفحة تكلفة لكل مشروع. يمكنك تركيب واحدة بنفسك عبر سرد جلسات ذلك المشروع وجمع تكاليفها، وهو ما يدعمه API ولا تدعمه الواجهة. أما استخدام مفاتيح API وسجلات التدقيق فسطح منفصل، يغطيه مقال تتبّع استخدام API وسجلات التدقيق.

وشيئان لن يحرّكا فاتورة ‏Taskfolk عندك: ربط وكلاء أكثر، وتشغيلهم بوتيرة أعلى. أعضاء الوكلاء مستثنون من عدّ المقاعد، وهو ما يشرحه مقال المقاعد، بينما يغطي إسناد العمل إلى وكيل مسار الإسناد الذي يفتح هذه الجلسات.

إن كان لديك وكيل متصل بالفعل، أضف نداء الاستخدام إلى نهاية حلقة تشغيله واتركه أسبوعًا. تكلفة التذكرة المنجزة، ونسبة الفئة الأولى إلى الفئة الثالثة، ستقول لك أكثر مما يقوله أي قياس مرجعي نشره غيرك.

أسئلة شائعة

كيف أعرف تكلفة مهمة واحدة نفّذها وكيل ذكاء اصطناعي؟

اربط كل جلسة وكيل بمفتاح مهمة، واجعل الوكيل يبلّغ عن استخدامه في نهاية كل دورة، ثم اجمع cost_usd عبر جلسات تلك المهمة. التذكرة التي استغرقت ثلاث محاولات تكلّف مجموع الثلاث، لا المحاولة الناجحة وحدها.

هل يستطيع ‏Taskfolk وضع سقف لإنفاق الوكيل؟

يمكنك ضبط سقف إنفاق لكل وكيل. تجاوزه ينبّه مالك الوكيل مرة واحدة ويكتب سجل تدقيق، ولا يوقف شيئًا. ‏Taskfolk لا يشغّل النموذج، فالرموز تُفوتر على حساب مزوّدك عبر عملية لا يصل إليها.

ماذا لو لم يبلّغ وكيلي عن استخدامه للرموز؟

تسجّل الجلسة العمل بلا تكلفة. وإن أبلغ الوكيل عن رموز مع اسم نموذج غير موجود في جدول الأسعار المدمج، تُحفظ الرموز وتبقى التكلفة null بدل عرض 0 دولار مضلّل. وإرسال cost_usd بنفسك يتجنّب الحالتين.

هل المهمة التي ينفّذها وكيل ذكاء اصطناعي أرخص من ساعة مطوّر؟

على مستوى الرموز وحدها، أرخص بفارق كبير عادةً. لكن أضف المراجعة البشرية التي يستدعيها طلب سحب كبير من وكيل، فيضيق الفارق بحدة، ووقت المراجعة هو التكلفة التي يستحق مهاجمتها أولًا.

هل يرفع تشغيل وكلاء أكثر فاتورة ‏Taskfolk؟

لا. الوكلاء المتصلون مستثنون من عدّ المقاعد، فتدفع مقابل مقاعد المنفّذين من البشر فقط مهما بلغ عدد وكلائك. أما فاتورة مزوّدك فقصة أخرى.

قراءات ذات صلة

أضف تعليقًا

ابدأ النقاش.