الرموز والسياق والتسعير
- عُدّ الرموز بشكل صحيح باستخدام أدوات Anthropic نفسها (لا مُجزّئ رموز نموذج آخر)
- ميّز بين max_tokens ونافذة السياق — ولماذا يهمّ هذا الفرق
- قدّر تكلفة الواجهة البرمجية من رموز المدخلات + المخرجات بأسعار كل نموذج
- اخفض التكلفة دون خسارة الجودة: اختر الحجم المناسب، خزّن مؤقتًا، قلّص، جمّع في حِزَم
التكلفة والحدود على الواجهة البرمجية تُقاس جميعها بـ**الرموز** (~ثلاثة أرباع الكلمة). ثلاثة أمور ينبغي ضبطها بدقة.
1. عُدّ الرموز بشكل صحيح
لا تخمّن، ولا تستخدم مُجزّئ رموز نموذج آخر (مثل tiktoken) — إذ تختلف أعداد الرموز بين عائلات النماذج. استخدم نقطة نهاية عدّ الرموز من Anthropic أو مساعد SDK لقياس الطلب قبل إرساله.
- قاعدة تخطيط تقريبية: ~750 كلمة ≈ ~1000 رمز (الرمز يساوي تقريبًا ثلاثة أرباع الكلمة).
2. max_tokens ≠ نافذة السياق
من السهل الخلط بين هذين الحدّين، لكنهما يحكمان أمرين مختلفين.
| الحدّ | ما الذي يقيّده | متى تغيّره |
|---|---|---|
max_tokens | طول الردّ (المخرجات فقط) | ارفعه إذا اقتُطِعت المخرجات |
| نافذة السياق | الميزانية الكلّية لـالمدخلات + المخرجات | المدخلات الكبيرة تترك مساحة أقلّ للمخرجات |
- اضبط max_tokens بحسب ما تحتاجه المهمة. القيمة المنخفضة جدًا تقتطع الردّ. والعالية بلا داعٍ لا تكلّف أكثر — فأنت تدفع فقط مقابل الرموز المُولَّدة فعليًا — لكنها قد تجعل الردود تستطرد.
3. قدّر التكلفة
تُحاسَب على رموز المدخلات + رموز المخرجات، بأسعار لكل نموذج (Opus > Sonnet > Haiku). تقدير سريع:
cost ≈ (input_tokens × input_rate) + (output_tokens × output_rate)
احصل على الأسعار الحالية من صفحة التسعير الرسمية — نحن لا نُرمّزها هنا عن قصد.
خفض التكلفة (دون خسارة الجودة)
Guided walkthrough1 of 4
- ابدأ بـ Sonnet؛ واحفظ Opus للأجزاء الصعبة. راجع اختيار نموذج (/docs/api/choosing-a-model).
- أعِد استخدام بادئة مطالبة ثابتة عبر الاستدعاءات. راجع التخزين المؤقت للمطالبات (/docs/api/prompt-caching).
- أرسل فقط السياق المهمّ. وهنا يساعد RAG (/docs/foundations/rag) أيضًا.
- حزّم المهام التي لا يهمّ فيها زمن الاستجابة.
مزيد من الاستراتيجية في مفاضلات التكلفة والزمن.
اختبر نفسك
0/4- كل شيء يُقاس بالرموز (~ثلاثة أرباع الكلمة)؛ ~750 كلمة ≈ ~1000 رمز.
- عُدّ الرموز بأدوات Anthropic نفسها — لا بمُجزّئ رموز نموذج آخر أبدًا.
- يضع max_tokens حدًّا للردّ؛ ونافذة السياق هي ميزانية المدخلات + المخرجات الكلّية.
- المحاسبة = رموز المدخلات + رموز المخرجات بأسعار لكل نموذج (Opus > Sonnet > Haiku).
- اخفض التكلفة باختيار حجم النموذج المناسب، وتخزين البادئات مؤقتًا، وتقليص المدخلات، والتجميع في حِزَم.