تحمل كل بطاقة نموذج رقمًا مثل «٢٠٠K سياق» أو «١M سياق». يبدو كمواصفة سعة، مثل مساحة القرص. لكنه أقرب إلى ميزانية تنفقها في كل طلب على حدة — ومعظم ما ينفقها ليس ما كتبته أنت.
آخر تحقّق من الأرقام: ٢٦ أغسطس ٢٠٢٦.
ما هو طول السياق
النموذج بلا ذاكرة. في كل مرة تستدعيه ترسل المحادثة كاملة من جديد — مطالبة النظام، وكل دور سابق، وأي ملفات مرفقة — ويقرأ ذلك كله قبل أن يكتب كلمة واحدة.
طول السياق هو الحجم الأقصى لتلك الحزمة، مقيسًا بالتوكنات. التوكن قطعة نصية صغيرة، نحو ثلاثة أرباع كلمة في الإنجليزية.
فهو إذن ليس مساحة تخزين. إنه حجم المكتب الذي يستطيع النموذج أن يفرد عليه مستنداتك، ويُخلى من جديد مع كل طلب.
الحدود الحقيقية اليوم
| طول السياق | نماذج بهذا الحجم |
|---|---|
| ٣٢٬٧٦٨ | Qwen 2.5 Coder 32B |
| ٢٠٠٬٠٠٠ | Claude Haiku 4.5 |
| ٢٦٢٬١٤٤ | Kimi K2.7 Code |
| ٤٠٠٬٠٠٠ | عائلة GPT-5 كاملة، بما فيها كل صيغة Codex |
| ١٬٠٠٠٬٠٠٠ | Claude Opus 5 و Claude Sonnet 5 و Qwen3 Coder Flash و Plus |
| ١٬٠٤٨٬٥٧٦ | عائلتا Gemini 2.5 و 3.x، و DeepSeek V4 Pro |
أمران يستحقان الانتباه.
المليون توكن نحو ٧٥٠٬٠٠٠ كلمة — عدة روايات طويلة. لا يحتاج ذلك أي تطبيق تقريبًا، ومن يحتاجه غالبًا لديه مشكلة استرجاع لا مشكلة سياق.
١٬٠٤٨٬٥٧٦ هو ٢²⁰، لا رقم تسويقي مدوّر. حيث يذكر مزوّد ١٬٠٠٠٬٠٠٠ بالضبط فقد قرّب؛ وحيث يذكر ١٬٠٤٨٬٥٧٦ فهو يبلّغ حجم المخزن الحقيقي.
أسعار التوكنات وأطوال السياق لكل نموذج نصّي على صفحة نماذج المحادثة.
ما الذي يملؤه فعلًا
هذا هو الجزء الذي لا تخبرك به بطاقات النماذج. ينشر توثيق Anthropic أعداد توكنات دقيقة لبضعة طلبات دنيا، وهي مفيدة:
| ما أُرسل | توكنات الإدخال |
|---|---|
| مطالبة نظام من خمس كلمات مع رسالة من كلمتين | ١٤ |
| سؤال من تسع كلمات مع تعريف أداة واحدة | ٤٠٣ |
| صورة واحدة مع «Describe this image» | ١٬٠٢٨ |
| ملف PDF واحد مع «Please summarize this document.» | ٢٬١٨٨ |
تعريف أداة واحدة يكلّف نحو ٣٩٠ توكنًا. وكيل يملك عشرين أداة ينفق نحو ٨٬٠٠٠ توكن من نافذته قبل أن يكتب المستخدم شيئًا — ويدفعها في كل طلب.
الصورة نحو ألف توكن. عشرون لقطة شاشة تعني ٢٠٬٠٠٠.
والمحادثة نفسها تكبر. الدور العاشر يحمل الأدوار من الأول إلى التاسع. محادثة بدت صغيرة في البداية تصير في النهاية أكبر شيء في الطلب.
فنموذج بـ«٢٠٠K سياق» داخل وكيل بخمس عشرة أداة ومطالبة نظام طويلة وبضع لقطات لا يبدأ عند ٢٠٠K. يبدأ أدنى من ذلك بكثير، ويتقلّص مع كل دور.
الفخ: النص نفسه ليس العدد نفسه من التوكنات
يُقاس طول السياق بالتوكنات، والتوكنات ليست وحدة ثابتة عبر النماذج.
يذكر توثيق Anthropic نفسه أن Claude 4.7 وما بعده يستخدم مُقطِّعًا أحدث ينتج فيه «النص المُدخَل نفسه توكنات أكثر بنحو ٣٠ بالمئة مما كان على النماذج السابقة».
ما يعني: مطالبة قيست بـ١٥٠٬٠٠٠ توكن على نموذج أقدم قد تصبح نحو ١٩٥٬٠٠٠ على أحدث — الكلمات نفسها، وثلاثون بالمئة أكثر من النافذة، وثلاثون بالمئة أكثر من الكلفة. إن كنت قد قِسْت خط معالجة مستندات على نموذج ثم بدّلته، فأعد القياس قبل أن تفترض أنه ما زال يتّسع.
المزوّدون يمنحونك وسيلة للتحقّق. نقطة نهاية عدّ التوكنات لدى Anthropic مجانية الاستدعاء. عُدّ على النموذج نفسه الذي تنوي تشغيله.
ماذا يحدث حين ينفد المكان
ليس تدهورًا لطيفًا. بحسب المزوّد تحصل على خطأ، أو إدخال مبتور، أو سجلّ مُسقَط بصمت — والثالث هو الخطِر، لأن النموذج يجيب بثقة انطلاقًا من محادثة لم يعد يراها كاملة.
ثلاثة مخارج، مرتّبة بحسب الجهد:
التقليم. إسقاط أقدم الأدوار أو تلخيصها. الأرخص بناءً، ويكفي عادةً للمحادثة.
التخزين المؤقت. إن كان الجزء الكبير من سياقك بادئة ثابتة — مطالبة نظام طويلة، أو مستند مرجعي — فالتخزين المؤقت للمطالبات يتيح للمزوّد حفظها والمحاسبة على جزء يسير لإعادة قراءتها. هذا لا يوسّع النافذة، لكنه يزيل معظم كلفة ملئها.
الاسترجاع. الكفّ عن إرسال المتن كله وإرسال الأجزاء ذات الصلة فقط. هندسة أكثر، لكنه النهج الوحيد الذي لا يسوء مع نمو بياناتك.
اللجوء إلى نافذة سياق أكبر هو الخيار الرابع، وعادةً الأغلى — لأنك تدفع ثمن كل توكن في تلك النافذة في كل طلب.
هل تكلّف النافذة الأكبر أكثر؟
ليس لكل توكن. نموذج بسياق ١M لا يُحاسَب بسعر أعلى من نموذج بـ٢٠٠K على الطلب نفسه؛ Claude Sonnet 5 بـ٢٫٠٠ دولار لكل مليون توكن إدخال، سواء أرسلت خمسمئة توكن أو خمسمئة ألف.
لكن النافذة الأكبر تجعل الإنفاق الأكبر سهلًا، لأنها تزيل الخطأ الذي كان سيوقفك. ملء نافذة مليون توكن بسعر ٢٫٠٠ دولار للمليون يكلّف ٢٫٠٠ دولار للطلب — وإذا كان ذلك الطلب دورَ محادثة يحدث خمسين ألف مرة شهريًا، فالحساب يصير جادًّا بسرعة.
الانضباط واحد في الحالتين: أرسل أقلّ ما تستطيع، لا أكثر ما يُسمح لك به.
الخلاصة المختصرة
- طول السياق هو الحجم الأقصى لطلب واحد، بالتوكنات، وليس ذاكرة.
- حدود اليوم تمتد من نحو ٣٣K إلى نحو ١M؛ ومعظم العمل الإنتاجي يتّسع مرتاحًا في الطرف الأدنى.
- تعريفات الأدوات (~٣٩٠ توكنًا لكل واحد)، والصور (~١٬٠٠٠)، وملفات PDF (~٢٬٠٠٠)، والسجلّ المُعاد إرساله تملؤه أسرع من مطالباتك.
- النص نفسه عدد توكنات مختلف على نماذج مختلفة — أعد التحقّق عند التبديل.
- النافذة الأكبر لا تكلّف أكثر لكل توكن. هي فقط تسهّل إنفاق المزيد منها.
استكشف المزيد على ElliSekiz
قارن أطوال السياق وأسعار التوكنات جنبًا إلى جنب. صفحة نماذج المحادثة تسرد كل نموذج نصّي بأسعار إدخاله وإخراجه.
ثم قِس مطالبتك أنت. كل صفحة نموذج فيها playground — شغّل طلبًا حقيقيًا واقرأ أعداد التوكنات الفعلية قبل أن تقيس أي شيء.
المصادر
- واجهة نماذج OpenRouter،
https://openrouter.ai/api/v1/models(أطوال السياق، قُرئت في ٢٦-٠٨-٢٠٢٦) - Anthropic — Token counting (أعداد أمثلة موثّقة، تغيّر المُقطِّع، نقطة نهاية عدّ مجانية)
