Yettyبيتا مفتوحة
أداة مجانية

حاسبة تكاليف
LLM API

الصق طلباً نموذجياً أو اكتب أعداد التوكنات، حدّد حجمك، وشاهد كم يكلّف الشهر على Claude وGPT وGemini وLlama وDeepSeek؛ جنباً إلى جنب، وكل سعر قابل للتعديل.

مجاناً، بلا تسجيل خاص 100%، لا شيء يغادر متصفّحك أسعار قابلة للتعديل، لا تتقادم أبداً
احسب الفاتورة

كم سيكلّف شهر من الطلبات؟

خاص 100%، لا شيء يغادر متصفّحك.

تقدير التوكنات = الأحرف / 4. تختلف أدوات التوكنة الحقيقية بحسب النموذج واللغة، عادةً بنسبة 10-15%؛ جيد للميزانية لا للفواتير.

%
الأسعار تتحرك؛ عدّل أي خلية. قيم 2026 الافتراضية نقطة انطلاق لا نصّاً مقدّساً؛ راجع صفحة أسعار مزوّدك.
النموذج إدخال $/1M إخراج $/1M التكلفة / شهر قارن إذا تضاعف 10 مرات
الصقه مباشرةً في مستند أو مسألة أو محادثة.
تبني شيئاً بذلك الذكاء الاصطناعي؟

حين يبني الذكاء الاصطناعي لديك موقعاً، تنشره Yetty مباشرة وتبقى متصلة عبر MCP؛ فيواصل الذكاء الاصطناعي التعديل والنشر وقراءة العملاء المحتملين.

لماذا تفاجئ الفاتورة الناس

كيف تعمل فوترة
LLM فعلاً

عدّادان، لا واحد

يُحتسب الإدخال والإخراج كلٌّ على حدة، والإخراج عادةً يكلّف نحو 5 أضعاف لكل توكن. نموذج ثرثار على خطة رخيصة قد يفوق في فاتورته نموذجاً مقتضباً على خطة باهظة.

أنت تعيد إرسال المحادثة كلها

الـAPI بلا حالة: كل دور يعيد إرسال السجل الكامل كإدخال. محادثة من 20 دوراً تدفع ثمن الدور 1 عشرين مرة؛ ولهذا تغلو المحادثات الطويلة بسرعة.

التخزين المؤقت هو الرافعة الكبرى

مقدّمة طلب ثابتة (طلب النظام، المستندات، الأدوات) يمكن تخزينها مؤقتاً؛ عندئذ يحتسب المزوّدون الإدخال المخزّن بخصم شديد، غالباً نحو 90%. فعّله بالأعلى لترى الأثر.

حجم النموذج مدى بـ25 ضعفاً

بين نموذج صغير ونموذج رائد قد يختلف السعر نفسه بمقدار 25 ضعفاً. وجّه الطلبات البسيطة (تصنيف، استخراج، إعادة تنسيق) إلى الصغير، وأبقِ الرائد للعمل الصعب.

التوكنات ليست كلمات

تبلغ الإنجليزية نحو 4 أحرف لكل توكن، لكن الشيفرة وJSON واللغات غير اللاتينية تُوكَّن أثقل. الطلب "القصير" نفسه بالعبرية أو اليابانية قد يكلّف أكثر بوضوح.

النجاح هو الخطر

التكاليف تتزايد خطياً مع الاستخدام؛ عمود ضِعف 10 بالأعلى هو سيناريو "انطلقت ميزتنا". خصّص له ميزانية قبل الإطلاق، لا في بريد الفاتورة بعده.

إجابات سريعة

يسأل الناس أيضاً

كم تكلفة Claude API لكل مليون توكن؟

اعتباراً من منتصف 2026 تبلغ الأسعار الرئيسية نحو 5$ لكل مليون توكن إدخال و25$ لكل مليون توكن إخراج في Claude Opus، و3$/15$ في Claude Sonnet، و1$/5$ في Claude Haiku. يغيّر المزوّدون الأسعار ويطلقون العروض كثيراً، ولهذا بالضبط كل خلية سعر في هذه الحاسبة قابلة للتعديل؛ اعتبر القيم الافتراضية نقطة انطلاق، والصق الأرقام الحالية من صفحة أسعار مزوّدك.

كيف أقدّر عدد التوكنات في نصّي؟

قاعدة سريعة للإنجليزية هي توكن واحد لكل 4 أحرف، أو نحو 750 كلمة لكل 1,000 توكن. تختلف أدوات التوكنة الحقيقية بحسب النموذج واللغة؛ فالشيفرة والكتابات غير اللاتينية والتنسيق غير المعتاد قد تغيّر العدد بنسبة 10-15% أو أكثر، فاستخدم التقدير للميزانية، ومُحصي التوكنات لدى المزوّد حين تحتاج فاتورة دقيقة.

كيف أقلّل تكاليف LLM API لديّ؟

أهم ثلاث روافع: استخدم نموذجاً أصغر للطلبات البسيطة (التصنيف والاستخراج نادراً ما يحتاجان نموذجاً رائداً)، خزّن مقدّمة الطلب المتكررة مؤقتاً (يخصم المزوّدون على الإدخال المخزّن بشدّة، غالباً نحو 90%)، وقلّل ما ترسله؛ فطلبات النظام الأقصر والسجل المُلخّص يخفّضان فاتورة الإدخال في كل طلب. وعادةً تضيف Batch APIs خصماً بنحو 50% للمهام التي تحتمل الانتظار.

دورك الآن

أحضر الموقع الذي لديك بالفعل.

أنفق التوكنات على موقع يدرّ دخلاً.

الذكاء الاصطناعي لديك يبني الموقع، وYetty تستضيفه وتسلّم مفاتيحه للذكاء الاصطناعي عبر MCP: النشر والتعديلات وSEO والعملاء المحتملون، كلها بطلب واحد.