حاسبة ميزانية السياق
اختر مستوى عتاد (من T0 إلى T9) للمعاينة، وقيمة مستهدفة لـ
chat.max_context_tokens (من 500 إلى 200,000). تحدّد القيمة في YAML؛ وتُشحن القيم الافتراضية عند التثبيت.
طول التوليد يستخدم chat.max_gen_tokens
(الحد الأقصى الذي يضبطه المُشغّل لـ Ollama
num_predict) — يقوم زر تطبيق في تطبيق Engine على سطح المكتب بكتابة كلا المفتاحين معاً لمستواك.
تحذيرات التأثير استرشادية فقط.
config/contextmint.defaults.yaml على مضيف API، أو عبر تراكب
~/.contextmint/server.defaults.yaml.
القيم الحية: GET /api/v1/config/context-budget?max_context_tokens=….
يعتمد مستوى العتاد في هذه الصفحة على ChatCaps وقت التشغيل من detector.py — وليس أداة تحقق من الإعداد.
المدخلات
النطاق الصالح من 500 إلى 200,000 رمز (الحد الأقصى في مخطط الخادم). الإعدادات المسبقة اختصارات؛ يمكنك كتابة أي قيمة ضمن النطاق.
مصفوفة القياس
الحقول المحسوبة لـ chat.* بناءً على
max_context_tokens المُختار عندما تكون
context_budget.auto_scale صحيحة (النسب من القيم الافتراضية المشحونة؛ خط الأساس
10000).
| متغيّر الخادم | القيمة المحسوبة | الصيغة |
|---|
غلاف المستوى (ChatCaps)
يربط فحص بدء التشغيل ذاكرة RAM/VRAM بالمستوى ثم بهذه السقوف. القيم من detector.py.
ميزانية RAG الفعلية (للمستوى المحدد)
ترتيب وقت التشغيل: سقف الإعداد ← تقييد العتاد ← الحد الأدنى للنية (يُرفع حتى سقف الإعداد). تجاوزات سياسة الصحة غير مُمثَّلة هنا.
مصفوفة مقارنة المستويات
ميزانية شرائح RAG الفعلية لكل مستوى عند نفس max_context_tokens.
ملف النسب (يُحرَّر في YAML)
| مفتاح النسبة | الكسر من max_context_tokens |
|---|
تراكب مثال
التطبيق الحي (Engine)
متصل بـ . يكتب في
~/.contextmint/server.defaults.yaml عبر واجهة API المحلية — يتطلّب إعادة تشغيل الخادم.