Claude يقود. وذكاءاتك الاصطناعية الأخرى تنجز المهام الصغيرة.
مع RouteAI، يُسند Claude اختبارات الوحدات والسكربتات وتعليقات docstring وملفات البناء والتعديلات الجماعية إلى الذكاءات الاصطناعية التي لديك بالفعل: نماذج Ollama على أجهزتك، والحصص اليومية المجانية لمزوّدين مثل Gemini أو Groq أو OpenRouter. الطاقة المجانية أولًا، والمدفوعة فقط إن سمحت بها، ويكتب Claude التكليف ويفحص النتيجة وتبقى له الكلمة الأخيرة.
Python 3.11 وOllama فقط · مزوّدو API اختياريون · Windows وmacOS وLinux · ترخيص MIT
فريق من المطورين المبتدئين على أجهزتك
خادم MCP صغير بلا أي تبعيات، وعقل توجيه يتعلّم، ومهارة تُخبر Claude متى يكون الإسناد مجديًا.
توجيه حسب القدرة والتكلفة
لكل مهمة فئة. تذهب complex وcode أولًا إلى جهاز GPU السريع، وtests وscripts وbuild وdocs إلى الأجهزة الأبطأ أو إلى الحصة المجانية لأحد المزوّدين. تُستخدم الطاقة المجانية قبل المدفوعة، وينتقل العمل إلى غيرها عندما تكون الأجهزة المفضلة مشغولة.
يتعلّم بأي نموذج يثق
يرتّب الموجِّه الأجهزة والنماذج حسب الجودة والسرعة المقيسة — بما في ذلك زمن تحميل النموذج وطابور الانتظار. وتأتي الدرجات من قياس الأداء ومن تقييم Claude لكل نتيجة حقيقية: جيدة، أو مُصحَّحة، أو مرفوضة.
تبقى الحوكمة بيد Claude
يقرر Claude ما يُسنده، ويكتب تكليفًا دقيقًا، ويشغّل الاختبارات، ويقرأ الفروقات (diff). ويبقى التصميم والتعليمات البرمجية الحساسة أمنيًا والتغييرات الشاملة من اختصاص Claude. أما قياس الأداء فيقترح تغييرات في الإعداد فقط، وأنت من يوافق عليها.
رموز أقل، فعلًا
يقرأ الخادم ملفات مشروعك بنفسه ويكتب النتائج مباشرةً على القرص، ولا يُرجع سوى معاينة قصيرة. لا يلصق Claude ملفًا أبدًا ولا يقرأ ردًا طويلًا، وتُبلغ كل مهمة بعدد الرموز التي وفّرتها.
دفعات متوازية
تعليمة واحدة، وأربعون ملفًا: اختبارات لكل وحدة، وdocstring لكل دالة، والترحيل نفسه في كل مكان. تتوزع المهام على جميع أجهزتك في آن واحد وتُكتب حيث تحدد، مثل tests/test_{stem}.py.
لا شيء لتثبيته سوى Python
مكتبة قياسية فقط: بلا pip، وبلا SDK، وبلا Docker. أضف مزوّد API متى شئت — Gemini أو Groq أو OpenRouter أو DeepSeek أو Mistral أو OpenAI أو نقطة الوصول الخاصة بك — مع المفتاح في متغير بيئة، لا في ملف أبدًا.
كيف تتكامل الأجزاء
يتحدث Claude Code إلى خادم محلي صغير واحد، ويتحدث الخادم إلى أجهزة Ollama على شبكتك، وإلى مزوّدي API الذين أضفتهم إن سمحت بذلك.
- الموجِّه: يختار الجهاز والنموذج لكل مهمة، المجاني قبل المدفوع
- الجودة والسرعة المقيسة لكل نموذج
- قياس أداء يقيّم نفسه، واحتساب الرموز
- يكتب Claude التكليفبضعة أسطر دقيقة ومسارات الملفات — لا محتوى الملفات أبدًا، فلا يدفع Claude ثمن قراءتها.
- يوجّهه الخادميقرأ الملفات، ويختار أفضل جهاز متاح ونموذج للفئة، وتُكتب النتيجة مباشرةً على القرص.
- يتحقق Claude ويقيّميشغّل الاختبارات، ويقرأ الفروقات (diff)، ويصنّف النتيجة: جيدة، أو مُصحَّحة، أو مرفوضة. ويتعلّم التوجيه من كل تقييم.
- ترى ما وفّرتهتُبلغ كل مهمة منجزة برموز Claude التي وفّرتها وبإجمالي الجلسة. قد تأتي نتيجة المهام الصغيرة جدًا بالسالب، والأرقام تقول ذلك بصراحة.
جاهز للعمل خلال خمس دقائق
إذا كان Ollama يعمل على أجهزتك بالفعل، فقد أوشكت على الانتهاء.
- ثبّت الإضافةيضيف أمران في Claude Code المتجر (marketplace) ويثبّتان RouteAI: خادم MCP، ومهارة الإسناد، والأمرين
/routeai:statusو/routeai:bench. - صِف أجهزتكيفحص
/routeai:setupكل خادم Ollama ويكتب~/.routeai/fleet.toml، ويضيف/routeai:add-aiمزوّدًا: يبقى مفتاحه في متغير بيئة، وأنت من يقرر إن كان يحق لملفاتك الوصول إليه. - اعمل كالمعتادعندما تتضمن الخطة اختبارات أو سكربتات أو تعليمات برمجية متكررة، يُسندها Claude، ويتحقق مما يعود، ويقيّمه. استخدم
/routeai:statusفي أي وقت لترى أين يذهب العمل وكم رمزًا وُفِّر.
التثبيت
# in Claude Code /plugin marketplace add bdbais/routeai /plugin install routeai@bais # describe your machines: models are picked and suggested per machine /routeai:setup gpu=http://192.168.1.13:11434 local=http://localhost:11434 # let the fleet learn your hardware, then check routing and savings /routeai:bench /routeai:status
على الأجهزة الأخرى غير جهازك، شغّل Ollama باستخدام OLLAMA_HOST=0.0.0.0 ليستمع على شبكتك. تعثر الإضافة بنفسها على Python 3.11+ (py أو python3 أو python).
قياس أداء يقيّم نفسه بنفسه
شغّله من حين لآخر حتى يتعرّف الأسطول على أجهزتك: كثيرًا ما دام لا يزال يتعلّم، ومرة شهريًا بعد أن تستقر الدرجات. ولا يُمَس المزوّدون المدفوعون ما لم تطلبهم بنفسك.
تقييم لا تخمين
عشر مهام حقيقية بفحوص تلقائية: تُشغَّل التعليمات البرمجية مقابل اختبارات وحدات مخفية، ويجب أن تكتشف الاختبارات المولَّدة أخطاءً زُرعت عمدًا، وتُنفَّذ السكربتات، ويُحلَّل TOML، وتُقارَن تعليقات docstring مع AST.
يستخرج أقصى ما في أجهزتك
يقيس عدد الرموز في الثانية، وزمن تحميل النموذج، ومقدار ما يتسع له VRAM من كل نموذج، وكيف تزداد الإنتاجية مع الطلبات المتوازية — ثم يخبرك بحجم السياق ودرجة التوازي الأنسب.
توصيات لا مفاجآت
يكتب كل تشغيل تقريرًا: أفضل نموذج لكل فئة، والنماذج التي ينبغي الاستغناء عنها، وعقدة أسرع تستحق فئة heavy. ويحوّله Claude إلى تغيير مقترح على fleet.toml لتوافق عليه.
يعرف متى يتوقف
يصبح كل زوج من نموذج وفئة مستقرًا بعد خمس عينات متسقة. تخبرك حالة النظام (status) متى يحين تشغيل جديد، وفي الأثناء يواصل العمل الحقيقي تحسين الدرجات.
تبقى تعليماتك البرمجية داخل شبكتك
لا يكون الإسناد مفيدًا إلا إذا لم يفتح ثغرات جديدة.
لا يخرج شيء من جهازك افتراضيًا
ترى النماذج المحلية ملفاتك، أما المزوّد الذي أضفته فلا يراها ما لم تفعّل له send_files. وتُتجاهَل نماذج Ollama من نوع :cloud، التي تعمل على ollama.com، ما لم تسمح بها صراحةً.
وصول محصور إلى الملفات
يقرأ الخادم ويكتب داخل المشروع الحالي والمجلدات التي تحددها فقط. وتُرفض أي مسارات تخرج عنها.
لا قياس عن بُعد
تبقى الإحصاءات والسجلات والتقارير في ~/.routeai على جهازك. ولا تتواصل الإضافة إلا مع خوادم Ollama التي أعددتها.
المفاتيح والميزانيات
تعيش مفاتيح API في متغيرات البيئة: لا في الإعداد أبدًا، ولا في المحادثة، ولا في أي سجل، ولا تتبع الطلبات أي إعادة توجيه. ولكل مزوّد سعره وسقف يومي بالطلبات أو الرموز أو الدولارات؛ وعند بلوغ السقف يعود العمل إلى أجهزتك.
مجاني ومفتوح المصدر، وسيبقى كذلك
يصدر RouteAI بموجب ترخيص MIT: استخدمه في العمل، وعدّله، وشاركه. إذا وفّر عليك رموزًا، فإن تبرعًا صغيرًا يساعد على استمراره.
أسئلة
ما النماذج التي ينبغي أن أستخدمها؟
يقترح الإعداد نماذج coder تناسب كل جهاز — على GPU بسعة 12 GB يعمل qwen2.5-coder:14b (نحو 50 tok/s) ونموذج mixture-of-experts qwen3-coder:30b، وعلى حاسوب محمول يعمل بـ CPU فقط نماذج بحجم 3–7B — ولا ينزّلها إلا بموافقتك. أما لدى المزوّدين فتختار من النماذج التي يوفّرونها. ثم يُظهر قياس الأداء ما ينجح فعلًا.
كم رمزًا يوفّر؟
تُخبرك بذلك كل مهمة منجزة: الملفات التي قرأها النموذج المنفِّذ مضافًا إليها ما كتبه، مطروحًا منها التكليف الذي كتبه Claude والنتيجة التي قرأها. توفّر المهام الكبيرة والدفعات آلاف الرموز، أما الصغيرة جدًا فقد تكلّف أكثر مما توفّر، ويقول التقرير ذلك — بما في ذلك ما كلّفك مزوّد مدفوع.
ماذا يحدث إذا كان أحد الأجهزة مطفأً؟
يُعلَّم على أنه متوقف، ويذهب العمل إلى الأجهزة الأخرى. وإذا لم يستطع أي منها تولي فئة ما، تُبلغ الأداة بذلك وينجز Claude المهمة بنفسه ببساطة.
هل الحاسوب المحمول بلا GPU مفيد؟
نعم، للسكربتات والاختبارات والتوثيق مع النماذج الصغيرة، وكاحتياطي عندما يكون جهاز GPU مشغولًا. شغّل عليه مهمة واحدة في كل مرة ليبقى عملك أنت سلسًا.
هل يمكنني إضافة Gemini أو Groq أو OpenAI؟
نعم: /routeai:add-ai gemini gem1. تعمل أي واجهة API متوافقة مع OpenAI، بما في ذلك vLLM أو LM Studio الخاصان بك. يذهب المفتاح إلى متغير بيئة، وأنت من يقرر إن كان يجوز إرسال ملفاتك، وأنت من يضبط سقفًا يوميًا بالطلبات أو الرموز أو الدولارات.
هل هو منتج من Anthropic أو Ollama؟
لا. إنه مشروع مستقل مفتوح المصدر، غير تابع لـ Anthropic ولا لـ Ollama. يستخدم واجهات الإضافات وMCP العامة في Claude Code وواجهة API العامة في Ollama.