Category

Local AI

Ollama LM Studio Open WebUI vLLM llama.cpp SGLang TensorRT-LLM Text Generation Inference (TGI) Local RAG GPU Optimization

30 posts

كسر حاجز الأداء العالي للذكاء الاصطناعي المحلي: غوص عميق في SGLang

مع تزايد الطلب على نشر نماذج اللغات الكبيرة (LLMs) محلياً، يواجه المطورون عقبات مع محركات الاستدلال التقليدية. بينما هيمنت أطر عمل مثل vLLM على مشهد الخوادم، غالباً ما تُرك قطاع النشر المحلي والحواف بتقنيات أبطأ وأقل تحسيناً...

إتقان الاستدلال المحلي: غوص تقني عميق في llama.cpp

لقد تحولت ديمقراطية نماذج اللغة الكبيرة (LLMs) بسرعة من واجهات برمجة التطبيقات المعتمدة على السحابة إلى الاستدلال المحلي على الجهاز. يقود هذه الحركة llama.cpp، وهي تنفيذ بلغة C/C++ صُمم في الأصل لتشغيل نماذج LLaMA الخاصة بشركة Meta على شرائح Apple Silicon. واليوم، أصبح المعيار الفعلي...

بناء ذكاء اصطناعي خاص: غوص عميق للمطورين في LM Studio

مع توسع حدود الذكاء الاصطناعي التوليدي، لم يكن الطلب على حلول الاستدلال منخفضة الكمون والتي تضع الخصوصية في المقام الأول أعلى من أي وقت مضى. بالنسبة للمطورين المعتادين على واجهات برمجة التطبيقات السحابية، فإن الانتقال إلى الاستدلال المحلي يطرح تحديات فريدة تتعلق بتحسين الأجهزة ودمج سير العمل. هنا يأتي دور LM St...

إتقان التكميم المخصص: بناء خط أنابيب GGUF باستخدام llama.cpp لنماذج اللغات الكبيرة المتخصصة في المجال

أحدثت نماذج اللغات الكبيرة (LLMs) ثورة في تطوير البرمجيات، لكن نشرها محلياً غالباً ما يواجه عقبة: قيود الذاكرة. بينما تقدم نماذج مثل Llama 3 أو Mistral قدرات مذهلة، فإن تمثيلاتها القياسية ذات النقطة العائمة 16-بت (FP16) غالباً ما تكون ثقيلة جداً لأجهزة المستهلك...

فتح LM Studio: إدارة النماذج المتقدمة وتكوين واجهة برمجة التطبيقات للمستخدمين المحترفين

بالنسبة للمستخدم العادي، يوفر LM Studio راحة واجهة رسومية تُزيل الغموض عن استنتاج نماذج اللغات الكبيرة (LLM) محلياً. ومع ذلك، بالنسبة للمطورين وعلماء البيانات، تخفي هذه الأداة محركاً خلفياً قوياً قادراً على التنسيق المعقد، وتحسين الأداء بدقة، والتكامل السلس في...

إطلاق العنان لأقصى أداء: دليل المطور لاستدعاء نماذج اللغات الكبيرة محلياً باستخدام NVIDIA TensorRT-LLM

انتقل تشغيل نماذج اللغات الكبيرة (LLMs) محلياً من هواية متخصصة إلى مطلب حاسم للشركات التي تتطلب خصوصية البيانات واستجابات منخفضة زمن الوصول. بينما سهلت أطر عمل مثل Ollama وvLLم الذكاء الاصطناعي المحلي، يبرز NVIDIA TensorRT-LLM كمعيار ذهبي...