Category

Open Models

Llama Qwen DeepSeek Gemma Mistral Phi Falcon Yi Mixtral

33 posts

فالكون: القوة المفتوحة المصدر التي تتحدى العمالقة المملوكة

في المشهد سريع التطور لنماذج اللغات الكبيرة (LLMs)، هيمن التنافس بشكل كبير على العمالقة مغلقي المصدر مثل GPT-4 وClaude. ومع ذلك، أنتجت حركة المصدر المفتوح منافسين أقوياء، مع عائلة فالكون من معهد الابتكار التقني (TII)...

ما وراء الضجيج: دليل المطورين لنشر وتخصيص نموذج Llama

أشارت إصدارات سلسلة Llama من Meta إلى تحول محوري في مشهد الذكاء الاصطناعي. ومن خلال فتح مصادر النماذج الأساسية عالية الأداء، ديمقراطية الوصول إلى أحدث نماذج اللغات الكبيرة (LLMs)، مما أتاح للمطورين والباحثين...

فتح إمكانيات نموذج Llama 3.1 8B على الأجهزة الاستهلاكية: غوص عميق في التكميم والأداء

أدى إطلاق نموذج Meta Llama 3.1 8B إلى خفض حاجز الدخول بشكل كبير لنشر نماذج اللغة الكبيرة (LLMs) المتطورة. ومع ذلك، يظل تشغيل هذه النماذج بكفاءة على الأجهزة الاستهلاكية تحدياً. تتطلب التنفيذ القياسي للنقاط العائمة 16 بت (FP16)...

فتح آفاق المحادثات المؤسسية: غوص عميق في نموذج Starling-7B المفتوح

في المشهد المتطور بسرعة لنماذج اللغات الكبيرة (LLMs)، تضاءلت الفجوة بين العمالقة المملوكين والبدائل مفتوحة المصدر بشكل كبير. هنا يأتي دور Starling-7B، وهو نموذج بـ 7 مليارات معلمة طورته منظمة LMSYS. على عكس النماذج التقليدية التي تدرب...

إتقان RAG المؤسسي: غوص عميق في Cohere Command R

لقد تطورت نماذج اللغات الكبيرة (LLMs) بسرعة من مولدات نصوص بسيطة إلى وكلاء أقوياء قادرين على الاستدلال المعقد. ومع ذلك، بالنسبة للتطبيقات المؤسسية، تظل نقطتا ألم حرجتين: الهلوسة في خطوط أنابيب التوليد المعزز بالاسترجاع (RAG) والقدرة على التفاعل مع الأدوات الخارجية.