Category

Open Models

Llama Qwen DeepSeek Gemma Mistral Phi Falcon Yi Mixtral

33 posts

باز کردن قفل دقت: بهترین شیوه‌ها برای Nomic-Embed Text در پایپ‌لاین‌های RAG

پارادایم تولید تقویت‌شده با بازیابی (RAG) نحوه تعامل مدل‌های زبانی بزرگ با داده‌های اختصاصی را متحول کرده است. با این حال، کیفیت سیستم RAG شما به شدت به یک جزء حیاتی وابسته است: مدل امبدینگ. در حالی که بسیاری از توسعه‌دهندگان به راه‌حل‌های انحصاری مانند O...

استقرار SmolLM2: مدل زبانی بزرگ ۱.۷ میلیارد پارامتری با کارایی بالا برای استنتاج محلی

زمینه مدل‌های زبانی بزرگ (LLMs) به‌طور فزاینده‌ای توسط رقابت برای اندازه و قابلیت‌ها تحت سلطه است، اما تقاضای رو به رشدی برای مدل‌هایی وجود دارد که اولویت را به کارایی، سرعت و مقرون‌به‌صرفه بودن می‌دهند بدون آنکه هوش بنیادین را فدا کنند. SmolLM2 از Hugging Face وارد میدان می‌شود...

بازدهی را آزاد کنید: بررسی فنی عمیق مدل‌های متن‌باز Mistral AI

در منظره سریعاً در حال تحول مدل‌های زبانی بزرگ (LLMs)، حرکت به سمت مدل‌های وزن‌باز یک حرکت تحول‌آفرین بوده است. در حالی که بسیاری از مدل‌های انحصاری پشت درهای API قفل شده‌اند، Mistral AI به عنوان یک رقیب قدرتمند ظهور کرده است...

مقایسه Mistral 7B و Mistral Large: بررسی معماری و عملکرد برای استقرار سازمانی

منظره مدل‌های زبانی بزرگ (LLM) به سرعت در حال تحول است و مدل‌های وزن‌باز به دلیل شفافیت و مقرون‌به‌صرفه بودن محبوبیت زیادی کسب کرده‌اند. در خط مقدم این حرکت، Mistral AI راه‌حل‌های متمایزی ارائه می‌دهد که برای محدودیت‌های محاسباتی مختلف و نیازهای عملکردی سفارشی‌سازی شده‌اند.

یِی توسط 01.AI: نگاهی عمیق به مدل زبانی بزرگ با وزن باز که منظره هوش مصنوعی را دگرگون می‌کند

در بوم‌سازگان پویای مدل‌های زبانی بزرگ (LLM)، معرفی مدل‌های با عملکرد بالا و وزن باز، لحظه‌ای محوری برای جامعه توسعه‌دهندگان بوده است. در میان این رقبا، یِی (Yi) به عنوان سری مدل‌های زبانی بزرگ توسعه‌یافته توسط 01.AI، بنیان‌گذاری‌شده توسط دانشمند برجسته هوش مصنوعی...

جما: رمزگشایی از مدل‌های زبانی باز نسل بعدی گوگل

منظره مدل‌های زبانی بزرگ (LLMs) رو به اشباع می‌رود، اما انتشارات کمی به اندازه سری **Gemma** گوگل دیپ‌مایند هیجان فنی ایجاد کرده‌اند. جما به عنوان خواهر وزن‌باز خانواده PaLM 2 گوگل طراحی شده و به محققان و توسعه‌دهندگان مدل‌های پایه با عملکرد بالا با موانع ورود بسیار کمتر ارائه می‌دهد...

فای آزاد شده: ساخت هوش مصنوعی لبه‌ای کارآمد با مدل‌های کوچک زبانی مایکروسافت

منظره مدل‌های زبانی بزرگ (LLMs) به‌طور سنتی توسط تعداد پارامترهای عظیمی که نیاز به GPUهای گران‌قیمت و زیرساخت ابری قابل‌توجهی دارند، مسلط بوده است. با این حال، تحقیقات مایکروسافت این پارادایم را با سری مدل‌های فای به چالش کشیده است. این‌ها فقط مدل‌های «کوچک» نیستند؛ آن‌ها...