Category

Open Models

Llama Qwen DeepSeek Gemma Mistral Phi Falcon Yi Mixtral

33 posts

باز کردن قفل هوش مصنوعی با عملکرد بالا: نگاهی عمیق به مدل‌های متن‌باز DeepSeek

منظره مدل‌های زبانی بزرگ (LLMs) به سرعت در حال تحول است و از غول‌های منبع‌بسته به سمت جایگزین‌های قدرتمند وزن‌باز حرکت می‌کند که به توسعه‌دهندگان امکان می‌دهد راه‌حل‌های هوش مصنوعی سفارشی، کارآمد و شفاف بسازند. در میان رقابت‌کنندگان جذاب این حوزه، DeepSeek شرکتی است که...

کشف کارایی: نگاهی عمیق به مدل Mixtral 8x7B شرکت Mistral AI

در منظره‌ی به سرعت در حال تحول مدل‌های زبانی بزرگ (LLMs)، جستجو برای عملکرد بالا بدون هزینه‌ی سرسام‌آور تعداد پارامترهای عظیم، به یکی از مهم‌ترین تغییرات معماری در سال‌های اخیر منجر شده است: مکانیسم ترکیب متخصصان (MoE). این مدل از آزمایشگاه‌های...

کشف قدرت فالکون: نگاهی عمیق به مدل‌های زبانی بزرگ متن‌باز

در چشم‌انداز به‌سرعت در حال تحول هوش مصنوعی، حرکت به سمت مدل‌های زبانی بزرگ (LLM) متن‌باز، دسترسی به قابلیت‌های پیشرفته پردازش زبان طبیعی را دموکراتیک کرده است. در میان غول‌های این حوزه، فالکون که توسط مؤسسه نوآوری فناوری توسعه یافته...

تسلط بر لاما: بررسی فنی عمیق در انقلاب مدل‌های زبانی بزرگ متن‌باز متا

منظره هوش مصنوعی با انتشار سری لاما متا به شدت تغییر کرده است. با متن‌باز کردن این مدل‌های زبانی بزرگ (LLM)، متا دسترسی به قابلیت‌های پیشرفته هوش مصنوعی را دموکراتیک کرده و به توسعه‌دهندگان اجازه می‌دهد تا برنامه‌های کاربردی اختصاصی و با عملکرد بالا بسازند...