Category

Open Models

Llama Qwen DeepSeek Gemma Mistral Phi Falcon Yi Mixtral

33 posts

Phi-4: تغییر به سمت استدلال در مدل‌های زبانی کوچک

منظره مدل‌های زبانی کوچک (SLM) در حال تجربه یک تحول بنیادین است. سال‌هاست که پارادایم غالب بر افزایش حجم داده‌های مصنوعی برای تقلید از پیچیدگی مدل‌های بزرگ‌تر استوار بوده است. با این حال، انتشار Phi-4 از مایکروسافت نقطه عطفی قاطع را نشان می‌دهد. این مدل پیشنهاد می‌کند که گلوگاه دیگر حجم داده نیست، بلکه کیفیت قابلیت‌های استدلالی تعبیه‌شده در معماری و فرآیند آموزش است.

رمزگشایی از دیپ‌سیک: تحول معماری در هوش مصنوعی متن‌باز

منظره هوش مصنوعی مدت طولانی تحت سلطه غول‌های مالکیت خصوصی بوده است، اما ظهور اخیر دیپ‌سیک این وضع موجود را به‌طور بنیادین به چالش کشیده است. دیپ‌سیک که از شرکت معاملاتی کمّی چینی High-Flyer سرچشمه گرفته، صنعت را نه تنها از طریق معیارهای عملکرد، بلکه با نشان دادن اینکه هوش سطح بالا نیازی به میلیاردها دلار سخت‌افزار اختصاصی یا انحصار منبع بسته ندارد، دگرگون کرده است...

DeepSeek-V3: تحلیل معماری MoE و کارایی آموزش برای استنباط مقرون‌به‌صرفه

انتشار DeepSeek-V3 نقطه عطفی مهم در فضای مدل‌های زبانی بزرگ (LLM) متن‌باز بود. با بهره‌گیری از معماری پیشرفته ترکیب متخصصان (MoE)، DeepSeek نشان داد که مقیاس عظیم لزوماً به هزینه‌های محاسباتی افسانه‌ای نیاز ندارد. برای توسعه‌دهندگان و مهندسان...

استاندارد آپاچی ۲.۰: سوخت رشد تجاری مدل‌های زبانی بزرگ متن‌باز

توسعه سریع مدل‌های زبانی بزرگ (LLM) منظره نرم‌افزار را دگرگون کرده است، اما محرک اصلی پذیرش گسترده آن‌ها تنها قدرت محاسباتی خام نیست، بلکه شفافیت حقوقی است. در میان چارچوب‌های مختلف لایسنس، لایسنس آپاچی ۲.۰ به عنوان استاندارد طلایی برای هوش مصنوعی متن‌باز آماده سازمانی ظاهر شده است...

فالکون 40B: چالشی که هوش مصنوعی سازمانی را بازتعریف می‌کند

در منظر سریعاً در حال تحول مدل‌های زبانی بزرگ (LLMs)، انتشار فالکون 40B توسط مؤسسه نوآوری فناوری (TII) لحظه‌ای محوری برای جامعه متن‌باز بود. برخلاف همتایان انحصاری آن، فالکون 40B جایگزینی قدرتمند و سازگار با تجاری ارائه می‌دهد که با عملکرد مدل‌های بزرگ‌تر و بسته‌منبع رقابت می‌کند...

تجزیه و تحلیل Llama: معماری، بهینه‌سازی و استقرار تولیدی مدل زبانی بزرگ متن‌باز متا

انتشار سری مدل‌های Llama متا نقطه عطفی در چشم‌انداز هوش مصنوعی بود. با متن‌باز کردن مدل‌های زبانی بزرگ با عملکرد بالا، متا دسترسی به قابلیت‌هایی را که پیش‌تر در اختیار آزمایشگاه‌های تحقیقاتی شرکت‌های ثروتمند بود، دموکراتیک کرد....

غبارروبی از میسترال: انقلاب مدل‌های زبانی بزرگ متن‌باز در هوش مصنوعی سازمانی

در چشم‌انداز به‌سرعت در حال تحول مدل‌های زبانی بزرگ (LLM)، سلطه غول‌های با منبع بسته مانند OpenAI اخیراً با رقابت جدی از سوی جامعه وزن‌باز مواجه شده است. در خط مقدم این تغییر، میسترال ای‌آی (Mistral AI) قرار دارد...