لایه شبکه هوش مصنوعی: مقایسه TCP، UDP و RDMA برای بارهای کاری استنتاج و آموزش مدلهای زبانی بزرگ
با مقیاسپذیری مدلهای زبانی بزرگ (LLM) به صدها میلیارد پارامتر، گلوگاه از محاسبات به ارتباطات منتقل میشود. در زیرساخت هوش مصنوعی، تأخیر شبکه و پهنای باند دیگر فقط معیارها نیستند؛ بلکه عوامل تعیینکننده زمان آموزش و زمان استنتاج هستند.