پشت پرده هوش مصنوعی | قسمت 37: اگر یک Expert بیشتر از ظرفیتش توکن دریافت کند چه اتفاقی میافتد؟
در قسمتهای قبل از مجموعه «پشت پرده هوش…
ارسال شده توسط معصومه معینی
142 بازدید
پشت پرده هوش مصنوعی | قسمت 36: چطور مدل Expertها را متعادل نگه میدارد؟
در قسمت قبل از مجموعه «پشت پرده هوش…
ارسال شده توسط معصومه معینی
168 بازدید
پشت پرده هوش مصنوعی | قسمت 35: Load Imbalance در مدل MoE چیست؟
در قسمت قبل از مجموعه «پشت پرده هوش…
ارسال شده توسط معصومه معینی
166 بازدید
پشت پرده هوش مصنوعی | قسمت 34: روتر در مدل MoE چیست؟
در مدلهای زبانی بزرگ، همیشه لازم نیست تمام…
ارسال شده توسط معصومه معینی
153 بازدید
پشت پرده هوش مصنوعی | قسمت 33: معماری Mixture of Experts چیست؟
در مدلهای زبانی بزرگ، تعداد پارامترها میتواند بسیار…
ارسال شده توسط معصومه معینی
162 بازدید
پشت پرده هوش مصنوعی | قسمت 32: Knowledge Distillation چیست؟
در قسمت قبل از مجموعه «پشت پرده هوش…
ارسال شده توسط معصومه معینی
194 بازدید
پشت پرده هوش مصنوعی | قسمت 31: آیا Quantization کیفیت مدل را کاهش میدهد؟
در قسمت قبل با Quantization در هوش مصنوعی…
ارسال شده توسط معصومه معینی
169 بازدید
پشت پرده هوش مصنوعی | قسمت 30: Quantization در هوش مصنوعی چیست و چگونه مدلها را سبکتر میکند؟
وقتی درباره مدلهای بزرگ هوش مصنوعی صحبت میکنیم،…
ارسال شده توسط معصومه معینی
194 بازدید
پشت پرده هوش مصنوعی | قسمت 29: چرا Context Window بزرگ حافظه بیشتری مصرف میکند؟
در قسمت قبل با KV Cache آشنا شدیم…
ارسال شده توسط معصومه معینی
207 بازدید