پشت پرده هوش مصنوعی | قسمت 34: روتر در مدل MoE چیست؟
در مدلهای زبانی بزرگ، همیشه لازم نیست تمام…
ارسال شده توسط معصومه معینی
326 بازدید
پشت پرده هوش مصنوعی | قسمت 33: معماری Mixture of Experts چیست؟
در مدلهای زبانی بزرگ، تعداد پارامترها میتواند بسیار…
ارسال شده توسط معصومه معینی
353 بازدید
پشت پرده هوش مصنوعی | قسمت 32: Knowledge Distillation چیست؟
در قسمت قبل از مجموعه «پشت پرده هوش…
ارسال شده توسط معصومه معینی
409 بازدید
پشت پرده هوش مصنوعی | قسمت 31: آیا Quantization کیفیت مدل را کاهش میدهد؟
در قسمت قبل با Quantization در هوش مصنوعی…
ارسال شده توسط معصومه معینی
363 بازدید
پشت پرده هوش مصنوعی | قسمت 30: Quantization در هوش مصنوعی چیست و چگونه مدلها را سبکتر میکند؟
وقتی درباره مدلهای بزرگ هوش مصنوعی صحبت میکنیم،…
ارسال شده توسط معصومه معینی
395 بازدید
پشت پرده هوش مصنوعی | قسمت 29: چرا Context Window بزرگ حافظه بیشتری مصرف میکند؟
در قسمت قبل با KV Cache آشنا شدیم…
ارسال شده توسط معصومه معینی
408 بازدید
پشت پرده هوش مصنوعی | قسمت 28: KV Cache چیست و چرا مدلهای زبانی را سریعتر میکند؟
وقتی یک مدل زبانی مانند ChatGPT در حال…
ارسال شده توسط معصومه معینی
417 بازدید
پشت پرده هوش مصنوعی | قسمت 27: اطلاعات قبلی مدل هوش مصنوعی کجا نگه داشته میشوند؟
وقتی یک مدل زبانی مانند ChatGPT شروع به…
ارسال شده توسط معصومه معینی
398 بازدید
پشت پرده هوش مصنوعی | قسمت 26: چرا بعضی مدلها سریعتر پاسخ میدهند؟
وقتی از دو مدل هوش مصنوعی یک سؤال…
ارسال شده توسط معصومه معینی
409 بازدید