پشت پرده هوش مصنوعی | قسمت ۴۶: Speculative Decoding چیست؟
وقتی یک مدل زبانی بزرگ قرار است پاسخی…
ارسال شده توسط معصومه معینی
21 بازدید
پشت پرده هوش مصنوعی | قسمت ۴۵: چطور یک مدل بزرگ روی چند GPU اجرا میشود؟
مدلهای هوش مصنوعی امروزی میتوانند بسیار بزرگ باشند.…
ارسال شده توسط معصومه معینی
39 بازدید
پشت پرده هوش مصنوعی | قسمت ۴۴: چرا GPU همیشه کافی نیست؟
وقتی درباره اجرای مدلهای هوش مصنوعی صحبت میکنیم،…
ارسال شده توسط معصومه معینی
65 بازدید
پشت پرده هوش مصنوعی | قسمت ۴۳: Batching در هوش مصنوعی چیست؟
وقتی تعداد زیادی کاربر بهصورت همزمان از یک…
ارسال شده توسط معصومه معینی
75 بازدید
پشت پرده هوش مصنوعی | قسمت ۴۲: تفاوت مدل Dense و MoE چیست؟
تا اینجا در مجموعه «پشت پرده هوش مصنوعی»…
ارسال شده توسط معصومه معینی
77 بازدید
پشت پرده هوش مصنوعی | قسمت ۴۱: Router در مدل MoE چگونه یاد میگیرد؟
در قسمت قبل از مجموعه «پشت پرده هوش…
ارسال شده توسط معصومه معینی
108 بازدید
پشت پرده هوش مصنوعی | قسمت ۴۰: ترکیب خروجی Expert در مدل MoE چگونه است؟
در قسمت قبل از مجموعه «پشت پرده هوش…
ارسال شده توسط معصومه معینی
116 بازدید
پشت پرده هوش مصنوعی | قسمت ۳۹: Top-k Routing در مدلهای MoE چیست؟
در قسمت قبل از مجموعه «پشت پرده هوش…
ارسال شده توسط معصومه معینی
117 بازدید
پشت پرده هوش مصنوعی | قسمت ۳۸: Token Dropping در مدلهای MoE چیست؟
در قسمت قبل از مجموعه «پشت پرده هوش…
ارسال شده توسط معصومه معینی
137 بازدید