Morgan Stanley: AI xotira tanqisligi bir necha yil davom etadi, uchta asosiy yo'l muammo yechimi, saqlash va gibrid hisoblash struktural imkoniyatlarga ega
Morgan Stanley tomonidan chiqarilgan yarim o'tkazgich sanoati bo'yicha tahlil hisobotida ta'kidlanishicha, DRAM xotira tanqisligi ushbu AI sanoati siklining butun davomida saqlanib qoladi, va AI hisoblash quvvatining kengayishi yangi plastina zavodlari qurilib, ishlab chiqarishga tushishini kutmaydi.
Zhihui Moliya APP xabariga ko'ra, Morgan Stanley yarimo'tkazgich sanoati bo'yicha hisobotida qayd etilishicha, DRAM xotira tanqisligi bu galgi AI sanoat bosqichi davomida ham saqlanib qoladi va AI hisoblash quvvatining kengayishi yangi chip zavodlari qurilib, ishlab chiqarila boshlashini kutmaydi. Sanoat apparat konfiguratsiyasini pasaytirish, reasoning arxitekturasini ajratish va CXL xotira havzasini tashkil etish kabi uch asosiy texnologiya yo‘li orqali xotira to‘sig‘ini aylanib o‘tmoqda va yetkazib berish cheklovlari ostida hisoblash infratuzilmasini rivojlantirishni davom ettirmoqda. Mazkur bank Micron (MU.US), SanDisk (SNDK.US) kabi xotira bozoridagi etakchilarga hamda CXL bog‘lanishi va geterogen reasoning yo‘nalishidagi qo‘shimcha imkoniyatlarga ijobiy qaraydi, Astera Labs (ALAB.US), Marvell (MRVL.US), Cerebras (CBRS.US) va Nvidia (NVDA.US) kabi kompaniyalarni tavsiya qiladi.
Morgan Stanley ta'kidlaydiki, hozirgi AI xotira tanqisligi qisqa muddatli muammo emas, balki hisoblash samaradorligi o‘sishi xotira ta’minoti tezligini ancha ortda qoldirayotgan strukturaviy muvozanatsizlikdir. Zamonaviy yirik modellar har 6 oyda ikki barobar qisqaradi, ilg‘or modellar kontekst oynalarining yillik o‘sishi 5-6 karra bo‘lib, reasoning uchun bir vaqtning o‘zida ishlashga ehtiyoj doimiy oshib bormoqda, xotira hajmi va o‘tkazish qobiliyatiga talab keskin oshmoqda. DRAM chip zavodlari qurilish muddati esa bir necha yil davom etadi, yetkazib berish imkoniyati juda past, tanqislik holati yana bir necha yil saqlanadi. Nvidia bosh direktori Jensen Huang ham sanoatga yondashuvni o‘zgartirish, arxitektura innovatsiyasi orqali xotira cheklovlariga javob berish, oddiygina ishlab chiqarish quvvatining oshishini kutmaslik zarurligini ochiq aytgan.
HBM va asosiy xotiraning taqchilligi yuzasidan sanoatdagi eng bevosita yechim - bitta qurilmaning xotira speklarini ixtiyoriy qisqartirish (De-speccing). Masalan, Nvidia Rubin arxitekturasi bo‘yicha, bitta rack LPDDR5 hajmi boshlang‘ich rejadagi 54TB dan 28TB ga tushirilgan, bitta GPU bilan ishlovchi HBM hajmi esa 288GB dan 192GB ga kamaytirildi va bu orqali umumiy chiqim soni kafolatlanmoqda. Morgan Stanley ta'kidlaydi, konfiguratsiyani qisqartirish xotira muammosini bartaraf etmaydi, faqatgina bosimni xotira sathlari o‘rtasida ko‘chiradi: yuqori tezlikdagi lokal xotirani qisqartirgandan so‘ng, KV cache kabi past chastotali ma’lumotlar NAND xotiraga “chuqurlashtiriladi”, shuningdek, GPUlararo ma’lumot almashinuvi oshadi va bu tarmoq bog‘lanish o‘tkazuvchanligiga bo‘lgan talabni oshiradi. Aslida, bu deyarli yuqori tezlikdagi tarmoq bog‘lanishi hamda arzonroq xotira resurslari yordamida yuqori o‘tkazuvchanlikka ega xotirani to‘ldirishdan iborat.
Ikkinchi yo‘l reasoning arxitekturasini ajratish (Disaggregation) hisoblanadi. AI reasoning ikki asosiy bosqichdan iborat: Prefill (oldindan to‘ldirish) va Decode (dekodlash), ular keskin farqlanadi: Prefill asosan hisoblash quvvatini talab qiladi, Decode esa kuchli darajada xotira o‘tkazuvchanligiga bog‘liq. An’anaviy arxitekturaga ko‘ra, bir xil tezlatkich ikkala vazifani ham bajaradi va bu resurslardan foydalanish samaradorligini pasaytiradi. Sanoat hozirda geterogen reasoningga tezlik bilan o‘tmoqda: ikkala bosqich har xil jihozlarda tashkil etiladi: hisoblashga mo‘ljallangan Prefill umumiy GPUda, xotira o‘tkazuvchanligiga muhtoj Decode esa katta hajmli chip ichidagi SRAMga ega maxsus tezlatkichda amalga oshiriladi.
Tipik misollar orasida Cerebras’ning chip-sathli dvigateli va Nvidia sotib olgan Groq LPU arxitekturasi mavjud bo‘lib, ular decoding bosqichida an’anaviy GPUlarga nisbatan ancha yuqori xotira o‘tkazuvchanligi samaradorligini ta’minlay oladi. Morgan Stanley fikricha, geterogen reasoning AI infratuzilmasining muhim evolyutsion yo‘nalishiga aylanadi va decodingda ixtisoslashgan hisoblash kompaniyalari aniq o‘sish bozorigina ega bo‘ladi.
Uchinchi yo‘l - CXL texnologiyasi yordamida xotira tizimini qayta qurish. CXL (Compute Express Link) – bu yuqori tezlikdagi bog‘lanish orqali xotirani kengaytirish, ulashish va havzalashtirish imkonini beradi, xotira faqat bitta protsessorga bog'lanib qolmaydi va xotira sig‘imining cheklovini yengishda asosiy texnologik yo‘lga aylanadi. Morgan Stanley hisob-kitobiga ko‘ra, AIga talab 2030 yilga kelib CXL va unga aloqador xotira yordamchi chip bozorining hajmi 6 milliard dollarga yetishiga olib keladi va bu an’anaviy CPU xotira kengaytmasi bozoridan ancha katta. Uning asosiy ahamiyati qatlamli xotira arxitekturasini qurishdir: eng yuqori tezlikdagi ma’lumotlar HBMda saqlanadi, undan keyingi ma’lumotlar CXL xotira havzasida, kam ishlatiladigan, sovuq ma’lumotlar esa NAND xotiraga tushiriladi va xarajatlar ma’lumot kirish chastotasiga moslashtiriladi.
Sarmoya yo‘nalishi nuqtai nazaridan Morgan Stanley quyidagi uch asosiy yo‘nalishni qayta tasdiqlaydi: Birinchisi, Micron va SanDisk ulushini oshirish, konfiguratsiyani qisqartirish yetkazib berish tanqisligi, emas, balki talabning pasayishidan emas, AI xotira talabining uzoq muddatda o‘sishi va yetkazib berishdagi farq ishlab chiqarish quvvatini so‘rib oladi; Ikkinchisi, CXL va scale-up bog‘lanish bozoridan Astera Labs va Marvellga sarmoya kiritish; Uchinchisi esa, geterogen reasoningdan foyda ko‘radigan Cerebras hamda Groq’ni sotib olish orqali geterogen yo‘nalishni to‘ldirayotgan Nvidia’ga e’tibor qaratish.
Risk ogohlantirishi: AI hisoblash talabi kutilganidan past bo‘lishi; CXL texnologiyasining joriy etilishi rejalashtirilganidan sekin bo‘lishi; xotira ishlab chiqarish quvvatining kutilganidan tez kengayishi.
Mas'uliyatni rad etish: Ushbu maqolaning mazmuni faqat muallifning fikrini aks ettiradi va platformani hech qanday sifatda ifodalamaydi. Ushbu maqola investitsiya qarorlarini qabul qilish uchun ma'lumotnoma sifatida xizmat qilish uchun mo'ljallanmagan.
Sizga ham yoqishi mumkin

Marvell (MRVL.US) sarmoyadorlar kuni “Uoll-stritdan yuqori” besh yillik rejasini e’lon qildi: Goldman Sachs esa bunga ishonmaydi va “Neytral” reytingini saqlab qoladi
Goldman Sachs ta'kidlashicha, aksiyalar narxiga aksariyat ijobiy kayfiyatlar allaqachon kiritilgan. Bank o‘zining maqsadli narxini 220 dollardan 270 dollarga oshirdi, reytingini esa “neytral” darajasida saqlab qoldi.
