Корейська економічна газета: коли AI CPU поглинає DRAM — дефіцит пам’яті триватиме ще рік!
Галузь пам’яті встановила рекордні результати, підштовхувана зростанням цін на товарний DRAM більш ніж на 100%; за прогнозами дефіцит триватиме ще рік, оскільки центральні процесори (CPU), спеціально розроблені для AI, вже введені в експлуатацію.

Нещодавно випущений “AI CPU” від Intel, за очікуваннями, матиме до чотирьох разів більше товарного DRAM, ніж попереднє покоління. У поєднанні з зростаючим попитом на висококапацитний DRAM для графічних процесорів (GPU), спостерігачі очікують, що виробничі можливості Samsung Electronics і SK Hynix не зможуть задовольнити вимоги ринку.За інформацією індустріальних джерел на 2-й день,виробники CPU намагаються інтегрувати 300–400GB DRAM в AI CPU. Це у чотири рази більше, ніж типові CPU-продукти (96–256GB), що викликає здивування.CPU займає важливе місце як “координатор AI”Різке зростання попиту на висококапацитний DRAM для AI CPU безпосередньо пов’язане з переходом AI-індустрії до структур, орієнтованих на інференцію. Минулого у AI інференція зводилася до простих питань та відповідей, нині вона стала “координатором” для різних агентних AI.Ключовим елементом цього процесу є “контекстна пам’ять”. Для координації всього робочого процесу CPU має пам’ятати зміст, беручи до уваги вихідні дані кожного агентного AI. Це робить розширення пам’яті — тобто простору для зберігання — надважливим.До цього часу AI дата-центри створювали обчислювальні інфраструктури навколо GPU з високою пропускною пам’яттю (HBM). Використовуючи переваги GPU у паралельній обробці масивних даних під час тренування AI, основна увага завжди приділялася “тренуванню AI”. Конфігурація серверів слідувала схемі 8 GPU до 1 CPU. Однак з переходом до інференції, сервери з суттєво більшою кількістю CPU почали швидко поширюватися.На нещодавній конференції щодо фінансових результатів керівники Intel пояснили: “У інфраструктурі AI інференції, обчислювальна структура змістилася до співвідношення CPU до GPU 1:4, і ця тенденція рухається все ближче до 1:1.”Після GPU, CPU також включено у битву за пам’ять — попит стрімко зростаєКонкуренція за об’єм пам’яті розширилася з GPU до CPU, і масштаби стрімко зростають. Наступне покоління AI-чіпів NVIDIA “Vera Rubin” оснащене 8 стеками HBM і має 288GB пам’яті, а наступне покоління GPU MI400 від AMD має ще більшу місткість — 432GB.Google нещодавно презентував свою кастомізовану мікросхему — восьме поколінняTensor Processing Unit (TPU 8i), яка теж планується бути оснащеною 288GB HBM. Додаючи до цього AI CPU “Xeon” від Intel та “EPYC” від AMD, які почали використовувати до 400GB висококапацитної DDR5, дефіцит пам’яті, ймовірно, триватиме довше.Це підтверджується цінами на спотовому ринку. За даними Kiwoom Securities, хоч ціни на старі DDR4 (16GB) впали на 16% у квітні за місяць, спотова ціна DDR5 (16GB), що використовується для AI CPU, за той же період зросла на 2,8%, зберігаючи свою премію.Один з галузевих джерел зазначає:“Зараз ринок DRAM вважається на 10 процентних пунктів коротшим від попиту. Понад HBM, попит на товарний DRAM стрімко зростає, і суперцикл може бути продовжено з очікуваного раніше 2026 року до 2027 року.”
Відмова від відповідальності: зміст цієї статті відображає виключно думку автора і не представляє платформу в будь-якій якості. Ця стаття не повинна бути орієнтиром під час прийняття інвестиційних рішень.
Вас також може зацікавити
Міністерство фінансів США збирається використати майже трильйон доларів з казначейського рахунку? Бессент наголошує на повторному викупі облігацій 9 вересня
9 вересня є датою набуття чинності плану розширення зворотного викупу довгострокових облігацій, оголошеного Міністерством фінансів США минулого тижня. Минулого тижня Бесент повідомив, що обсяг одного зворотного викупу може перевищити 4 мільярди доларів.
Nvidia оголосила про повний запуск у виробництво Groq 3 LPX, ефективність міркувань Vera Rubin зросла у кілька разів, SpaceXAI посилює інвестиції в агентів та космічний AI
Nvidia заявила, що на основі робочого навантаження AgentX від SemiAnalysis та моделі DeepSeek V4 Pro продуктивність Vera Rubin на мегават у 30 разів вища за попереднє покоління GB300 NVL72, а вартість на один токен знижена у 35 разів. SpaceXAI використає Vera CPU для прискорення наступного покоління додатків штучного інтелекту-агентів, а також розширить платформу на основі Vera Rubin. SpaceXAI планує розмістити оптимізовану версію Vera Rubin NVL72 у космосі для першого покоління супутників Starmind AI.
Телефонна конференція Pinduoduo: Подальше посилення ланцюга постачання, розвиток власного бренду просувається повільніше, ніж очікувалося, але мета "створити ще один Pinduoduo за три роки" залишається незмінною
Керівництво на телефонній конференції чітко зазначило, що стратегічний акцент зміщується на глибоку трансформацію ланцюга постачання, а спеціальна ініціатива "Екосистема на сто мільярдів" розширюється до сільськогосподарських регіонів, промислових кластерів і логістичної інфраструктури. Хоча розвиток власного бренду просувається повільніше, ніж очікувалося, він все ще є ключовою стратегією "три роки на перебудову PDD", зосереджуючись на спільних довгострокових дослідженнях з виробниками у категоріях, де платформа має перевагу. Глобальний бізнес, зіштовхнувшись з новою тарифною політикою ЄС, перемикається на місцевих продавців та виконання замовлень зі складів задля підвищення стійкості. Компанія наголошує на прихильності до довгострокової стратегії та не женеться за короткостроковим зростанням.
Зниження дохідності держоблігацій США може мати зворотний ефект? Citadel попереджає Міністерство фінансів США, що "фінансові обмеження" можуть послабити долар і підштовхнути інфляцію
Міністерство фінансів США нещодавно знизило довгострокові витрати на фінансування за рахунок розширення масштабів зворотного викупу довгострокових державних облігацій, але цей крок викликає попередження з боку Уолл-стріт щодо потенційних побічних ефектів.

