source avatarqinbafrank

I-share

Kung batay sa pinakabagong ulat ng SemiAnalysis, bumaba na ang HBM ng Rubin Ultra sa 192GB, ang 192GB ay mas limitado kaysa sa 288GB sa mga scenario na sensitibo sa memorya tulad ng Agentic inference, mahabang context, at MoE large models, na nangangahulugan na ang tunay na epektibong performance nito sa ilang sitwasyon ay magkakapareho o kahit mas mababa kaysa sa standard version ng Vera Rubin. Hindi mas maganda ang performance ng upgraded Ultra Rubin kaysa sa standard version ng Vera Rubin—posible na kailangan ng mas maraming GPU upang maisagawa ang iisang modelo, na magdudulot ng dagdag na overhead sa inter-GPU communication, model partitioning, at data movement, na babawasan ang epektibong utilization ng bawat GPU at magpapataas sa cost per token. Sa madaling salita, bagaman tumataas ang产量 ng GPU, kung kailangan ng mas maraming GPU bawat task, hindi naman kasabay na bumababa ang system-level cost ng computing power. Ang logika ng upgraded version ay hindi makatwiran. Kaya ba’t hindi na kailangang ipagpatuloy ang Ultra version? Magpatuloy lang tayo sa pagbebenta ng Vera Rubin version hanggang kalagitnaan ng 2027, at hintayin na lang ang susunod na henerasyon noong 2028—ang Feynman architecture. 🤔

Disclaimer: Ang information sa page na ito ay maaaring nakuha mula sa mga third party at hindi necessary na nagre-reflect sa mga pananaw o opinyon ng KuCoin. Ibinigay ang content na ito para sa mga pangkalahatang informational purpose lang, nang walang anumang representation o warranty ng anumang uri, at hindi rin ito dapat ipakahulugan bilang financial o investment advice. Hindi mananagot ang KuCoin para sa anumang error o omission, o para sa anumang outcome na magreresulta mula sa paggamit ng information na ito. Maaaring maging risky ang mga investment sa mga digital asset. Pakisuri nang maigi ang mga risk ng isang produkto at ang risk tolerance mo batay sa iyong sariling kalagayang pinansyal. Para sa higit pang information, mag-refer sa aming Terms ng Paggamit at Disclosure ng Risk.