― Advertisement ―

उच्च-उचाई UAV ले गुरुत्वाकर्षण-सहायता डाइभ फाइनलको साथ संसारको सबैभन्दा छिटो चरा जस्तै काम गर्दछ

युक्रेनले युक्रेनलाई धम्की दिएको छ। आत्मघाती गोताखोर आक्रमण100 भन्दा बढी रिपोर्ट गरिएको हत्याले Tsyklop लाई युक्रेनको व्यस्त अवरोधकहरू बीचमा राख्योगुरुत्वाकर्षण उच्च-गति हवाई अवरोधको समयमा...
Homeसूचना प्रविधिAI SSD ले HBM, DDR, र NAND को प्रयोग गरेर पहिलो टोकन...

AI SSD ले HBM, DDR, र NAND को प्रयोग गरेर पहिलो टोकन विलम्बता 50X द्वारा घटाउने वाचा गर्दछ – आठ Nvidia RTX 5090 लाई भर्चुअल 46-कार्ड बेहेमथमा परिणत गर्दछ।



  • पारंपरिक GenStor GenStor मेमोरी SSDs प्रयोग गर्ने HBM सीमितताहरू
  • PT200Z SSD ले इन्फरेन्स वर्कलोडको कुशलतापूर्वक माग गर्दा निरन्तर क्यास अद्यावधिकहरूलाई समर्थन गर्दछ
  • आठ RTX 5090 GPU ले नाटकीय रूपमा ठूलो प्रभावकारी अनुमान मेमोरी क्षमता प्राप्त गर्दछ

GenStorAIGE ले आफ्नो acceler AI200206 को प्लेटफर्ममा acceler लाई प्रस्तुत गरेको छ। प्रभावकारी AI मेमोरी क्षमता विस्तार गर्न भण्डारण-केन्द्रित दृष्टिकोण।

GPU उच्च ब्यान्डविथ मेमोरी, प्लेटफर्मले PCIe Gen5 solid-state ड्राइभहरू सिधै मेमोरी hierarchy मा समावेश गर्दछ। id=”elk-seasonal”/>

Sh2p> को वरिपरि निर्मित तीन-स्तरीय मेमोरी आर्किटेक्चर id=”elk-378c20ca-8560-11f1-ae52-0719b5a297e2″>AI90 ले HBM, प्रणाली DRAM, र को लागि अनन्य मेमोरी संरचना अनुमान कार्यभारहरू ह्यान्डल गर्दै।

केभी क्यास डाटालाई SSDs मा पारदर्शी रूपमा अफलोड गरेर, प्लेटफर्मले महत्त्वपूर्ण रूपमा ठूला वर्कलोडहरू र लामो सन्दर्भ विन्डोहरूलाई समर्थन गर्दा GPU मेमोरीमा दबाब कम गर्छ। data-nosnippet=”” class=”clear-both pt-2 pb-0 mb-4″>

तपाईलाई मन पर्न सक्छ

GenStorAIGE को अनुसार, यो आर्किटेक्चरले समर्थित कन्फिगरेसनहरूमा धेरै सेकेन्डबाट सब-सेकेन्ड प्रतिक्रिया समयहरूमा पहिलो-टोकन विलम्बता घटाउँछ।

यसले 50x सुधारको प्रतिनिधित्व गर्दछ, साथै थ्रुपुट लाभहरू 5.1x सम्म पुग्छ र लगभग 39% GPU> मेमोरीमा 39%। id=”slice-container-newsletterForm-articleInbodyContent-kSLqjMFd3EqcNafandzbtB” class=”slice-container newsletter-inbodyContent-slice newsletterForm-articleInbodyContent-kSLqjMFd3EqcNafandzmFd3EqcNafandzmfd_newsterb> data-hydrate=”true” class=”newsletter-form__wrapper newsletter-form__wrapper–inbodyContent”>

बुद्धिमान पियर-टू-पीयर GPU कम्युनिकेसनको संयोजनमा, कम्पनीले AI90 ले आठ चलिरहेको प्रणालीहरूमा 5.8x सम्मको अनुमानलाई गति दिन सक्छ NvidiaF0 RT कार्डहरू।

त्यो गुणकले प्रभावकारी रूपमा आठ-कार्ड सेटअपलाई निरन्तर इन्फरेन्स कार्यहरूमा 46-GPU क्लस्टरको नजिक व्यवहार गर्न अनुमति दिन्छ।

वास्तुकलाले 128,000 टोकनहरू भन्दा धेरै कन्टेक्स्ट विन्डोहरूलाई पनि समर्थन गर्दछ, धेरै ठूला कागजातहरू प्रशोधन र मेमोरी बिना नै उपलब्ध कुराकानी



अब के पढ्ने

> प्रणाली

निरन्तर KV क्यास अद्यावधिकहरूद्वारा उत्पन्न हुने निरन्तर लेखन कार्यभारहरूलाई समर्थन गर्न, GenStorAIGE ले AI90 लाई आफ्नो नयाँ PT200Z मार्फत जोडेको छ। PCIe Gen5 x4 इन्टरफेस, ड्राइभले 14.8 GB/s पुग्ने क्रमिक पढ्ने गति प्रदान गर्दछ।

अनियमित पढ्ने कार्यसम्पादनले लगभग 3.1 मिलियन IOPS लाई हिट गर्छ, जबकि पढ्ने लेटन्सी केवल 54 माइक्रोसेकेन्डमा बस्छ।

लेख्नुहोस् विलम्बता बढ्दै जान्छ र र्यापिड 14.8 जीबी/सेकेन्डमा माइक्रोसेकेन्डको माइक्रोसेकेन्डको समर्थन गर्दछ। वास्तुकला निरन्तर निर्भर गर्दछ।

सहनशीलता मूल्याङ्कन प्रति दिन १०० ड्राइभ राइट सम्म पुग्छ, निरन्तर क्यास डाटा परिवर्तनको साथ दिगो उद्यम एआई वर्कलोडहरूको लागि उपयुक्त आंकडा।

यो डिजाइनले AI पूर्वाधारमा व्यापक परिवर्तनलाई प्रतिबिम्बित गर्दछ

मेमोरी tieringa-link-line, href=”https://www.techradar.com/computing/artificial-intelligence/best-llms” data-url=”https://www.techradar.com/computing/artificial-intelligence/best-llms” data-hl-processed=”none” data-mrf-recirculation=”inline-link” data-before-rewrite-localise=”https://www.techradar.com/computing/artificial-intelligence/best-llms”>LLMs एक्लै GPU HBM को व्यावहारिक सीमाहरू बढ्दै गएको छ।

अत्यन्तै छिटो SSD भण्डारणलाई इन्फरेन्स पाइपलाइनहरूमा एकीकृत गर्नाले GPUM को अतिरिक्त लम्बाइको GPUM को लम्बाइ बिना नै एउटा विधि प्रदान गर्दछ। कन्फिगरेसनहरू।

कार्यसम्पादन दाबीहरूले यस चरणमा बाहिर नियन्त्रित परीक्षण सर्तहरू राख्छन् कि छैनन् भन्ने यथार्थ रूपमा अप्रमाणित रहन्छ।

धेरै विक्रेता घोषणाहरू जस्तै, यी कार्यसम्पादन तथ्याङ्कहरू सीधै GenStorAIGE बाट आउँछन् र अझै पनि विभिन्न वास्तविक-विश्व AI कार्यभारहरूमा स्वतन्त्र बेन्चमार्किङ चाहिन्छ। href=”https://www.guru3d.com/story/genstoraige-ai90-reduces-first-token-latency-by-up-to-50x/” target=”_blank” rel=”nofollow” data-url=”https://www.guru3d.com/story/genstoraige-ai90-reduces-x-latency-first” referrerpolicy=”no-referrer-when-downgrade” data-hl-processed=”none” data-mrf-recirculation=”inline-link”>The Guru of 3D




थप पढ्नुहोस्