Nvidia-nın tezliklə təqdim edəcəyi inference çip sistemi Groq-un "dil işləmə vahidi" (LPU) texnologiyasını birləşdirir, ənənəvi GPU-lardan tamamilə fərqli bir arxitekturadan istifadə edir, daha geniş miqyaslı SRAM inteqrasiyası və 3D yığma texnologiyası ilə böyük modellərin inference prosesində gecikmə və yaddaş bant genişliyi məhdudiyyətlərini optimallaşdırmaq üçün xüsusi olaraq hazırlanıb.
Nvidia-nın tezliklə təqdim edəcəyi inference çip sistemi Groq-un "dil işləmə vahidi" (LPU) texnologiyasını birləşdirir, ənənəvi GPU-lardan tamamilə fərqli bir arxitekturadan istifadə edir, daha geniş miqyaslı SRAM inteqrasiyası və 3D yığma texnologiyası ilə böyük modellərin inference prosesində gecikmə və yaddaş bant genişliyi məhdudiyyətlərini optimallaşdırmaq üçün xüsusi olaraq hazırlanıb.
Orijinal göstərin
Bitget kriptovalyuta, səhm və qızıl üzrə vahid platformada ticarət imkanı təqdim edir. İndi ticarət edin!
Yeni istifadəçilər üçün 6,200 USDT dəyərində xoş gəlmisiniz paketi! İndi qeydiyyatdan keçin!
Bu yeni məhsulun növbəti nəsil Feynman arxitekturası əsasında hazırlanacağı ehtimal olunur ki, bu da AI agentlərinin işləmə enerji sərfiyyatını və xərclərini əhəmiyyətli dərəcədə azaldacaq. OpenAI 30 milyard dollar dəyərində satınalma və investisiya vədi verib. Nvidia gələn ay keçiriləcək GTC inkişaf etdiricilər konfransında Groq-un "dil işləmə vahidi" (LPU) texnologiyasını birləşdirən tamamilə yeni bir inference çipini təqdim etməyi planlaşdırır, bu isə Nvidia-nın inference hesablama sahəsinə sürətlə keçdiyini və müştərilərin yüksək performanslı, aşağı xərcli hesablama həllərinə olan təcili tələbatına cavab verdiyini göstərir. Wall Street Journal-ın məlumatına görə, Nvidia CEO-su Jensen Huang tərəfindən "dünya heç vaxt belə bir şey görməyib" kimi təsvir olunan bu yeni sistem, AI modellərinin sorğu-cavab sürətini artırmaq üçün xüsusi olaraq hazırlanıb. Məhsulun təqdimatı mövcud AI hesablama bazarının strukturunu yenidən formalaşdıracağı və daha səmərəli alternativlər axtaran bulud xidmətləri təminatçıları və korporativ investorlar üçün birbaşa təsir göstərəcəyi gözlənilir. Bu texnologiyanın bazar tərəfindən ilkin qəbulunun mühüm göstəricisi olaraq, ChatGPT-nin yaradıcısı OpenAI artıq bu yeni prosessorun ən böyük müştərilərindən biri olmağa razılaşıb və Nvidia-dan böyük miqdarda "xüsusi inference gücü" alacağını elan edib. Bu addım yalnız Nvidia-nın əsas müştəri bazasını möhkəmləndirmir, həm də bazara aydın siqnal göndərir: müstəqil AI agentlərini dəstəkləyən infrastruktur artıq genişmiqyaslı əvvəlcədən təlimdən səmərəli inference-ə keçir. Bəzi birja və çoxsaylı startaplarla sərt rəqabət şəraitində Nvidia ənənəvi qrafik prosessorlarına (GPU) olan tək asılılığını aşır. Yeni texnologiya arxitekturalarını tətbiq etməklə və yalnız mərkəzi prosessorlar (CPU) üzərində yerləşdirmə modellərini araşdırmaqla, şirkət AI sənayesinin növbəti inkişaf mərhələsində bazar liderliyini qorumağa çalışır. LPU dizaynının inteqrasiyası, böyük modellərin inference məhdudiyyətlərinə birbaşa təsir AI sənayesinin model təlimindən real tətbiq yerləşdirməsinə keçidi ilə inference hesablama əsas diqqətə çevrilib. AI inference əsasən iki mərhələyə bölünür: əvvəlcədən doldurma (pre-fill) və dekodlaşdırma (decode), burada böyük AI modellərinin dekodlaşdırma prosesi xüsusilə yavaşdır. Bu texniki məhdudiyyətə qarşı Nvidia fiziki limitləri xarici texnologiya inteqrasiyası ilə aşmağa qərar verib. Wall Street Journal-ın məlumatına görə, Nvidia ötən ilin sonunda startap Groq-un əsas texnologiya lisenziyasını 20 milyard dollara əldə edib və təsisçi Jonathan Ross daxil olmaqla rəhbər komandasını "əsas işə qəbul" müqaviləsi çərçivəsində cəlb edib. Groq-un hazırladığı "dil işləmə vahidi" (LPU) ənənəvi GPU-lardan tamamilə fərqli arxitekturaya malikdir və inference funksiyalarını yerinə yetirərkən son dərəcə yüksək səmərəlilik nümayiş etdirir. Sənaye analitikləri hesab edirlər ki, tezliklə təqdim olunacaq yeni məhsul inqilabi növbəti nəsil Feynman arxitekturasına əsaslana bilər. Wall Street Insights-un əvvəlki məqaləsinə görə, Feynman arxitekturası daha geniş SRAM inteqrasiyası tətbiq edə və hətta 3D yığma texnologiyası ilə LPU-nu dərin şəkildə birləşdirə bilər, əsasən gecikmə və yaddaş bant genişliyi kimi inference məhdudiyyətlərini optimallaşdırmaq üçün, nəticədə AI agentlərinin işləmə enerji sərfiyyatını və xərclərini əhəmiyyətli dərəcədə azaldır. Yalnız CPU yerləşdirməsini genişləndirmək, müxtəlif hesablama seçimləri təqdim etmək LPU arxitekturasının tətbiqi ilə yanaşı, Nvidia ənənəvi prosessorlarının istifadə üsulunu da çevik şəkildə tənzimləyir. Nvidia-nın əvvəlki standart yanaşması Vera CPU-nu güclü Rubin GPU ilə məlumat mərkəzi serverlərində birləşdirmək idi, lakin bəzi xüsusi AI agenti iş yükünü işləyərkən bu konfiqurasiya çox baha başa gəlir və enerji səmərəliliyi aşağıdır. Bəzi böyük korporativ müştərilər müəyyən AI tapşırıqlarını yalnız CPU mühitində işlədərkən daha səmərəli olduğunu aşkar ediblər. Bu tendensiyaya uyğun olaraq, Nvidia bu ay Meta Platforms ilə əməkdaşlığını genişləndirdiyini və Meta-nın reklam hədəfləmə AI agentini dəstəkləmək üçün ilk dəfə genişmiqyaslı yalnız CPU yerləşdirməsini həyata keçirdiyini elan edib. Bu əməkdaşlıq bazar tərəfindən Nvidia-nın strateji dəyişikliklərinin erkən göstəricisi kimi qiymətləndirilir və şirkətin yalnız GPU satış modelindən kənara çıxaraq müxtəlif hardware kombinasiyaları ilə AI bazarının fərqli seqmentlərini hədəfləməyə çalışdığını göstərir. Bazar tələbatı dəyişir, rəqabət davam edir Bu əsas hardware dizaynının təkamülü birbaşa texnologiya sənayesində AI agenti tətbiqlərinə olan tələbatın partlayışından qaynaqlanır. Bir çox AI agenti hazırlayan və işlədən şirkətlər ənənəvi GPU-ların çox baha olduğunu və real model işlədilməsində ən yaxşı seçim olmadığını aşkar ediblər. OpenAI-nin addımları bu tendensiyanı vurğulayır. Nvidia-nın yeni sistemini sürətlə böyüyən Codex alətini təkmilləşdirmək üçün almağa söz verməklə yanaşı, OpenAI ötən ay startap Cerebras ilə on milyardlarla dollar dəyərində hesablama əməkdaşlığı müqaviləsi bağlayıb. Cerebras CEO-su Andrew Feldman-ın sözlərinə görə, onların inference-ə yönəlmiş çipləri sürət baxımından Nvidia-nın GPU-larını üstələyir. Bundan əlavə, OpenAI birja Trainium çiplərindən istifadə üçün də böyük müqavilə imzalayıb. Yalnız startaplar deyil, əsas bulud xidmət təminatçıları da öz çiplərini inkişaf etdirməyə tələsirlər. Avtomatik kodlaşdırma bazarının lideri kimi tanınan Anthropic Claude Code hazırda əsasən birja və birjanın törəmə şirkətinin dizayn etdiyi çiplərdən istifadə edir, Nvidia məhsullarından deyil. Rəqiblərin təzyiqləri qarşısında Jensen Huang wccftech-ə müsahibəsində vurğulayıb ki, Nvidia artıq yalnız çip təchizatçısı deyil, yarımkeçiricilər, məlumat mərkəzləri, bulud və tətbiqləri əhatə edən tam AI ekosistemi qurucusuna çevrilir. İnvestorlar üçün gələn ay keçiriləcək GTC konfransı Nvidia-nın inference dövründə 90% bazar payı əfsanəsini davam etdirə biləcəyini yoxlamaq üçün əsas məqam olacaq.
0
0
İmtina: Bu məqalənin məzmunu yalnız müəllifin fikrini əks etdirir və platformanı heç bir şəkildə təmsil etmir. Bu məqalə investisiya qərarları qəbul etmək üçün istinad kimi nəzərdə tutulmayıb.
