Nvidia yeni çip hazırlayır

Nvidia yeni çip hazırlayır

Nvidia süni intellekt modellərinin cavab yaratma mərhələsini, yəni “inference” prosesini sürətləndirmək üçün ixtisaslaşmış yeni prosessor üzərində işləyir. Məlumata görə sistem əsas müştərilərdən biri olan OpenAI üçün nəzərdə tutulur və təqdimatı gələn ay San-Xosedə keçiriləcək Nvidia GTC konfransında planlaşdırılır.

Yeni platforma inference sahəsində ixtisaslaşmış startap Groq tərəfindən dizayn edilmiş çipi inteqrasiya edir. Bu addım OpenAI-nin mürəkkəb tapşırıqlar, məsələn, proqram kodlaşdırması və Sİ-dən Sİ-yə ünsiyyət zamanı mövcud Nvidia avadanlıqlarının sürəti ilə bağlı narazılıqlarından sonra atılır. Bildirilir ki, inference üçün optimallaşdırılmış bu sistem OpenAI-nin gələcək ehtiyaclarının təxminən 10%-ni qarşılaya bilər. Real vaxt rejimində Sİ xidmətlərinə tələbat artdıqca inference hesablama gücü əsas “boğaz nöqtəsi”nə çevrilib.

Nvidia xəbəri rəsmi təsdiqləməsə də, bu təşəbbüs şirkətin daha geniş strategiyasına uyğundur. Məsələn, təqdim edilən Vera Rubin arxitekturası əvvəlki Blackwell platforması ilə müqayisədə vatt başına 10 dəfə daha yüksək performans vəd edir və iri miqyaslı Sİ klasterləri üçün nəzərdə tutulub.

Rəqabət mühiti də sürətlə dəyişir. OpenAI daha aşağı gecikmə əldə etmək üçün Groq və Cerebras kimi alternativləri test edib. Bu isə inference gücü üçün ayrıca, xüsusi həllərin müzakirəsini gücləndirib. Artıq inference xərcləri təlim xərcləri ilə rəqabət aparacaq səviyyəyə çatır.

Bazarda AMD, Broadcom və Google-un TPU həlləri kimi rəqiblər pay qazanmağa başlayıb. Xüsusilə enerji məhdudiyyətləri fonunda böyük bulud provayderləri daha səmərəli həllər axtarırlar.

San-Xosedə GTC konfransında təqdimat Nvidia-nın bazardakı dominant mövqeyini qorumaq niyyətini nümayiş etdirir. Şirkətin “Blackwell Ultra” və “Rubin” yol xəritəsi agent tipli Sİ və daha mürəkkəb məntiq modellərinə fokuslanaraq növbəti mərhələyə keçidi hədəfləyir.