☰
✕

NetApp Novus bidik infrastruktur AI, klaim tembus 100 TB per detik

JAKARTA (IndoTelko) - NetApp memperkenalkan NetApp Novus, arsitektur penyimpanan data generasi baru yang dirancang untuk mendukung infrastruktur kecerdasan buatan (AI) dengan skala GPU besar.

NetApp mengklaim Novus sebagai penyimpanan tercepat di dunia yang dirancang khusus untuk penyedia infrastruktur AI. Arsitektur tersebut ditujukan untuk menjaga suplai data ke GPU tetap konsisten, dengan kemampuan throughput agregat yang diproyeksikan melampaui 100 TB per detik.

Kebutuhan tersebut muncul seiring berkembangnya AI factory, termasuk yang dioperasikan oleh penyedia neocloud dan GPU-as-a-Service. Menurut NetApp, arsitektur penyimpanan tradisional dapat menjadi salah satu hambatan ketika jumlah GPU meningkat secara signifikan.

Dalam kondisi tertentu, pemanfaatan GPU bahkan dapat turun di bawah 30% ketika infrastruktur penyimpanan tidak mampu memasok data yang dibutuhkan secara memadai. Kondisi tersebut berpotensi meningkatkan biaya operasional karena kapasitas komputasi GPU yang mahal tidak dimanfaatkan secara optimal.

Chief Product Officer NetApp Syam Nair mengatakan, skala AI membutuhkan arsitektur penyimpanan yang dirancang khusus untuk memenuhi kebutuhan tersebut.

“AI factory kesulitan dan ekonomi GPU runtuh ketika data tidak mampu mengimbangi,” ujar Syam.

Novus menggunakan pendekatan arsitektur yang memisahkan metadata dari jalur data. Dengan desain tersebut, performa, kapasitas, dan konkurensi dapat ditingkatkan secara independen tetapi tetap berada dalam satu namespace menggunakan NFS standar industri.

Pada tahap awal, Novus menggabungkan NetApp Novus Data Director, perangkat lunak metadata yang berjalan pada infrastruktur Supermicro yang telah dikualifikasi, dengan layanan data NetApp ONTAP melalui sistem AFF A90.

Kombinasi tersebut membentuk arsitektur disaggregated yang menurut NetApp dirancang untuk melampaui throughput 100 TB per detik dan mendukung pemanfaatan tinggi pada ratusan ribu GPU.

Arsitektur ini juga dirancang untuk lingkungan AI berskala cloud dan multi-tenant. NetApp menyebut Novus telah dapat dipesan dan memiliki jalur menuju penerapan software-defined di masa mendatang, dengan tetap mempertahankan namespace, model operasional, dan fondasi data yang sama.

Dari sisi operasional, Novus ditujukan untuk mengurangi bottleneck penyimpanan sehingga GPU dapat terus memperoleh data berkecepatan tinggi. Sistem ini juga memungkinkan miliaran file dan dataset AI berukuran besar berkembang dalam satu namespace, tanpa harus membangun silo penyimpanan baru.

Pendekatan tersebut memungkinkan operator meningkatkan hanya sumber daya yang dibutuhkan untuk beban kerja tertentu. NetApp menilai model ini dapat membantu mengoptimalkan penggunaan daya, ruang, dan infrastruktur pendukung, sekaligus mempertahankan aspek keamanan, ketahanan, serta kebutuhan multi-tenancy.

Vice President & Principal Analyst Moor Insights & Strategy Mike Leone mengatakan, aspek ekonomi infrastruktur AI semakin bergantung pada kemampuan menjaga sumber daya komputasi tetap produktif ketika jumlah GPU terus meningkat.

Menurutnya, keterbatasan kemampuan storage dalam memasok data pada skala cloud dapat menjadi faktor pembatas bagi performa pelatihan AI maupun tingkat pengembalian investasi infrastruktur.

Sementara itu, Chief Analyst Omdia Tony Palmer mengatakan pengujian terhadap NetApp Novus menunjukkan skalabilitas performa yang mendekati linear ketika klaster ONTAP ditambahkan ke dalam satu global namespace.

Berdasarkan pengujian yang diamati Omdia, pemodelan mereka memproyeksikan arsitektur metadata dan data terdisagregasi Novus dapat mencapai throughput baca sekuensial hingga 100 TBps, dengan kapasitas efektif puluhan exabyte atau lebih.

Kolaborasi NetApp dengan Cisco juga diarahkan untuk mengintegrasikan aspek komputasi, jaringan, dan data dalam infrastruktur AI. Senior Vice President dan General Manager Cisco Compute Jeremy Foster menilai data dan cara memanfaatkannya menjadi faktor penting ketika infrastruktur AI memasuki skala yang semakin besar.

NetApp Novus saat ini ditawarkan untuk kebutuhan infrastruktur AI berskala besar, dengan pengembangan berikutnya diarahkan pada model software-defined dan skala penyimpanan yang lebih besar. (mas)