AMD telah memperkenalkan Instinct MI350P, AI accelerator PCIe baharu yang disasarkan untuk server enterprise — dan benda paling besar di sini simple je: ini kad PCIe Instinct pertama AMD dalam kira-kira empat tahun.
Daripada paksa syarikat masuk ke sistem rack-scale baharu yang mahal, MI350P direka sebagai kad dual-slot, drop-in untuk server standard dengan air cooling. Untuk bisnes di Malaysia dan SEA yang cuba jalankan lebih banyak AI workload secara lokal — macam chatbots, internal copilots, recommendation systems, analytics, atau private inference — benda ni memang penting. Bukan semua syarikat ada bajet atau infra untuk terus lompat masuk ke AI cluster gergasi.
MI350P berasaskan seni bina GPU AMD CDNA 4 dan menggunakan proses 3nm TSMC untuk compute dies-nya. Ia hadir dalam konfigurasi 4 XCD, yang basically separuh daripada apa yang AMD guna pada MI350X yang lebih high-end. Ada juga satu I/O die yang dibina menggunakan proses 6nm TSMC.
Atas kertas, kad ini membawa 128 compute units, 8,192 stream processors, 512 matrix cores, dan peak clock 2,200MHz. AMD kata cip ini mengandungi 73 bilion transistor. Untuk memori, ia hadir dengan 144GB HBM3E pada bus 4096-bit, memberikan bandwidth sehingga 4TB/s. Ada juga 128MB Infinity Cache.
Dari segi performance, AMD memang push kad ini kuat untuk format AI enterprise. MI350P menyokong MXFP6 dan MXFP4 lower-precision, termasuk sparsity acceleration untuk format 8-bit dan 16-bit yang biasa digunakan. AMD mendakwa sekitar 2,299 TFLOPS, naik sehingga 4,600 peak TFLOPS pada MXFP4. Itu nombor yang memang ditujukan untuk inference workload serius, bukan gaming PC atau creator rig biasa.
Power draw masih sangat server-class. MI350P mempunyai rating total board power 600W, menggunakan connector 16-pin, dan dilaporkan boleh dikonfigurasi turun ke 450W. Kad ini sepanjang 10.5 inci, atau 267mm, dan menggunakan passive cooling, jadi ini memang untuk airflow server yang betul — bukan build desktop tempered-glass biasa kau, bro.
Bahagian paling menarik untuk bisnes SEA ialah form factor PCIe. Banyak syarikat serantau nak capability AI, tapi membina infra high-density baharu memang sakit dan mahal. PCIe accelerator yang boleh slot masuk ke server compatible sedia ada memberi team IT upgrade path yang lebih praktikal. Untuk firma Malaysia yang sudah menjalankan data room on-prem, ini mungkin lebih realistik daripada terus membeli sistem AI proprietary besar dari hari pertama.
AMD meletakkan MI350P sebagai pesaing kepada NVIDIA H200 NVL, yang juga PCIe accelerator dan hadir dengan 141GB HBM3E. Wccftech menyatakan kad H200 NVL berharga sekitar US$30,000 hingga US$40,000, iaitu lebih kurang RM140,000 hingga RM190,000 sebelum tax, shipping, support, dan markup enterprise tempatan. Jadi ya, semua ini memang langsung bukan duit level consumer.
AMD kata MI350P kini tersedia melalui pelbagai partner. Ia juga menyokong platform ROCm AMD dan AI software stack yang enterprise-ready, sesuatu yang penting sebab hardware sahaja tak cukup dalam deployment AI. Ecosystem, developer tools, dan sokongan software jangka panjang akan menentukan sama ada syarikat betul-betul adopt benda ini atau tidak.
Untuk gamers, ini takkan boost FPS kau secara langsung. Tapi untuk scene tech yang lebih luas, benda ini penting sebab AI infrastructure semakin jadi sebahagian daripada semua benda — cloud gaming services, content tools, customer support, esports analytics, game testing, malah moderation systems. Kalau AMD boleh buat AI acceleration lebih mudah deploy dalam server biasa, lebih banyak syarikat serantau mungkin dapat akses kepada AI compute serius tanpa perlu bajet level hyperscaler.
Source: Wccftech Gaming