PSPK – 07 April 2026 | Jakarta – Evaluasi performa kecerdasan buatan generatif (GenAI) kini memasuki fase baru berkat inisiatif yang dipimpin oleh AMD bersama konsorsium MLCommons. AMD menegaskan pergeseran penting dari sekadar mengukur kecepatan GPU menjadi penilaian kualitas layanan yang dirasakan oleh pengguna akhir melalui API.
Latar Belakang Benchmark AI
Selama ini, standar performa AI sering diukur dengan metrik throughput token pada GPU. Pendekatan ini kurang mencerminkan kondisi layanan AI yang dikelola, di mana kecepatan penyampaian token melalui antarmuka pemrograman aplikasi (API) menjadi faktor kritis bagi pengalaman pengguna.
Peran AMD dalam MLPerf Endpoints
AMD bergabung sebagai kolaborator awal dalam proyek MLPerf Endpoints, rangkaian benchmark inferensi AI yang dirancang untuk mensimulasikan beban kerja dunia nyata. Emad Barsoum, Corporate VP AMD, menekankan pentingnya standar terbuka dan transparansi dalam evaluasi, serta menyatakan bahwa AMD terlibat sejak fase definisi beban kerja, aturan, hingga infrastruktur evaluasi.
Keunggulan MLPerf Endpoints
- Arsitektur berbasis API memungkinkan pengukuran performa layanan yang sebenarnya diakses oleh aplikasi.
- Sistem pengiriman bergulir (rolling submission) mempercepat pembaruan benchmark seiring perkembangan model GenAI.
- Metodologi yang dapat direproduksi menggunakan framework AI open‑source, memudahkan verifikasi oleh komunitas.
Dampak bagi Industri
Dengan standar baru ini, penyedia layanan dan perusahaan yang mengadopsi GenAI dapat memperoleh gambaran yang lebih realistis tentang performa infrastruktur mereka. David Kanter, co‑founder MLCommons, memuji kontribusi AMD dalam menyatukan standar industri yang dapat dipercaya dan berbasis produksi nyata.
Rencana AMD ke Depan
AMD berkomitmen untuk terus mempublikasikan hasil kinerja GPU Instinct melalui kerangka kerja MLPerf Endpoints. Publikasi reguler diharapkan memberikan transparansi bagi pengguna akhir dan memperkuat posisi AMD sebagai pemimpin dalam ekosistem AI generatif.












