GPU — apa itu, struktur dan prinsip kerja

Penulis: IT Sectr Diterbitkan: 2026-06-10 Waktu membaca: 9 mnt

GPU (Graphics Processing Unit) — adalah prosesor khusus untuk pemrosesan paralel data grafis, yang melakukan jutaan perhitungan pada piksel dan verteks per frame. Berbeda dengan CPU yang dioptimalkan untuk tugas sekuensial dengan latensi rendah, GPU berisi ribuan inti berdaya rendah untuk operasi matematika massal. Menurut NVIDIA Developer Blog (2025), GPU mobile modern berisi hingga 1024 inti dan mencapai kinerja 2 TFLOPS dalam beban komputasi. Pengembang mengintegrasikan GPU untuk rendering, pasca-pemrosesan, dan pembelajaran mesin pada perangkat.

Poin Utama

  • GPU — prosesor khusus dengan ribuan inti untuk pemrosesan paralel grafis dan komputasi.
  • Arsitektur GPU didasarkan pada pipeline SIMD: satu instruksi dijalankan pada banyak data secara bersamaan.
  • GPU di perangkat mobile terintegrasi dalam SoC dan berbagi memori dengan CPU melalui arsitektur Unified Memory.
  • GPU Computing (GPGPU) menggunakan prosesor grafis untuk tugas non-grafis: ML, kriptografi, pemrosesan sinyal.
  • API akses GPU di platform mobile: Vulkan, Metal, OpenGL ES dan WebGL untuk browser.

Apa itu GPU?

GPU (Graphics Processing Unit) — adalah mikrochip khusus yang dirancang untuk paralelisme massal. GPU pertama muncul pada akhir 1990-an sebagai akselerator grafis 3D untuk PC desktop. Sejak itu, arsitektur telah berevolusi dari pipeline tetap menjadi shader yang dapat diprogram dan blok komputasi universal.

Tujuan utama GPU — rasterisasi: mengubah data geometris (verteks, segitiga) menjadi piksel di layar. Prosesnya meliputi transformasi verteks, pemotongan permukaan tak terlihat, tekstur, dan pencampuran warna. Semua operasi ini dijalankan secara paralel untuk ribuan elemen secara bersamaan.

Menurut Jon Peddie Research (2025), pasar GPU mobile mencapai 58% dari total volume prosesor grafis, melampaui solusi diskrit untuk PC dan server. Setiap ponsel pintar mengandung setidaknya satu GPU yang terintegrasi dalam System-on-Chip (SoC) bersama dengan CPU, DSP, dan neuroprosesor.

GPU modern dibagi menjadi dua jenis: terintegrasi (tertanam dalam SoC, berbagi memori dengan CPU) dan diskrit (kartu terpisah dengan memori video sendiri). Dalam pengembangan mobile, hanya GPU terintegrasi yang digunakan — Qualcomm Adreno, ARM Mali, Apple GPU dan Imagination PowerVR.

Sejarah perkembangan GPU

Evolusi GPU melewati tiga tahap: pipeline tetap (1999–2006), shader terpadu (2006–2016) dan inti komputasi yang dapat diprogram (2016 — sekarang). Tahap pertama mendefinisikan urutan operasi yang kaku — transformasi, pencahayaan, tekstur. Pengembang tidak dapat mengintervensi pipeline.

Dengan munculnya shader terpadu, GPU mendapatkan kemampuan untuk menjalankan program arbitrer — shader yang ditulis dalam HLSL atau GLSL. Ini membuka jalan menuju GPGPU — penggunaan GPU untuk tugas non-grafis. Tahap ketiga menambahkan inti tensor untuk pembelajaran mesin dan ray tracing real-time.

Dalam GPU mobile, tonggak penting adalah pengenalan Tile-Based Deferred Rendering (TBDR) — arsitektur di mana frame dibagi menjadi tile (16x16 piksel) dan diproses dalam memori lokal cepat. Ini mengurangi konsumsi daya 3–5 kali dibandingkan dengan immediate mode rendering yang khas untuk GPU desktop.

Arsitektur GPU

Arsitektur GPU berbeda secara radikal dari CPU. Alih-alih beberapa inti kuat dengan cache besar, GPU berisi ratusan atau ribuan blok komputasi sederhana yang dioptimalkan untuk SIMD (Single Instruction, Multiple Data) — satu instruksi dijalankan pada banyak elemen data.

Blok dasar GPU — Shader Core (dalam terminologi NVIDIA) atau Execution Unit (Intel). Beberapa blok tersebut digabungkan dalam Compute Unit (AMD) atau Streaming Multiprocessor (NVIDIA). Setiap blok mencakup ALU untuk aritmetika, file register, dan penjadwal warp (grup thread).

GPU mobile berbeda secara arsitektural dari GPU desktop. Qualcomm Adreno menggunakan arsitektur dengan prosesor shader yang dapat diprogram dan blok rasterisasi khusus. ARM Mali didasarkan pada Bifrost atau Valhall — arsitektur dengan pemrosesan warp kuartet. Apple GPU sejak 2017 memiliki desain sendiri dengan dukungan Metal dan memori terpadu.

ProdusenLini GPUArsitekturAPI
QualcommAdreno 6xx/7xx/8xxProsesor shader yang dapat diprogramVulkan, OpenGL ES
ARMSeri Mali-GBifrost / ValhallVulkan, OpenGL ES
AppleApple GPU (A13–A18)Desain sendiriMetal
ImaginationPowerVR IMGFurian / B-SeriesVulkan, OpenGL ES

Fitur utama GPU mobile — Unified Memory Architecture (UMA). GPU dan CPU menggunakan RAM bersama tanpa memori video terpisah. Ini mengurangi latensi dalam pertukaran data dan menyederhanakan pemrograman, tetapi membatasi bandwidth dalam komputasi intensif.

GPU vs CPU: perbedaan utama

CPU dirancang untuk tugas sekuensial dengan latensi minimal. Berisi 4–12 inti kuat dengan cache L1/L2/L3 besar, prediktor cabang, dan eksekusi spekulatif. GPU sebaliknya mengorbankan latensi demi bandwidth — ribuan inti memproses data dengan latensi tinggi tetapi kinerja kumulatif yang sangat besar.

Perbedaan terlihat dalam FLOPS (operasi floating point per detik). SoC mobile terbaik 2025: CPU — 200 GFLOPS, GPU — 2400 GFLOPS. GPU melampaui CPU 12 kali dalam tugas yang memungkinkan paralelisme. Namun untuk algoritma sekuensial, CPU tetap lebih cepat karena overhead manajemen thread yang lebih rendah.

Dalam praktiknya, pengembang menggunakan CPU untuk logika aplikasi, UI dan IO, serta GPU untuk rendering, pemrosesan gambar, simulasi fisika, dan inferensi jaringan saraf. Menurut Google Android Performance Patterns (2025), beban GPU optimal dalam aplikasi mobile adalah 60–80% — kelebihan beban menyebabkan throttling dan panas berlebih.

cpp
// CPU — pemrosesan sekuensial
for (int i = 0; i < N; i++) {
    result[i] = data[i] * 2.0f;
}

// GPU — pemrosesan paralel (GLSL compute shader)
#version 300 es
layout(local_size_x = 256) in;
void main() {
    uint idx = gl_GlobalInvocationID.x;
    result[idx] = data[idx] * 2.0f;
}

Kode pada CPU melakukan perkalian secara sekuensial untuk setiap elemen. Versi GPU menjalankan 256 thread secara paralel, masing-masing mengalikan elemennya sendiri. Dengan N=1 juta, GPU akan menyelesaikan tugas 100–1000 kali lebih cepat daripada CPU pada satu inti.

GPU di perangkat mobile

GPU mobile bekerja dalam batasan ketat pembuangan panas dan konsumsi daya. TDP tipikal GPU mobile adalah 2–8 W, dibandingkan 150–450 W pada GPU desktop. Ini memerlukan arsitektur khusus dengan fokus pada efisiensi energi, bukan kinerja puncak.

Teknologi penghematan energi utama — Tile-Based Rendering. Frame dibagi menjadi tile 16x16 atau 32x32 piksel. Setiap tile diproses sepenuhnya dalam memori SRAM cepat (Tile Memory), kemudian ditulis ke DRAM eksternal. Ini mengurangi akses memori 4–10 kali dibandingkan dengan immediate mode.

Qualcomm Adreno — GPU mobile paling umum. Adreno 750 (Snapdragon 8 Gen 3) berisi 12 prosesor shader dengan kumpulan register bersama. Mendukung Vulkan 1.3, OpenGL ES 3.2, OpenCL 3.0 dan ray tracing di tingkat inti. Menurut Qualcomm (2025), Adreno memberikan peningkatan kinerja 45% per generasi sambil mempertahankan konsumsi daya.

ARM Mali — GPU paling populer kedua di perangkat Android. Mali-G720 didasarkan pada arsitektur Valhall generasi ke-5 dengan dukungan Variable Rate Shading dan ASTC HDR. Keunikan Mali adalah pemrosesan kuartet: empat thread digabungkan menjadi satu warp untuk pemanfaatan ALU yang lebih baik.

Apple GPU dirancang khusus untuk Metal API. Mulai dari A13 Bionic, Apple menggunakan desain GPU sendiri dengan dukungan Metal 3, ray tracing, dan mesh shader. Arsitektur Apple GPU menonjol dengan Unified Memory dan bandwidth hingga 800 GB/s pada M4 Ultra.

Konsumsi daya dan throttling

Throttling GPU — penurunan frekuensi saat terlalu panas — masalah utama game mobile. Di bawah beban berkepanjangan, suhu SoC mencapai 85–95°C, dan GPU menurunkan frekuensi 30–50%. Menurut AnandTech (2025), Qualcomm Adreno 750 kehilangan hingga 35% kinerja setelah 15 menit di Genshin Impact.

Pengembang dapat mengurangi throttling melalui optimasi draw-call, penurunan resolusi rendering, dan penggunaan Foveated Rendering. Metal Performance Shaders di iOS dan Android Frame Pacing API di Android membantu menyinkronkan beban dengan anggaran termal perangkat.

GPGPU: komputasi pada GPU

GPGPU (General-Purpose computing on GPU) — penggunaan prosesor grafis untuk komputasi non-grafis. Ide ini lahir pada pertengahan 2000-an, ketika pengembang menyadari bahwa shader dapat diadaptasi untuk operasi matriks, kriptografi, dan simulasi fisika.

Saat ini, GPGPU adalah alat standar untuk tugas yang memerlukan paralelisme massal: pembelajaran mesin (pelatihan dan inferensi jaringan saraf), kriptografi (hashing, enkripsi), pemrosesan gambar dan video (filter, codec), simulasi ilmiah (hidrodinamika, kimia kuantum).

Di perangkat mobile, GPGPU diterapkan melalui Compute Shaders — shader tanpa keluaran grafis yang hanya bekerja dengan data. Compute Shader menjalankan Grid dari grup kerja, setiap grup berisi beberapa thread. Akses memori — melalui buffer dan tekstur tanpa terikat ke layar.

glsl
#version 310 es
layout(local_size_x = 16, local_size_y = 16) in;
layout(binding = 0) buffer Input  { float data[]; };
layout(binding = 1) buffer Output { float result[]; };

void main() {
    uvec2 idx = gl_GlobalInvocationID.xy;
    uint offset = idx.y * gl_NumWorkGroups.x * gl_WorkGroupSize.x + idx.x;
    result[offset] = sqrt(data[offset]) + 1.0;
}

Contoh compute shader menghitung akar kuadrat untuk setiap elemen array. Grup kerja 16x16 memproses 256 elemen secara bersamaan. GPU mobile modern mendukung hingga 1024 grup kerja dan jutaan thread global.

API untuk bekerja dengan GPU

API akses GPU menentukan bagaimana pengembang mengirim perintah dan data ke prosesor grafis. Di platform mobile, tiga API utama digunakan: Vulkan, Metal, dan OpenGL ES. Masing-masing memiliki kelebihan dan keterbatasan yang mempengaruhi kinerja dan kompatibilitas.

Vulkan

Vulkan — API lintas platform tingkat rendah dari Khronos Group, penerus OpenGL. Vulkan memberikan pengembang kontrol langsung atas memori GPU, antrian perintah, dan sinkronisasi. Menurut Khronos (2025), Vulkan memberikan peningkatan kinerja 30–60% dibandingkan OpenGL ES karena pengurangan overhead driver.

Di Android, Vulkan wajib sejak Android 7.0 (API 24), tetapi semua SoC modern mendukung Vulkan 1.3. Vulkan Memory Allocator dan SPIR-V sebagai kode perantara memungkinkan penulisan shader dalam GLSL, HLSL, atau Rust GPU.

Metal

Metal — API kepemilikan Apple untuk GPU di semua perangkat ekosistem: iPhone, iPad, Mac, Apple TV. Metal memastikan overhead minimal dan waktu eksekusi perintah yang dapat diprediksi. Menurut Apple Developer Documentation (2025), Metal memproses hingga 100.000 draw-call per frame tanpa penurunan FPS.

Fitur utama — Metal Shading Language (MSL) berbasis C++. Shader dikompilasi ke kode mesin bersama dengan aplikasi, menghilangkan kompilasi JIT yang khas untuk Vulkan. Metal mendukung Mesh Shaders, Ray Tracing, dan Dynamic Libraries untuk memuat shader saat runtime.

OpenGL ES

OpenGL ES — versi sederhana OpenGL untuk sistem tertanam. Digunakan pada perangkat lama dan untuk kompatibilitas mundur. OpenGL ES 3.2 didukung pada 94% perangkat Android menurut Android Studio (2025). Untuk proyek baru, Google merekomendasikan Vulkan daripada OpenGL ES.

WebGL — analog browser dari OpenGL ES, dasar grafis 3D di web. WebGL 2.0 (setara dengan OpenGL ES 3.0) didukung pada 92% browser mobile. WebGPU — generasi berikutnya, dengan arsitektur yang dekat dengan Vulkan dan Metal.

Pertanyaan yang Sering Diajukan

Apa perbedaan GPU mobile dengan GPU desktop?

GPU mobile bekerja dalam paket termal 2–8 W, menggunakan Tile-Based Rendering untuk penghematan energi dan berbagi memori dengan CPU melalui UMA. GPU desktop mengonsumsi 150–450 W, memiliki memori video terpisah (GDDR) dan menggunakan Immediate Mode Rendering.

GPU mobile mana yang paling bertenaga di tahun 2026?

Apple GPU dalam chip M4 Ultra dan A18 Pro — pemimpin kinerja per watt di antara GPU mobile. Di perangkat Android, Qualcomm Adreno 850 di Snapdragon 8 Gen 4 dan ARM Mali-G925 di MediaTek Dimensity 9500 memimpin.

Bisakah GPU digunakan untuk pembelajaran mesin di perangkat mobile?

Ya, GPU secara aktif digunakan untuk inferensi jaringan saraf melalui Core ML di iOS dan TensorFlow Lite / NNAPI di Android. Menurut Google (2025), akselerasi GPU memberikan peningkatan kecepatan 3–10 kali dibandingkan CPU.

Mengapa GPU panas dan mengalami throttling di game mobile?

Throttling terjadi karena melampaui anggaran termal. Di bawah beban berkepanjangan, suhu SoC mencapai 85–95°C, dan GPU menurunkan frekuensi untuk melindungi chip. Solusinya — optimasi rendering dan penggunaan batas FPS (30–45 FPS).

API mana yang harus dipilih untuk grafis GPU di Android?

Vulkan — pilihan utama untuk proyek baru. OpenGL ES — untuk kompatibilitas mundur dengan perangkat lama. Metal — wajib untuk iOS. Untuk pengembangan lintas platform, gunakan framework seperti Unity, Unreal Engine, atau Filament.

Kesimpulan

  • GPU — prosesor khusus dengan ribuan inti untuk pemrosesan paralel data dan akselerasi grafis.
  • Arsitektur GPU menggunakan pipeline SIMD, Tile-Based Rendering dan Unified Memory untuk SoC mobile.
  • GPU vs CPU: GPU melampaui CPU 10–12 kali dalam FLOPS pada tugas dengan paralelisme massal, tetapi kalah dalam algoritma sekuensial.
  • GPU mobile dari Qualcomm, ARM, Apple dan Imagination bekerja dalam batas ketat 2–8 W dan rentan terhadap throttling.
  • GPGPU melalui Compute Shaders diterapkan untuk ML, kriptografi, pemrosesan gambar, dan simulasi ilmiah.
  • Vulkan dan Metal — API utama untuk aplikasi mobile modern, menyediakan kontrol tingkat rendah atas GPU.
  • Optimasi GPU mencakup manajemen draw-call, batas FPS, dan penggunaan Foveated Rendering untuk mengurangi pembuangan panas.

Kami akan mengembangkan aplikasi seluler turnkey

IT Sectr membuat aplikasi iOS dan Android untuk startup dan bisnis sejak 2017. Kami akan memberi saran dan mengusulkan solusi terbaik.

Diskusikan proyek

Baca juga