ML di perangkat (on-device ML) — menjalankan model machine learning langsung di perangkat seluler tanpa mengirim data ke server. Menurut laporan Google AI, 2025, lebih dari 70% pengguna lebih menyukai aplikasi dengan on-device ML karena privasi dan tidak adanya latensi jaringan. Core ML dari Apple, TensorFlow Lite dari Google, dan ML Kit memungkinkan penyelesaian tugas Vision, NLP, pengenalan wajah dan objek sepenuhnya di perangkat — tanpa internet dan dengan konsumsi daya minimal.
Poin Utama
ML di perangkat (on-device ML) adalah pendekatan di mana model machine learning dijalankan langsung di perangkat seluler tanpa mengirim data ke server jarak jauh. Privasi adalah keuntungan utama: data pengguna tidak pernah meninggalkan perangkat. Menurut penelitian Google (2024), 63% pengguna menolak fitur ML yang memerlukan pengiriman data ke server. On-device ML menghilangkan latensi jaringan, bekerja offline, dan mengurangi konsumsi daya melalui akselerasi perangkat keras.
On-device ML memproses data dalam milidetik, bukan detik — sangat penting untuk pengenalan wajah dan objek secara real-time. Tidak perlu koneksi internet adalah keunggulan lain: fitur ML tersedia dalam mode pesawat dan di wilayah dengan konektivitas tidak stabil. Core ML menggunakan Neural Engine di chip Apple A12+, memberikan 11 triliun operasi per detik dengan konsumsi daya di bawah 1 W. Untuk aplikasi seluler, on-device ML telah menjadi standar de facto dalam tugas Vision, NLP, dan pengenalan objek.
ML dalam aplikasi seluler digunakan untuk otentikasi wajah (Face ID), filter AR di Snapchat dan Instagram, pelacak kebugaran dengan Pose Detection, pemindaian OCR di Adobe Scan, dan input prediktif di keyboard. Model kustom untuk tugas spesifik dibuat melalui Core ML (iOS) atau TensorFlow Lite (Android). ML Kit cocok untuk skenario tipikal — pengenalan teks, wajah, dan kode batang tanpa perlu melatih model.
Core ML adalah framework Apple untuk menjalankan model ML di iPhone, iPad, Mac, dan Apple Watch. Secara otomatis memilih akselerasi perangkat keras optimal: Neural Engine untuk jaringan saraf pada perangkat dengan A12+ (11 TOPS), GPU untuk tugas pemrosesan gambar, dan CPU untuk komputasi sekuensial. Core ML mendukung format .mlmodel (asli) dan .mlmodelc (dikompilasi). Konversi model dari PyTorch dan TensorFlow dilakukan melalui coremltools — pustaka Python yang mempertahankan topologi dan bobot.
Create ML adalah aplikasi Apple untuk melatih model sederhana tanpa menulis kode. Untuk produksi, gunakan coremltools — alat konversi dari PyTorch, TensorFlow, dan scikit-learn. Coremltools mendukung kuantisasi float32 → float16 dan int8, paletisasi ruang warna, dan penghapusan operasi redundan untuk mengurangi ukuran model.
import coremltools as ct
model = ct.convert(
"resnet50.mlmodel",
source="pytorch",
convert_to="mlprogram"
)
model.save("Resnet50.mlpackage")
Neural Engine adalah prosesor saraf khusus di chip Apple A12 dan yang lebih baru. 16 inti melakukan hingga 11 triliun operasi per detik dengan konsumsi daya di bawah 1 W. Core ML secara otomatis mengarahkan komputasi jaringan saraf ke Neural Engine dan komputasi yang kompatibel dengan GPU ke Metal GPU. Pengembang tidak perlu memilih perangkat — Core ML melakukannya melalui Performance Report, menganalisis model dan perangkat keras yang tersedia.
TensorFlow Lite (TFLite) adalah solusi lintas platform Google untuk menjalankan model ML di Android, iOS, dan Linux. Model berformat .tflite dan dibuat melalui TFLiteConverter dari ekosistem TensorFlow. TFLite mendukung kuantisasi float32 → int8, yang mengurangi ukuran model 4 kali lipat dengan tetap mempertahankan akurasi 97–99% pada tugas klasifikasi. Google Play Services for TFLite secara otomatis memperbarui runtime tanpa perlu merilis ulang aplikasi.
TFLiteConverter adalah alat utama untuk mengonversi model TensorFlow ke format .tflite. Kuantisasi int8 pasca-pelatihan mengompres model dari 300 MB menjadi 75 MB tanpa akses ke seluruh dataset. Pelatihan sadar kuantisasi (QAT) memberikan kehilangan akurasi minimal — kurang dari 1% pada ImageNet. TFLiteConverter juga mendukung pemangkasan graf dan penghapusan operasi yang tidak didukung oleh runtime TFLite.
import tensorflow as tf
converter = tf.lite.TFLiteConverter.from_saved_model(
"saved_model_dir"
)
converter.optimizations = [tf.lite.Optimize.DEFAULT]
tflite_model = converter.convert()
Tanpa delegasi, TFLite menjalankan model di CPU 3–5 kali lebih lambat dibandingkan dengan akselerasi perangkat keras. Delegasi GPU menggunakan OpenCL dan OpenGL ES 3.1 di Android, Delegasi Core ML menggunakan Neural Engine di iOS. Delegasi NNAPI memanfaatkan NPU dan DSP di Android 8.1+. Delegasi XNNPACK memberikan akselerasi lintas platform di CPU ARM dengan optimalisasi untuk prosesor seluler. Untuk memilih delegasi, gunakan TfLiteGpuDelegate.create() dengan pemeriksaan null pada hasil.
ML Kit adalah SDK dari Google dengan API siap pakai untuk on-device ML. Dalam aplikasi seluler, ML Kit digunakan untuk pengenalan teks (50+ bahasa, termasuk tulisan tangan), Deteksi Wajah (468 titik kunci wajah), Pemindaian Kode Batang (QR, EAN-13, Code 128, PDF417, Data Matrix), dan Deteksi Objek. Semua API berfungsi sepenuhnya di perangkat tanpa internet. ML Kit tersedia di iOS dan Android dengan API terpadu.
Deteksi Wajah mengembalikan koordinat kontur wajah, alis, mata, hidung, dan bibir, serta sudut kemiringan kepala dan status mata. Topeng AR dan filter kamera adalah skenario penggunaan paling populer. Pengenalan Teks mengekstrak teks dari foto dengan akurasi hingga 99% pada karakter cetak. API mendukung pengenalan real-time melalui CameraX.
val recognizer = TextRecognition.getClient()
val image = InputImage.fromBitmap(bitmap)
recognizer.process(image)
.addOnSuccessListener { result ->
result.textBlocks.forEach { block ->
println(block.text)
}
}
Pemindaian Kode Batang mengenali kode batang dalam aliran video kamera secara real-time. Deteksi Objek mengidentifikasi objek dalam gambar dengan kotak pembatas dan label kelas (orang, mobil, hewan). Deteksi Pose menentukan 33 titik kunci tubuh untuk aplikasi kebugaran dan analisis gerakan. Pelabelan Gambar mengembalikan hingga 10 label semantik gambar — "alam", "kota", "makanan".
Apple menyediakan solusi ML bawaan melalui Vision dan NaturalLanguage tanpa menginstal SDK pihak ketiga. Vision (VNRequest) melakukan deteksi wajah, teks, kode batang, dan kontur di perangkat. NaturalLanguage (NLTokenizer) menyediakan tokenisasi, lematisasi, identifikasi bahasa, dan analisis sentimen. Di Android, padanan diimplementasikan melalui ML Kit (pengenalan) dan SpeechRecognizer dari android.speech (ucapan). Alat bawaan tidak memerlukan unduhan model — sudah terinstal sebelumnya di sistem.
Vision mencakup VNDetectFaceRectanglesRequest (deteksi wajah), VNRecognizeTextRequest (pengenalan teks), VNDetectBarcodesRequest (kode batang), dan VNDetectHumanBodyPoseRequest (kerangka). VNCoreMLRequest mengintegrasikan model Core ML kustom ke dalam pipeline Vision — misalnya, klasifikasi emosi pada wajah yang terdeteksi. Semua permintaan dijalankan di Neural Engine dengan latensi minimal.
let request = VNRecognizeTextRequest { request, error in
guard let observations = request.results
as? [VNRecognizedTextObservation] else { return }
for observation in observations {
let topCandidate = observation
.topCandidates(1).first
print(topCandidate?.string as? String ?? "")
}
}
let handler = VNImageRequestHandler(
cgImage: image, options: [:]
)
try? handler.perform([request])
NaturalLanguage menyediakan NLTokenizer untuk memisahkan teks menjadi token, NLLanguageRecognizer untuk identifikasi bahasa (72 bahasa), dan NLSentimentAnalyzer untuk analisis sentimen teks. SFSpeechRecognizer adalah API pengenalan ucapan yang mendukung 50+ bahasa di perangkat (iOS 13+). Memerlukan izin SFSpeechRecognizerAuthorizationStatus sebelum digunakan. Hasil datang secara asinkron melalui SFSpeechRecognitionResultHandler.
Pertanyaan Umum
ML di perangkat (on-device ML) adalah pendekatan di mana model machine learning dijalankan langsung di perangkat seluler tanpa mengirim data ke server. Core ML, TensorFlow Lite, dan ML Kit adalah framework utama untuk on-device ML.
Core ML adalah framework Apple untuk iOS dan macOS dengan akselerasi di Neural Engine. TensorFlow Lite adalah solusi lintas platform Google untuk Android, iOS, dan Linux. Core ML menawarkan kinerja lebih baik di perangkat Apple, TFLite menawarkan keserbagunaan.
ML Kit menyelesaikan tugas visi komputer dan NLP yang tipikal: pengenalan teks, wajah, kode batang, objek, dan postur tubuh. Semua API berfungsi di perangkat tanpa internet dan tidak memerlukan pembuatan model sendiri.
Tidak, on-device ML bekerja sepenuhnya secara lokal. Model dimuat ke perangkat dan dijalankan tanpa koneksi internet. ML Kit juga menawarkan versi API berbasis cloud dengan akurasi lebih tinggi, tetapi mode on-device tersedia offline.
Untuk khusus iOS, pilih Core ML — menggunakan Neural Engine dan terintegrasi erat dengan ekosistem Apple. Untuk proyek lintas platform, pilih TensorFlow Lite. Untuk tugas tipikal tanpa model kustom, pilih ML Kit dengan API siap pakai.
Ringkasan
Kami akan mengembangkan aplikasi seluler turnkey
IT Sectr membuat aplikasi iOS dan Android untuk startup dan bisnis sejak 2017. Kami akan memberi saran dan mengusulkan solusi terbaik.