AI/ML Engineer — Jakarta

Membangun sistem machine learning yang benar-benar jalan di produksi.

Saya Raka Mahendra, engineer yang fokus pada LLM fine-tuning, computer vision, dan infrastruktur MLOps. 6 tahun mengubah notebook eksperimen menjadi layanan dengan latensi rendah dan biaya terkendali.

PyTorchLLM Fine-tuningComputer VisionMLOpsRAG Systems
train_run.py — gpu-cluster-01
01[epoch 12/20] loss=0.184 val_acc= 94.2%
02[eval] F1 macro naik dari baseline +11.6 pts
03[deploy] latency p95 via Triton 38 ms
04[status] model dipromosikan ke production
GPU util
87%
VRAM
72%
Throughput
93%
23
Model di production
40+ jt
Inferensi per bulan
-62%
Biaya serving setelah optimasi
6 th
Pengalaman ML engineering
Karya Terpilih

Proyek yang mengukur dirinya sendiri.

Setiap proyek saya lengkapi dengan metrik nyata — akurasi, latensi, dan dampak biaya — bukan sekadar demo.

Catatan Riset

Yang sedang saya pelajari dan tulis.

Eksperimen, benchmark, dan catatan teknis dari pekerjaan sehari-hari — dibagikan supaya orang lain tidak jatuh di lubang yang sama.

Benchmark

Quantization 4-bit: seberapa besar penurunan kualitas di bahasa Indonesia?

Membandingkan GPTQ, AWQ, dan bitsandbytes pada tugas NLU berbahasa Indonesia. Hasilnya: penurunan jauh lebih kecil dari yang ditakutkan.

Juni 2026
Eksperimen

Distilasi model vision untuk perangkat edge kelas 5 watt

Catatan proses mengecilkan model deteksi 6x lipat tanpa kehilangan recall kritis, termasuk trik augmentasi yang paling berpengaruh.

April 2026
Tulisan

Evaluasi LLM tanpa menyewa 100 annotator

Framework evaluasi semi-otomatis dengan LLM-as-judge yang dikalibrasi sampel manusia — dipakai di tiga proyek klien.

Februari 2026
Stack

Peralatan kerja harian.

Tool yang saya pakai dari eksperimen sampai serving — dipilih karena terbukti, bukan karena tren.

Modeling

PyTorchHugging FaceLoRA / PEFTYOLOscikit-learn

Serving

TritonvLLMONNX RuntimeFastAPIgRPC

Data & Infra

AirflowSparkPostgreSQLQdrantS3 / MinIO

MLOps

MLflowWeights & BiasesDockerKubernetesGitHub Actions
Kontak

Punya masalah ML yang butuh diselesaikan?

Saya terbuka untuk proyek konsultasi, kontrak jangka pendek, dan diskusi teknis. Ceritakan masalah Anda — saya balas dalam 1–2 hari kerja.

raka@mahendra.ai