Lewati ke konten utama
Sidang Terbuka Promosi Doktor · Rabu, 23 September 2026 · Auditorium FK-KMK UGM H−40 Lihat Undangan →
kedokterangigi.ai
— Cerita · Scrolly-Telling

Ketika 5 dari 10 rujukan gigi meleset — bisakah AI menjadi pendamping keputusan?

Adaptasi naratif disertasi: masalah rujukan JKN, adu 11 model AI, uji RCT pada 62 dokter gigi, hingga suara para klinisi.

6 babak ±3 menit 8 Agustus 2026
Gulir untuk memulai
— BABAK 01 · MASALAH DI JANTUNG JKN

Semua berawal dari satu gerbang.

Dalam JKN, pasien tidak langsung ke rumah sakit. Mereka masuk lewat FKTP — puskesmas dan klinik — tempat dokter gigi berperan sebagai gate keeper: merawat tuntas, atau merujuk ke FKTL bila kasus di luar kompetensi layanan primer.

Namun gerbang itu sering salah membuka.

Dua studi menemukan hal yang konsisten: 52,2% rujukan gigi di DIY tidak tepat Hanung, 2018, dan ketepatan rujukan hingga klaim FKTL hanya 41,8% Hanindriyo dkk., 2016. Separuh lebih perjalanan pasien dimulai dari keputusan yang meleset.

Dan skalanya terus membesar.

Kunjungan prosedur gigi rawat jalan tingkat lanjutan naik dari 2,09 juta (2019) menjadi 3,17 juta (2021). Setiap rujukan yang tidak tepat berarti antrean yang memanjang, biaya yang membengkak, dan perawatan yang tertunda.

FKTP
Gerbang pertama — puskesmas & klinik; dokter gigi sebagai gate keeper.
▼ rujukan bila di luar kompetensi
FKTL
Rumah sakit rujukan — spesialis, kasus kompleks, biaya lebih tinggi.
SISTEM RUJUKAN BERJENJANG JKN · UU 40/2004
RUJUKAN GIGI TIDAK TEPAT
52,2–58,2%
dari total rujukan kesehatan gigi FKTP → FKTL yang diteliti
Hanindriyo dkk., 2016 · hal.4 Hanung, 2018 · hal.4
KUNJUNGAN PROSEDUR GIGI RJTL (JUTA)
2,09
2019
3,17
2021
+51,7% DALAM DUA TAHUN · BPJS KESEHATAN
— BABAK 02 · MENGAPA MELESET

Bukan karena dokternya tidak mampu.

Godaan pertama adalah menyalahkan kompetensi. Data tidak mendukung itu. Yang terjadi lebih dekat pada beban keputusan: keragaman kasus sangat luas, waktu konsultasi terbatas, dan kriteria rujukan tersebar di banyak dokumen.

Studi pendahuluan memperkuat dugaan itu.

Penelusuran pada 283 fasilitas kesehatan gigi primer di Daerah Istimewa Yogyakarta menunjukkan pola yang sama berulang: keputusan sulit diambil berkali-kali tanpa alat bantu yang hadir tepat waktu.

TIGA TEKANAN PADA SATU KEPUTUSAN
  1. Keragaman kasus lintas 14 departemen kedokteran gigi.
  2. Waktu konsultasi terbatas di layanan primer.
  3. Kriteria rujukan tersebar, tidak tersedia pada momen keputusan.
STUDI PENDAHULUAN
283
faskes gigi primer di DIY ditelusuri
Aghasy, 2026
— BABAK 03 · TAHAP 1 · SEBELAS MODEL DIADU

Sebelum dipakai, harus diuji dulu.

Sebelas Large Multimodal Model diuji terhadap 140 soal UKMP2DG yang mencakup 14 departemen — menghasilkan 1.540 observasi. Pertanyaannya sederhana: siapa yang paling dapat dipercaya membaca kasus gigi?

Claude memimpin, tetapi tak satu pun sempurna.

Akurasi total hanya 54,3%. Claude tertinggi dengan 71,4% (100 dari 140), disusul Grok 70,0%, GPT 67,9%, Gemini 66,4%, dan DeepSeek 63,6%.

Jurang antara model berbayar dan sumber terbuka.

Rata-rata model API 67,9% berbanding model sumber terbuka 43,0% — selisih 24,9 poin persentase yang signifikan (χ² = 95,2; p < 0,001; V = 0,249).

Yang tak terduga: cepat tidak berarti ceroboh.

Durasi median sangat beragam — Gemini 6 detik, Claude 33 detik, Grok 100 detik. Namun korelasi akurasi dengan durasi hanya ρ = 0,055. Tidak ada trade-off antara kecepatan dan ketepatan.

RANCANGAN BENCHMARK
1.540
11 model × 140 soal UKMP2DG × 14 departemen
Aghasy, 2026 · Tahap 1
AKURASI MODEL API (%)
71,40
Claude
70,00
Grok
67,90
GPT
66,40
Gemini
63,60
DeepSeek
AKURASI TOTAL 11 MODEL: 54,3%
MODEL API
67,9%
Claude · Grok · GPT · Gemini · DeepSeek
SUMBER TERBUKA
43,0%
Mistral · Medgemma · Gemma · Llama · Llava · Qwen
Δ 24,9 PP · χ²=95,2 · p<0,001 · V=0,249
KORELASI AKURASI ↔ DURASI
ρ = 0,055
praktis nol — model yang lambat tidak berpikir lebih baik
Aghasy, 2026 · Tahap 1
— BABAK 04 · TAHAP 2 · UJI COBA TERKENDALI

Dari laboratorium ke tangan dokter gigi.

Claude dipilih sebagai mesin CDSS, lalu diuji lewat rancangan acak terkendali pada 62 dokter gigi FKTP. Kelompok berbantuan CDSS dibandingkan dengan kelompok yang bekerja seperti biasa.

Lonjakan yang konsisten di semua ukuran.

Ketepatan diagnosis ICD-10 79,0% vs 49,4% (+29,6 pp). Ketepatan tindakan ICD-9-CM 87,4% vs 63,9% (+23,5 pp). Ketepatan keduanya sekaligus 68,4% vs 38,7% (+29,7 pp).

Tanpa memperlambat pekerjaan.

Durasi kerja kedua kelompok tidak berbeda bermakna (p = 0,163). Peningkatan ketepatan tidak dibayar dengan waktu konsultasi yang lebih panjang.

Paling menolong justru pada kasus yang jarang.

Selisih terbesar muncul pada erosi gigi: 96,8% vs 32,3%. Di sinilah nilai CDSS paling terasa — bukan pada kasus rutin, melainkan pada kasus yang jarang ditemui sehingga pola pengenalannya belum terbentuk.

RANCANGAN RCT
62
dokter gigi FKTP · acak terkendali
Aghasy, 2026 · Tahap 2
KETEPATAN: CDSS vs KONTROL (%)
79,0
49,4
ICD-10
87,4
63,9
ICD-9-CM
68,4
38,7
Keduanya
CDSS Kontrol
PILLAI'S TRACE 0,707 · F(3,58)=46,7 · p<0,001
DURASI KERJA
p = 0,163
tidak berbeda bermakna antara kedua kelompok
Aghasy, 2026 · hal.172–173
CDSS
96,8%
ketepatan pada kasus erosi gigi
KONTROL
32,3%
ketepatan pada kasus erosi gigi
SELISIH TERBESAR DI ANTARA SELURUH KASUS
— BABAK 05 · TAHAP 3 · SUARA KLINISI

Angka saja tidak cukup.

Sistem yang terbukti akurat belum tentu dipakai. Tahap ketiga menggali penerimaan lewat diskusi kelompok terfokus, memakai tujuh konstruk UTAUT2 berdampingan dengan enam prinsip etika AI WHO.

Keputusan tetap milik dokter.

Benang merah yang muncul berulang: CDSS diterima selama ia memindahkan titik awal berpikir, bukan mengambil alih keputusan. Transparansi kepada pasien dan kejelasan tanggung jawab menjadi syarat yang tidak dapat ditawar.

UTAUT2
7
konstruk kesediaan memakai
ETIKA WHO
6
prinsip kelayakan dipakai
KEDUANYA HARUS TERPENUHI
“CDSS memindahkan titik awal berpikir dari halaman kosong menjadi daftar kemungkinan yang sudah tersusun — tanggung jawab klinis tidak ikut berpindah.”
— Benang merah diskusi kelompok terfokus
— BABAK 06 · MAKNA BAGI PRAKTIK

Bukan mengganti dokter — menahan pintu agar tidak salah terbuka.

Tiga tahap penelitian menuju satu kesimpulan yang berhati-hati: Large Multimodal Model layak menjadi pendamping keputusan pada sistem rujukan kesehatan gigi, dengan syarat tata kelola yang jelas. Ketepatan meningkat hampir 30 poin persentase tanpa memperlambat pelayanan, dan manfaat terbesarnya justru pada kasus yang paling jarang ditemui.

+29,6
PP · KETEPATAN ICD-10
+23,5
PP · KETEPATAN ICD-9-CM
71,4%
AKURASI CLAUDE · TAHAP 1
— Sumber & Bacaan
Hanindriyo dkk., 2016 · hal.4 Hanung, 2018 · hal.4 BPJS Kesehatan, 2021 Aghasy, 2026 · Naskah disertasi 328 hal.
— Cookie

Situs ini memakai cookie yang sangat diperlukan agar halaman berfungsi — tidak untuk melacak Anda, dan tidak ada iklan. Yang meminta persetujuan Anda hanya konten pihak ketiga: peta Google pada halaman undangan. Selengkapnya.