
Postingan XDA yang muncul di banyak halaman utama membuat poin yang telah diam-diam diuji oleh banyak pengguna Obsidian: ponsel Android modern dengan RAM 8 atau 12 GB dapat menjalankan model dengan 3 miliar parameter pada kecepatan yang dapat dibaca, sepenuhnya offline, dan ketika dipasangkan dengan Obsidian, itu mengubah vault menjadi sesuatu antara buku harian dan otak kedua yang dapat dicari. Tidak ada perjalanan cloud, tidak ada tagihan per-token, tidak ada sinyal yang diperlukan di pesawat atau kereta bawah tanah.
Kami menguji 7 aplikasi Android yang membuat pasangan ini bekerja dalam praktik. Setiap aplikasi di bawah menjalankan model di perangkat, mencolok ke vault Obsidian yang disimpan di ponsel, dan tetap berguna tanpa koneksi jaringan.
Apa yang harus dicari
- Inferensi di perangkat. Jika aplikasi memanggil API, itu bukan alat yang kami uji.
- Model yang masuk akal. Q4-quantised 3B atau 7B adalah sweet spot; apa pun yang lebih besar mengenai swap dan mati.
- Akses vault. Akses langsung ke sistem file vault Obsidian lebih baik daripada copy-paste setiap saat.
- Kecepatan prompt. Di bawah 15 token per detik tidak dapat digunakan untuk apa pun yang lebih lama dari sebuah kalimat.
- Perilaku baterai. Generasi yang memakan waktu dua menit pada 30% CPU baik; yang membutuhkan sepuluh menit pada 100% tidak.
- Default yang masuk akal. Template, pencarian yang menyadari tag, dan riwayat obrolan yang bertahan menutup aplikasi.
Perbandingan cepat
| Aplikasi | Terbaik untuk | Paket gratis | Fitur unggulan | Rating |
|---|---|---|---|---|
| Obsidian | Vault itu sendiri, di ponsel | Ya | Vault yang sama di desktop dan mobile dengan plugin lokal | 4,7 bintang di Aptoide |
| MLC Chat | Inferensi di perangkat tercepat untuk obrolan | Ya (open source) | Model 3B dan 7B yang dipercepat Vulkan pada kecepatan yang wajar | Hanya sideload |
| PocketPal AI | Pelari LLM yang ramah pemula dengan perpustakaan model | Ya (open source) | Download GGUFs dari Hugging Face di dalam aplikasi | 4,4 bintang |
| Layla | Obrolan dengan RAG lokal di atas file apa pun | Tier gratis | Menjalankan model kecil di atas catatan Anda tanpa pengaturan | 4,3 bintang |
| Ollama in Termux | Server Ollama penuh di ponsel, untuk pengguna power | Ya (open source) | API yang sama seperti desktop, sehingga plugin hanya bekerja | Hanya sideload |
| Smart Composer (plugin Obsidian) | Akses model lokal dari Obsidian mobile | Ya (open source) | Berbicara dengan endpoint yang kompatibel dengan OpenAI, termasuk Ollama lokal | Plugin gratis |
| Text Generator (plugin Obsidian) | Prompt berbasis template terhadap model lokal | Ya (open source) | Mengubah catatan apa pun menjadi prompt dengan variabel | Plugin gratis |
7 aplikasi terbaik untuk Obsidian dengan LLM lokal di Android
1. Obsidian — terbaik karena semua yang di bawah berjalan melawan vault-nya
Obsidian di Android membawa vault Markdown yang sama seperti desktop, disinkronkan melalui Obsidian Sync, Syncthing, atau remote Git yang self-hosted, dan menjalankan sebagian besar plugin yang tidak memerlukan API browser. Plugin lokal berarti lapisan AI tetap di ponsel bahkan ketika vault berada di tempat lain.
Di mana ia jatuh pendek: Plugin komunitas yang menganggap lingkungan desktop gagal diam-diam. Pengguna iCloud harus mengandalkan Obsidian Sync atau Working Copy karena Android tidak melihat iCloud.
Harga:
- Gratis: aplikasi lengkap dengan vault lokal
- Berbayar: Obsidian Sync (opsional) untuk sinkronisasi vault terenkripsi
Platform: Android, iOS, Windows, macOS, Linux
Download: obsidian.md — juga tersedia di Aptoide dan Google Play
Garis bawah: Pilih Obsidian terlebih dahulu, karena setiap plugin AI di sini menargetkan vault yang duduk di ponsel.
2. MLC Chat — kecepatan inferensi di perangkat terbaik
MLC Chat mengirimkan model yang dikompilasi oleh proyek MLC LLM untuk berjalan pada GPU ponsel melalui Vulkan. Model 3B seperti Phi-3.5-mini menghasilkan lebih dari 20 token per detik di Snapdragon 8 Gen 3, dan 7B Q4 quant dapat digunakan di ponsel flagship. Obrolan hidup secara lokal, tidak ada akun yang diperlukan.
Di mana ia jatuh pendek: Hanya sideload, katalog model lebih kecil dari PocketPal, dan menambahkan model khusus memerlukan langkah kompilasi di desktop.
Harga:
- Gratis: open source di bawah Apache 2.0
- Berbayar: tidak ada
Platform: Android (sideload APK)
Download: llm.mlc.ai
Garis bawah: Pilih MLC Chat ketika Anda menginginkan generasi lokal tercepat di ponsel dan nyaman dengan APK yang di-sideload.
3. PocketPal AI — on-ramp terbaik untuk orang baru ke LLM lokal
PocketPal AI adalah cara paling ramah untuk memasuki jalan model lokal. Instal aplikasi, telusuri set GGUF model yang dikurasi dari Hugging Face, ketuk untuk mengunduh, dan mulai mengobrol. Template mencakup sebagian besar keluarga model di luar kotak, jadi pengguna pertama kali tidak mengedit chat_template JSON di layar ponsel.
Di mana ia jatuh pendek: Inferensi hanya CPU melalui llama.cpp, jadi kecepatan lebih rendah dari MLC Chat pada perangkat keras yang sama. Akses vault adalah copy-paste kecuali Anda memasangkannya dengan plugin Obsidian.
Harga:
- Gratis: open source di bawah MIT
- Berbayar: tidak ada
Platform: Android, iOS
Download: Google Play
Garis bawah: Pilih PocketPal jika ini adalah pertama kalinya Anda menjalankan model di ponsel.
4. Layla — terbaik ketika obrolan perlu melihat catatan Anda
Layla menjalankan model kecil secara lokal dan melapisi langkah retrieval-augmented ringan di atasnya, jadi prompt dapat mereferensikan catatan atau PDF yang Anda tunjukkan. Bagi pengguna Obsidian, ini berarti “rangkum catatan minggu lalu” bekerja tanpa pekerjaan plugin apa pun, selama vault berada di folder yang dapat dibaca Layla.
Di mana ia jatuh pendek: Kualitas RAG pada model kecil tidak merata. Tier gratis membatasi ukuran model; tier berbayar menghapusnya. Kepolaran UI tertinggal dari PocketPal.
Harga:
- Tier gratis dengan model terbatas
- Berbayar: upgrade sekali jadi membuka model yang lebih besar
Platform: Android, iOS
Download: Google Play
Garis bawah: Pilih Layla jika tujuannya adalah “jawab pertanyaan tentang catatan saya” dan Anda tidak ingin membangun pipa sendiri.
5. Ollama in Termux — setup power-user terbaik yang mencerminkan desktop
Memasang Ollama di dalam Termux memberikan ponsel server HTTP yang sama seperti desktop yang dijalankan, di interface loopback. Plugin Obsidian apa pun yang berbicara dengan Ollama kemudian berbicara dengannya secara langsung. Baterai lebih berat karena Termux tidak keluar dengan anggun, tetapi kinerja mengalahkan sebagian besar GUI runner di ponsel yang sama.
Di mana ia jatuh pendek: Termux dari Play Store sudah usang; sideload dari F-Droid atau build GitHub resmi. Izin layanan foreground memerlukan perhatian, dan throttling termal dapat merusak generasi panjang.
Harga:
- Gratis: open source
- Berbayar: tidak ada
Platform: Android (Termux)
Download: ollama.com dengan Termux
Garis bawah: Pilih ini jika Anda sudah nyaman di Termux dan menginginkan pengalaman Ollama desktop di ponsel.
6. Smart Composer — plugin Obsidian terbaik untuk menunjuk ke model lokal
Smart Composer adalah plugin komunitas yang mengubah obrolan di dalam Obsidian menjadi percakapan dengan endpoint yang kompatibel dengan OpenAI apa pun, termasuk Ollama lokal atau LM Studio yang berjalan di ponsel yang sama melalui Termux, atau di server rumah di seluruh LAN. Prompt dapat @-mention catatan, folder, dan tag, jadi prompt “tulis ulang paragraf ini dalam nada catatan harian bulan lalu” memiliki konteks nyata.
Di mana ia jatuh pendek: Plugin masih menganggap Anda dapat menjangkau server, jadi jika ponsel offline dan tidak ada server lokal yang berjalan, itu tidak melakukan apa pun.
Harga:
- Gratis: open source di bawah MIT
- Berbayar: tidak ada
Platform: Android, iOS, Windows, macOS, Linux (di dalam Obsidian)
Download: github.com/glowingjade/obsidian-smart-composer
Garis bawah: Pilih Smart Composer sebagai jembatan antara Obsidian dan model, apakah model itu berjalan di ponsel atau di server rumah Anda.
7. Text Generator — plugin terbaik untuk templat prompt
Text Generator memperlakukan catatan sebagai template. Bungkus variabel, tambahkan prompt sistem, dan menjalankan template di catatan apa pun mengisi placeholder dan mengirim hasil ke model yang dikonfigurasi. Ini bekerja melawan Ollama lokal, LM Studio, atau penyedia yang dihosting, dan perpustakaan template di forum komunitas besar.
Di mana ia jatuh pendek: Sintaks membutuhkan sore untuk dipelajari. Debug template yang gagal di mobile lebih menyakitkan daripada di desktop.
Harga:
- Gratis: open source di bawah GPLv3
- Berbayar: tidak ada
Platform: Android, iOS, Windows, macOS, Linux (di dalam Obsidian)
Download: text-gen.com
Garis bawah: Pilih Text Generator jika Anda menginginkan template prompt yang dapat digunakan kembali yang mengubah catatan menjadi tindakan AI yang dapat diulang.
Cara memilih
Jika Anda belum memiliki vault di ponsel, instal Obsidian terlebih dahulu dan sinkronkan.
Jika Anda menginginkan generasi lokal tercepat dan nyaman dengan APK yang di-sideload, jalankan MLC Chat.
Jika ini adalah pertama kalinya Anda mencoba model lokal di ponsel, instal PocketPal AI dan pilih model 3B.
Jika obrolan harus melihat catatan Anda tanpa pipa manual, coba Layla dengan folder vault yang dibagikan.
Jika Anda sudah tinggal di Termux, instal Ollama di sana dan biarkan setiap plugin Obsidian menunjuk ke localhost.
Untuk membawa model ke Obsidian itu sendiri, tambahkan Smart Composer sebagai permukaan obrolan.
Untuk prompt berbasis template yang dapat diulang di catatan, tambahkan Text Generator juga.
FAQ
Apa ponsel terkecil yang dapat menjalankan model yang berguna?
Ponsel RAM 8 GB dari dua generasi flagship terakhir akan menjalankan model 3B pada kecepatan yang berguna. Ponsel RAM 12 GB membuka quant 7B Q4. Di bawah 6 GB, OS terus menukar model dan kecepatan jatuh dari tebing.
Model apa yang harus saya mulai dengan?
Phi-3.5-mini dan Llama-3.2-3B keduanya default yang bagus untuk ponsel. Keduanya cocok di bawah 3 GB di Q4, menghasilkan secara koheren, dan mengetahui cukup pengetahuan umum untuk berguna. Naik ke 7B seperti Qwen2.5-7B atau Mistral-7B di perangkat flagship.
Apakah menjalankan model akan merusak baterai saya?
Generasi pendek beberapa ratus token bagus. Jalankan agen panjang, pipeline RAG yang mengenkode ulang vault besar, atau penggunaan foreground berkelanjutan akan menguras ponsel normal dalam beberapa jam. Perlakukan model lokal seperti asisten bentuk pendek, bukan layanan latar belakang.
Dapatkah Obsidian mobile memanggil model yang berjalan di desktop saya?
Ya. Arahkan Smart Composer ke IP lokal desktop Anda dan port Ollama di atas jaringan rumah Anda. Tambahkan Tailscale atau WireGuard jika Anda menginginkan koneksi yang sama untuk bekerja ketika Anda jauh dari rumah. Ponsel tetap pribadi; modelnya hanya di tempat lain.