
वह XDA पोस्ट जो कई होमपेजों पर आई, एक बात को रेखांकित करती है जिसे कई Obsidian उपयोगकर्ता चुपचाप परीक्षण कर रहे थे: 8 या 12 GB RAM वाला एक आधुनिक Android फ़ोन 3 बिलियन पैरामीटर वाले मॉडल को पठनीय गति पर, पूरी तरह ऑफ़लाइन चला सकता है, और Obsidian के साथ जोड़ने पर, यह वॉल्ट को एक डायरी और एक खोज योग्य दूसरे मस्तिष्क के बीच कुछ में बदल देता है। कोई क्लाउड राउंड-ट्रिप नहीं, कोई प्रति-टोकन बिल नहीं, हवाई जहाज या मेट्रो की सवारी पर कोई सिग्नल आवश्यक नहीं।
हमने 7 Android ऐप्स का परीक्षण किया जो इस जोड़ी को व्यावहारिक रूप से काम करते हैं। नीचे दिए गए प्रत्येक ऐप्स डिवाइस पर मॉडल चलाता है, फ़ोन पर संग्रहीत Obsidian वॉल्ट से जुड़ता है, और नेटवर्क कनेक्शन के बिना उपयोगी रहता है।
क्या खोजें
- डिवाइस पर अनुमान। यदि ऐप्स एक API को कॉल करता है, तो यह वह उपकरण नहीं है जिसका हम परीक्षण कर रहे हैं।
- उचित मॉडल। Q4-क्वांटिज़्ड 3B या 7B甜蜜 मिठास की बिंदु है; कुछ भी बड़ा स्वैप को मार देता है।
- वॉल्ट एक्सेस। Obsidian वॉल्ट की फ़ाइल सिस्टम तक सीधी पहुंच हर बार कॉपी-पेस्ट करने से बेहतर है।
- प्रॉम्प्ट गति। प्रति सेकंड 15 टोकन से कम किसी भी चीज़ के लिए एक वाक्य से अधिक लंबी अनुपयोगी है।
- बैटरी व्यवहार। एक पीढ़ी जो 30% CPU पर दो मिनट लेती है वह ठीक है; जो 100% पर दस मिनट लेती है वह नहीं है।
- समझदारी भरे डिफ़ॉल्ट। टेम्प्लेट, टैग-जागरूक खोज, और चैट इतिहास जो ऐप्स को बंद करने से बचता है।
त्वरित तुलना
| ऐप्स | सर्वश्रेष्ठ के लिए | फ्री प्लान | असाधारण सुविधा | रेटिंग |
|---|---|---|---|---|
| Obsidian | वॉल्ट ही, फ़ोन पर | हाँ | डेस्कटॉप और मोबाइल पर समान वॉल्ट स्थानीय प्लगइन के साथ | Aptoide पर 4.7 स्टार |
| MLC Chat | चैट के लिए डिवाइस पर सबसे तेज़ अनुमान | हाँ (खुला स्रोत) | Vulkan-त्वरित 3B और 7B मॉडल उचित गति पर | केवल साइडलोड |
| PocketPal AI | स्थानीय LLM के लिए शुरुआत के अनुकूल | हाँ (खुला स्रोत) | ऐप्स के भीतर Hugging Face से GGUFs डाउनलोड करता है | 4.4 स्टार |
| Layla | किसी भी फ़ाइल के ऊपर स्थानीय RAG के साथ चैट | मुफ्त स्तर | सेटअप के बिना आपके नोट्स के ऊपर एक छोटा मॉडल चलाता है | 4.3 स्टार |
| Ollama in Termux | फ़ोन पर पूर्ण Ollama सर्वर, उन्नत उपयोगकर्ताओं के लिए | हाँ (खुला स्रोत) | डेस्कटॉप के समान API, तो प्लगइन बस काम करते हैं | केवल साइडलोड |
| Smart Composer (Obsidian प्लगइन) | Obsidian मोबाइल से स्थानीय मॉडल एक्सेस | हाँ (खुला स्रोत) | किसी भी OpenAI-संगत एंडपॉइंट से बात करता है, स्थानीय Ollama सहित | मुफ्त प्लगइन |
| Text Generator (Obsidian प्लगइन) | स्थानीय मॉडल के विरुद्ध टेम्पलेटेड प्रॉम्प्ट | हाँ (खुला स्रोत) | किसी भी नोट को चर के साथ प्रॉम्प्ट में बदल देता है | मुफ्त प्लगइन |
Android में Obsidian के साथ स्थानीय LLM के लिए 7 सर्वश्रेष्ठ ऐप्स
1. Obsidian — सर्वश्रेष्ठ क्योंकि सब कुछ नीचे इसके वॉल्ट के विरुद्ध चलता है
Obsidian Android पर डेस्कटॉप के समान Markdown वॉल्ट को ले जाता है, Obsidian Sync, Syncthing या एक स्व-होस्ट किए गए Git रिमोट के माध्यम से सिंक करता है, और अधिकांश प्लगइन चलाता है जिन्हें ब्राउज़र API की आवश्यकता नहीं है। स्थानीय प्लगइन का मतलब है कि AI परत फ़ोन पर रहती है भले ही वॉल्ट कहीं और हो।
जहां यह विफल होता है: सामुदायिक प्लगइन जो डेस्कटॉप वातावरण मानते हैं, चुपचाप विफल हो जाते हैं। iCloud उपयोगकर्ताओं को Obsidian Sync या Working Copy पर निर्भर रहना पड़ता है क्योंकि Android iCloud को नहीं देखता है।
मूल्य निर्धारण:
- मुफ्त: स्थानीय वॉल्ट के साथ पूर्ण ऐप्स
- भुगतान: Obsidian Sync (वैकल्पिक) एन्क्रिप्टेड वॉल्ट सिंक के लिए
प्लेटफॉर्म: Android, iOS, Windows, macOS, Linux
डाउनलोड: obsidian.md — Aptoide और Google Play पर भी उपलब्ध
निचली पंक्ति: Obsidian को पहले चुनें, क्योंकि यहाँ हर AI प्लगइन फ़ोन पर बैठे वॉल्ट को लक्षित करता है।
2. MLC Chat — सर्वश्रेष्ठ डिवाइस पर अनुमान गति
MLC Chat MLC LLM परियोजना द्वारा संकलित मॉडल प्रदान करता है जो Vulkan के माध्यम से फ़ोन के GPU पर चलने के लिए। Phi-3.5-mini जैसा 3B मॉडल Snapdragon 8 Gen 3 पर 20+ टोकन प्रति सेकंड पर उत्पन्न करता है, और एक 7B Q4 क्वांट फ्लैगशिप फ़ोन पर उपयोगी है। चैट स्थानीय रूप से रहते हैं, कोई खाता आवश्यक नहीं।
जहां यह विफल होता है: केवल साइडलोड, मॉडल कैटलॉग PocketPal से छोटा है, और कस्टम मॉडल जोड़ना डेस्कटॉप पर संकलन चरण की आवश्यकता है।
मूल्य निर्धारण:
- मुफ्त: Apache 2.0 के तहत खुला स्रोत
- भुगतान: कोई नहीं
प्लेटफॉर्म: Android (साइडलोड APK)
डाउनलोड: llm.mlc.ai
निचली पंक्ति: MLC Chat चुनें जब आप फ़ोन पर सबसे तेज़ स्थानीय पीढ़ी चाहते हैं और साइडलोड किए गए APK के साथ सहज हैं।
3. PocketPal AI — स्थानीय LLM में नए लोगों के लिए सर्वश्रेष्ठ ऑन-रैम्प
PocketPal AI स्थानीय-मॉडल सड़क पर आने का सबसे मैत्रीपूर्ण तरीका है। ऐप्स इंस्टॉल करें, Hugging Face से GGUF मॉडल का एक क्यूरेटेड सेट ब्राउज़ करें, डाउनलोड करने के लिए टैप करें, और चैटिंग शुरू करें। टेम्पलेट बॉक्स से बाहर अधिकांश मॉडल परिवारों को कवर करते हैं, इसलिए पहली बार उपयोगकर्ता फ़ोन स्क्रीन पर chat_template JSON को संपादित नहीं कर रहा है।
जहां यह विफल होता है: llama.cpp के माध्यम से केवल CPU अनुमान, तो गति समान हार्डवेयर पर MLC Chat से कम है। वॉल्ट एक्सेस कॉपी-पेस्ट है जब तक आप इसे Obsidian प्लगइन के साथ युग्मित न करें।
मूल्य निर्धारण:
- मुफ्त: MIT के तहत खुला स्रोत
- भुगतान: कोई नहीं
प्लेटफॉर्म: Android, iOS
डाउनलोड: Google Play
निचली पंक्ति: PocketPal चुनें यदि यह आपका पहली बार है फ़ोन पर मॉडल चलाना।
4. Layla — सर्वश्रेष्ठ जब चैट को आपके नोट्स देखने की आवश्यकता हो
Layla स्थानीय रूप से छोटे मॉडल चलाता है और ऊपर एक हल्के पुनर्प्राप्ति-वर्धित चरण को परत देता है, इसलिए एक प्रॉम्प्ट आपके द्वारा इंगित किए गए नोट्स या PDF को संदर्भित कर सकता है। Obsidian उपयोगकर्ता के लिए, इसका मतलब है “पिछले सप्ताह के नोट्स को सारांशित करें” बिना किसी प्लगइन काम के काम करता है, जब तक वॉल्ट Layla द्वारा पठनीय फ़ोल्डर में हो।
जहां यह विफल होता है: एक छोटे मॉडल पर RAG गुणवत्ता असमान है। मुफ्त स्तर मॉडल आकार को सीमित करता है; भुगतान किया गया स्तर इसे हटा देता है। UI पॉलिश PocketPal से पीछे हट जाता है।
मूल्य निर्धारण:
- सीमित मॉडल के साथ मुफ्त स्तर
- भुगतान: एकबारी अपग्रेड बड़े मॉडल को अनलॉक करता है
प्लेटफॉर्म: Android, iOS
डाउनलोड: Google Play
निचली पंक्ति: Layla चुनें यदि लक्ष्य “मेरे नोट्स के बारे में सवाल जवाब दें” है और आप स्वयं पाइपलाइन नहीं बनाना चाहते।
5. Ollama in Termux — सर्वश्रेष्ठ पावर-उपयोगकर्ता सेटअप जो डेस्कटॉप को प्रतिबिंबित करता है
Ollama को Termux के भीतर स्थापित करना फ़ोन को उसी HTTP सर्वर देता है जो डेस्कटॉप चलाता है, लूपबैक इंटरफेस पर। कोई भी Obsidian प्लगइन जो Ollama से बात करता है फिर इसके साथ सीधे बात करता है। बैटरी भारी है क्योंकि Termux सुंदरता से बाहर नहीं निकलता है, लेकिन प्रदर्शन समान फ़ोन पर अधिकांश GUI रनर को हराता है।
जहां यह विफल होता है: Play Store से Termux पुराना है; F-Droid या आधिकारिक GitHub बिल्ड से साइडलोड करें। अग्रभूमि सेवा अनुमतियों को देखभाल की आवश्यकता है, और तापीय थ्रॉटलिंग लंबी पीढ़ी को चोट पहुंचा सकती है।
मूल्य निर्धारण:
- मुफ्त: खुला स्रोत
- भुगतान: कोई नहीं
प्लेटफॉर्म: Android (Termux)
डाउनलोड: ollama.com Termux के साथ
निचली पंक्ति: यह चुनें यदि आप पहले से ही Termux में सहज हैं और फ़ोन पर डेस्कटॉप Ollama अनुभव चाहते हैं।
6. Smart Composer — स्थानीय मॉडल पर इंगित करने के लिए सर्वश्रेष्ठ Obsidian प्लगइन
Smart Composer सामुदायिक प्लगइन है जो Obsidian के भीतर चैट को किसी भी OpenAI-संगत एंडपॉइंट के साथ बातचीत में बदल देता है, स्थानीय Ollama या LM Studio सहित जो Termux के माध्यम से समान फ़ोन पर चल रहा है, या LAN के माध्यम से घर के सर्वर पर। प्रॉम्प्ट @-नोट्स, फ़ोल्डर और टैग का उल्लेख कर सकते हैं, इसलिए “इस पैराग्राफ को पिछले महीने के दैनिक नोट्स के स्वर में फिर से लिखें” प्रॉम्प्ट में वास्तविक संदर्भ है।
जहां यह विफल होता है: प्लगइन अभी भी मानता है कि आप सर्वर तक पहुंच सकते हैं, तो यदि फ़ोन ऑफलाइन है और कोई स्थानीय सर्वर नहीं चल रहा है, तो यह कुछ नहीं करता है।
मूल्य निर्धारण:
- मुफ्त: MIT के तहत खुला स्रोत
- भुगतान: कोई नहीं
प्लेटफॉर्म: Android, iOS, Windows, macOS, Linux (Obsidian के भीतर)
डाउनलोड: github.com/glowingjade/obsidian-smart-composer
निचली पंक्ति: Obsidian और मॉडल के बीच पुल के रूप में Smart Composer चुनें, चाहे वह मॉडल फ़ोन पर चले या आपके घर के सर्वर पर।
7. Text Generator — प्रॉम्प्ट टेम्पलेट के लिए सर्वश्रेष्ठ प्लगइन
Text Generator नोट्स को टेम्पलेट के रूप में मानता है। एक चर को लपेटें, एक सिस्टम प्रॉम्प्ट जोड़ें, और किसी भी नोट पर टेम्पलेट चलाने से प्लेसहोल्डर भर जाते हैं और परिणाम कॉन्फ़िगर किए गए मॉडल को भेजा जाता है। यह स्थानीय Ollama, LM Studio या होस्टेड प्रदाताओं के विरुद्ध काम करता है, और सामुदायिक फोरम पर टेम्पलेट पुस्तकालय बड़ा है।
जहां यह विफल होता है: सिंटैक्स सीखने में एक दोपहर लगती है। मोबाइल पर विफल टेम्पलेट को डीबग करना डेस्कटॉप पर अधिक दर्दनाक है।
मूल्य निर्धारण:
- मुफ्त: GPLv3 के तहत खुला स्रोत
- भुगतान: कोई नहीं
प्लेटफॉर्म: Android, iOS, Windows, macOS, Linux (Obsidian के भीतर)
डाउनलोड: text-gen.com
निचली पंक्ति: Text Generator चुनें यदि आप पुन: प्रयोग योग्य प्रॉम्प्ट टेम्पलेट चाहते हैं जो नोट को एक दोहराए जाने वाले AI कार्य में बदल देते हैं।
कैसे चुनें
यदि आपके पास अभी तक फ़ोन पर वॉल्ट नहीं है, तो Obsidian को पहले स्थापित करें और सिंक करें।
यदि आप सबसे तेज़ स्थानीय पीढ़ी चाहते हैं और साइडलोड किए गए APK के साथ सहज हैं, तो MLC Chat चलाएं।
यदि यह फ़ोन पर स्थानीय मॉडल आजमाने का आपका पहली बार है, तो PocketPal AI स्थापित करें और 3B मॉडल चुनें।
यदि चैट को मैनुअल पाइपलाइन के बिना आपके नोट्स देखने की आवश्यकता है, तो साझा किए गए वॉल्ट फ़ोल्डर के साथ Layla आजमाएं।
यदि आप पहले से ही Termux में रहते हैं, तो Ollama को वहां स्थापित करें और हर Obsidian प्लगइन को localhost की ओर इशारा करने दें।
मॉडल को Obsidian में ही लाने के लिए, चैट सतह के रूप में Smart Composer जोड़ें।
नोट्स पर दोहराए जाने वाले टेम्पलेटेड प्रॉम्प्ट के लिए, Text Generator भी जोड़ें।
FAQ
सबसे छोटा फ़ोन कौन सा है जो उपयोगी मॉडल चला सकता है?
पिछली दो पीढ़ियों के फ्लैगशिप से 8 GB RAM वाला फ़ोन उपयोगी गति पर 3B मॉडल चलाएगा। 12 GB RAM वाला फ़ोन 7B Q4 क्वांट खोलता है। 6 GB से कम, OS मॉडल को स्वैप करते रहता है और गति गिरावट जाता है।
मुझे किस मॉडल से शुरुआत करनी चाहिए?
Phi-3.5-mini और Llama-3.2-3B दोनों फ़ोन के लिए अच्छे डिफॉल्ट हैं। दोनों Q4 में 3 GB के अंदर फिट होते हैं, सुसंगत रूप से उत्पन्न करते हैं, और उपयोगी होने के लिए पर्याप्त सामान्य ज्ञान जानते हैं। Qwen2.5-7B या Mistral-7B जैसे 7B तक कदम रखें।
मॉडल चलाने से मेरी बैटरी नष्ट होगी?
सैकड़ों टोकन की छोटी पीढ़ी ठीक है। लंबी एजेंट रन, RAG पाइपलाइन जो एक बड़े वॉल्ट को पुन: एन्कोड करते हैं, या निरंतर अग्रभूमि उपयोग कुछ घंटों में सामान्य फ़ोन को सूखा देते हैं। स्थानीय मॉडल को छोटे-फॉर्म सहायक के रूप में, पृष्ठभूमि सेवा के रूप में नहीं मानें।
क्या Obsidian मोबाइल मेरे डेस्कटॉप पर चल रहा मॉडल को कॉल कर सकता है?
हाँ। Smart Composer को अपने डेस्कटॉप के स्थानीय IP और Ollama पोर्ट के लिए अपने होम नेटवर्क पर इंगित करें। यदि आप चाहते हैं कि समान कनेक्शन घर से दूर रहते समय काम करे तो Tailscale या WireGuard जोड़ें। फ़ोन निजी रहता है; मॉडल बस कहीं और है।