डेस्कटॉप पर MuckScraper विकल्प

XDA ने इस महीने MuckScraper पर एक लेख प्रकाशित किया, जो एक स्व-होस्ट किए गए समाचार एकत्रकर्ता है जो आउटलेट्स में लेखों को समूहित करता है, एक स्थानीय LLM के साथ पूर्वाग्रह को स्कोर करता है और आपके स्वयं के Ollama इंस्टेंस के खिलाफ सारांश उत्पन्न करता है। यह वास्तव में एक चतुर परियोजना है। यह grregis/MuckScraper पर एक एकल GitHub रिपो भी है जिसमें एक योगदानकर्ता है, कोई पैकेज किए गए रिलीज नहीं, और एक Docker Compose फ़ाइल है जो बहुत सारे स्थानीय मॉडल वायरिंग को मानती है। MuckScraper के सात विकल्प वास्तविक रखरखाव संख्या के साथ अधिकांश समान काम को Ollama निर्भरता के बिना कवर करते हैं।

त्वरित तुलना

ऐप सर्वश्रेष्ठ के लिए मुक्त योजना शुरुआती मूल्य उल्लेखनीय विशेषता
FreshRSS डिफ़ॉल्ट स्व-होस्ट किए गए एकत्रकर्ता हाँ मुक्त विशाल एक्सटेंशन इकोसिस्टम
Miniflux न्यूनतावादी एकल-बाइनरी पाठक हाँ मुक्त या $15/वर्ष होस्ट किया गया 2024 के बाद से LLM एकीकरण
Selfoss मल्टी-सोर्स डैशबोर्ड हाँ मुक्त RSS, Twitter, Reddit को एकत्रित करता है
Tiny Tiny RSS पावर-यूजर फ़िल्टरिंग हाँ मुक्त Regex फ़िल्टर, प्लगइन API
CommaFeed Google Reader क्लोन हाँ मुक्त या $3/माह होस्ट किया गया क्लीन Java-आधारित UI
Yarr एकल-फ़ाइल डेस्कटॉप पाठक हाँ मुक्त स्थानीय बाइनरी के रूप में चलता है
Feedbin प्रबंधित समाचार पत्र पाठक 14-दिन की परीक्षा $5/माह ई-पुस्तकें, समाचार पत्र, पॉडकास्ट

लोग MuckScraper को क्यों छोड़ते हैं

GitHub रिपो जुलाई के मध्य में एक एकल योगदानकर्ता और कुछ सितारों को दिखाता है। शौक परियोजना में कोई गलती नहीं है, लेकिन समाचार एकत्रण एक ऐसा काम है जो 24/7 चलता है, और इसके लिए एकल रिपो चुनना जोखिम लेता है। तीन ठोस दर्द बिंदु XDA के टुकड़े की टिप्पणियों और Hacker News में दिखाई देते हैं:

  1. डिफ़ॉल्ट रूप से Ollama निर्भरता। MuckScraper की पूर्वाग्रह स्कोरिंग और सारांश को स्थानीय मॉडल की आवश्यकता है। यदि आप पहले से ही 7B मॉडल के साथ Ollama नहीं चला रहे हैं, तो आप दो सेवाएं स्थापित कर रहे हैं, एक नहीं।
  2. कोई पैकेज किए गए रिलीज नहीं। स्रोत से Docker Compose काम करता है यदि आप Docker को जानते हैं, लेकिन कोई Homebrew फॉर्मूला नहीं, कोई APT रिपो नहीं, कोई एक-लाइन इंस्टॉलर नहीं। प्रत्येक अपग्रेड एक git pull है।
  3. कहानी क्लस्टरिंग एकमात्र सार्थक नया विचार है। क्रॉस-आउटलेट समूहीकरण अच्छा है, लेकिन इस सूची में हर गंभीर RSS पाठक एक दशक से खोज और फ़िल्टरिंग को हल कर रहा है। यदि पूर्वाग्रह स्कोरिंग आपके लिए किलर फीचर नहीं है, तो MuckScraper उन उपकरणों का एक भारी संस्करण है जो आपके पास पहले से हैं।

विकल्प

FreshRSS – सर्वश्रेष्ठ डिफ़ॉल्ट स्व-होस्ट किए गए समाचार एकत्रकर्ता

FreshRSS 2013 में Google Reader के बंद होने के समुदाय का उत्तर है, और 2026 में यह पहली बार स्व-होस्ट किए गए फीड रीडर को स्थापित करने वाले किसी के लिए डिफ़ॉल्ट विकल्प है। PHP-आधारित, MySQL या PostgreSQL बैकएंड, आधिकारिक रूप से बनाए गए Docker इमेज। कोई भी Raspberry Pi 3 या उससे अधिक पर चलता है।

एक्सटेंशन इकोसिस्टम यह है जो इसे अलग करता है। संग्रहीत लेख स्क्रैपिंग, YouTube चैनल हैंडलिंग, RSS के बिना साइटों के लिए XPath स्क्रैपिंग, और मोबाइल साथी ऐप्स (FeedMe, Readrops) के लिए एक्सटेंशन लगभग हर उपयोग केस को कवर करते हैं जो MuckScraper की बिल्ट-इन सुविधाएं डुप्लिकेट करने का प्रयास करती हैं।

यह कहाँ कम पड़ता है: कोई निर्मित LLM सारांश नहीं। डिफ़ॉल्ट UI अभी भी 2015 वेब ऐप की तरह दिखता है। सेटअप को सामने एक वेब सर्वर की आवश्यकता है।

मूल्य निर्धारण:

MuckScraper से माइग्रेशन: अपने OPML को MuckScraper से निर्यात करें, तीन क्लिक में FreshRSS में आयात करें। कोई भी पूर्वाग्रह स्कोर जो आपने MuckScraper में टैग किया है वह स्थानांतरित नहीं होगा।

डाउनलोड: FreshRSS.org

नीचे की पंक्ति: यदि आप MuckScraper को छोड़ रहे हैं और सबसे सुरक्षित स्व-होस्ट किए गए डिफ़ॉल्ट चाहते हैं तो यहाँ शुरू करें।

Miniflux – न्यूनतमवादियों के लिए सर्वश्रेष्ठ जो अभी भी LLM एकीकरण चाहते हैं

Miniflux एक एकल Go बाइनरी, एक PostgreSQL बैकएंड, और कुछ नहीं है। कोई प्लगइन नहीं, कोई विषय नहीं, कोई एक्सटेंशन नहीं। यह 2.1 रिलीज चक्र के बाद से क्या करता है वह तीसरे पक्ष के AI प्रदाताओं के साथ मूल एकीकरण है जो मांग पर लेख सारांश के लिए है। इसे OpenAI, Anthropic या स्थानीय Ollama endpoint पर इशारा करें, और यह इनलाइन लेखों को सारांशित करता है।

पाठक UI पठनीयता के बारे में आक्रामक है। पूर्ण-पाठ स्क्रैपिंग बिल्ट-इन और प्रति-फीड सक्षम है। कीबोर्ड शॉर्टकट हर क्रिया को कवर करते हैं।

यह कहाँ कम पड़ता है: स्व-होस्ट किए गए बिल्ड में कोई मल्टी-यूजर समर्थन नहीं (आप एक खाता प्राप्त करते हैं)। कोई मोबाइल ऐप नहीं; PWA काम करता है लेकिन नेटिव नहीं है। UI डिज़ाइन द्वारा कम नहीं है; कुछ पाठक इसे बहुत सादा पाते हैं।

मूल्य निर्धारण:

MuckScraper से माइग्रेशन: OPML निर्यात स्वच्छ रूप से आयात करता है। MuckScraper के साथ उपयोग कर रहे मॉडल से मेल खाने के लिए Miniflux सेटिंग में अपने LLM प्रदाता को कॉन्फ़िगर करें।

डाउनलोड: Miniflux.app

नीचे की पंक्ति: यदि आप MuckScraper कृत्रिम बुद्धिमत्ता सारांश को Docker Compose जिमनास्टिक्स के बिना चाहते हैं तो सर्वश्रेष्ठ पिक।

Selfoss – RSS से परे एकत्रित करने के लिए सर्वश्रेष्ठ

Selfoss प्रत्येक स्रोत को “spout” के रूप में मानता है और RSS, Twitter (Nitter के माध्यम से), Reddit, Mastodon, GitHub commits और लगभग एक दर्जन अन्य स्रोतों को कवर करता है। यह इस सूची में MuckScraper की क्रॉस-सोर्स महत्वाकांक्षाओं का सबसे करीबी उपकरण है, हालांकि LLM परत के बिना।

डैशबोर्ड नदी-शैली है: सब कुछ एक कॉलम में, सबसे नई पहले क्रमबद्ध। टैग या स्रोत द्वारा फ़िल्टरिंग तत्काल है। स्टैक PHP प्लस SQLite (या बड़ी स्थापना के लिए MySQL) है, और यह लगभग कुछ भी पर चलता है।

यह कहाँ कम पड़ता है: विकास अब धीमा है (कुछ महीनों में रिलीज, हर कुछ हफ्तों में नहीं)। API परिवर्तनों के बाद Twitter एकीकरण टूट गया और केवल Nitter मिरर के माध्यम से काम करता है जो अप्रत्याशित हैं। मोबाइल UI काम करता है लेकिन सूचनाओं को सिंक नहीं करता है।

मूल्य निर्धारण:

MuckScraper से माइग्रेशन: RSS के लिए OPML आयात काम करता है। गैर-RSS स्रोत (Reddit, YouTube) को हाथ से पुनः कॉन्फ़िगर करने की आवश्यकता है।

डाउनलोड: Selfoss.aditu.de

नीचे की पंक्ति: यदि आप एक डैशबोर्ड में RSS प्लस सब कुछ चाहते हैं तो Selfoss चुनें।

Tiny Tiny RSS – पावर-यूजर फ़िल्टरिंग के लिए सर्वश्रेष्ठ

Tiny Tiny RSS उन लोगों के लिए विकल्प है जो अपने समाचार फीड पर regex फ़िल्टर लिखते हैं। फ़िल्टर नियम हर लेख सेवन पर चलते हैं और regex मैच, तारीख रेंज और स्रोत डोमेन के आधार पर ऑटो-टैग, ऑटो-मार्क-रीड या ऑटो-स्टार कर सकते हैं। प्लगइन API उस सब के दरवाजे खोलता है जो रक्षक ने नहीं बनाया है।

परियोजना का विकास 2020 में स्व-होस्ट किए गए Gitea में स्थानांतरित हुआ (डेवलपर ने GitHub के साथ झगड़ा किया) लेकिन अभी भी नियमित रिलीज के साथ सक्रिय है।

यह कहाँ कम पड़ता है: इंस्टॉल PHP प्लस PostgreSQL है और पैमाने पर चिकनी चलाने के लिए nginx tuning की आवश्यकता है। डिफ़ॉल्ट UI दिनांकित है। कुछ प्लगइन पुराने हैं।

मूल्य निर्धारण:

MuckScraper से माइग्रेशन: RSS के लिए OPML आयात करें। TT-RSS के regex फ़िल्टर सिंटैक्स का उपयोग करके किसी भी टैग नियम को फिर से बनाएं।

डाउनलोड: tt-rss.org

नीचे की पंक्ति: पावर-यूजर पिक। यदि आप पहले से regex नहीं लिख रहे हैं तो छोड़ दें।

CommaFeed – Google Reader दिख के लिए सर्वश्रेष्ठ

CommaFeed एक Java-आधारित स्व-होस्ट किए गए फीड रीडर है जिसका UI दृश्यमान रूप से 2013 के आसपास Google Reader की नकल करता है। यही तो बात है। तीन-पैन लेआउट, फ़ोल्डर पदानुक्रम, कीबोर्ड शॉर्टकट जो किसी के भी मांसपेशी स्मृति से मेल खाते हैं जिसने ब्राउज़र में Reader का उपयोग किया है।

एकल JAR या Docker कंटेनर के रूप में चलता है। भंडारण के लिए PostgreSQL या MySQL का उपयोग करता है। एक एकल डेवलपर द्वारा सक्रिय रूप से बनाए रखा जाता है जिसमें योगदानकर्ताओं का एक छोटा आधार है।

यह कहाँ कम पड़ता है: कोई उन्नत फ़िल्टरिंग नहीं। कोई प्लगइन सिस्टम नहीं। Java मेमोरी फ़ुटप्रिंट PHP या Go समकक्षों से भारी है।

मूल्य निर्धारण:

MuckScraper से माइग्रेशन: OPML आयात काम करता है। कोई भी कस्टम पूर्वाग्रह टैग स्थानांतरित नहीं होते हैं।

डाउनलोड: CommaFeed.com

नीचे की पंक्ति: यदि आप Google Reader को याद करते हैं और एक स्व-होस्ट किए गए क्लोन चलाना चाहते हैं जो उसकी तरह दिखता है तो इसे चुनें।

Yarr – स्थानीय-केवल एकल-बाइनरी पाठक के लिए सर्वश्रेष्ठ

Yarr अत्यधिक न्यूनतावादी विकल्प है: एक Go बाइनरी, एक SQLite फ़ाइल, एक ब्राउज़र टैब। कोई सर्वर की जरूरत नहीं। आप अपने लैपटॉप पर yarr चलाते हैं, यह localhost:7070 को अपने ब्राउज़र में खोलता है, और वह आपका फीड रीडर है। कोई होस्टिंग ओवरहेड के बिना एक एकल मशीन पर एकल पाठक के लिए आदर्श।

रखरखाव कर्ता (Nazar Kanaev) Windows, macOS और Linux के लिए बिल्ड प्रदान करता है। कुल इंस्टॉल आकार लगभग 15 MB है।

यह कहाँ कम पड़ता है: डिवाइस में कोई सिंक नहीं। कोई मल्टी-यूजर नहीं। कोई LLM कुछ भी नहीं। फ़िल्टरिंग बुनियादी है।

मूल्य निर्धारण:

MuckScraper से माइग्रेशन: OPML आयात काम करता है। कोई भी पूर्वाग्रह डेटा नहीं।

डाउनलोड: github.com/nkanaev/yarr

नीचे की पंक्ति: यदि आप एकमात्र पाठक हैं और आप एक सर्वर नहीं चलाना चाहते हैं तो सही पिक। यदि आप डिवाइस में सिंक चाहते हैं तो छोड़ दें।

Feedbin – यदि आप भुगतान करेंगे तो सर्वश्रेष्ठ प्रबंधित विकल्प

Feedbin स्व-होस्ट किया गया नहीं है, और यही तो बात है। यदि MuckScraper एक शौक की तरह लगता है जो एक काम बन गया, तो Feedbin विपरीत भुगतान है: प्रबंधित होस्टिंग, एक मूल iOS ऐप, प्रथम श्रेणी की समाचार पत्र रूटिंग (प्रत्येक खाता एक @feedbin.me ईमेल प्राप्त करता है जो समाचार पत्रों को फीड में बदलता है) और पॉडकास्ट सदस्यता ट्रैकिंग।

पूर्वाग्रह स्कोरिंग वहाँ नहीं है। न ही LLM सारांश। जो Feedbin के पास है वह अपटाइम और एक छोटी पूर्णकालिक टीम है जो 2013 से इसे बनाए रखती है।

यह कहाँ कम पड़ता है: लागत $5 प्रति माह। खुला स्रोत नहीं। स्व-होस्ट किया गया नहीं।

मूल्य निर्धारण:

MuckScraper से माइग्रेशन: एक क्लिक में OPML आयात।

डाउनलोड: Feedbin.com

नीचे की पंक्ति: यदि आप अपने समय को $5 प्रति माह से अधिक मूल्यवान मानते हैं तो Feedbin भुगतान करें। यदि स्व-होस्ट किए गए कठोर आवश्यकता है तो छोड़ दें।

कैसे चुनें

FreshRSS चुनें यदि आप सबसे सुरक्षित स्व-होस्ट किए गए डिफ़ॉल्ट चाहते हैं। इसमें सबसे बड़ा समुदाय और सबसे अधिक एक्सटेंशन हैं।

Miniflux चुनें यदि आप विशेष रूप से LLM सारांश कोण चाहते हैं जो आपको MuckScraper की ओर आकर्षित करता है, Docker Compose जटिलता के बिना।

Selfoss चुनें यदि समाचार पूर्वाग्रह स्कोरिंग की तुलना में एक डैशबोर्ड में RSS प्लस Reddit प्लस GitHub commits को एकत्रित करना अधिक मूल्यवान है।

Tiny Tiny RSS चुनें यदि आप regex फ़िल्टर लिखते हैं और पावर-यूजर नियंत्रण चाहते हैं।

Yarr चुनें यदि आप एक एकल-उपयोगकर्ता स्थानीय-केवल पाठक चाहते हैं और एक सर्वर चलाने से इनकार करते हैं।

Feedbin का भुगतान करें यदि आप अपने स्वयं के sysadmin होने से रोकना चाहते हैं। यह उन लोगों के लिए ईमानदार उत्तर है जो स्वीकार करते हैं कि वे बनाए रखने की तुलना में पढ़ना पसंद करेंगे।

यदि LLM पूर्वाग्रह स्कोरिंग किलर सुविधा है तो MuckScraper पर रहें। इस सूची में कोई अन्य उपकरण इसे बॉक्स से बाहर मेल खाता है।

अक्सर पूछे जाने वाले प्रश्न

MuckScraper क्या है?

MuckScraper GitHub पर grregis द्वारा एक स्व-होस्ट किए गए समाचार एकत्रकर्ता है। यह आउटलेट्स में लेखों को कहानियों में समूहित करता है, स्थानीय LLM के साथ पूर्वाग्रह को स्कोर करता है और सारांश उत्पन्न करता है। इसे चलाने के लिए Ollama या एक संगत स्थानीय मॉडल सर्वर की आवश्यकता है।

क्या FreshRSS MuckScraper का एक अच्छा विकल्प है?

हाँ, अधिकांश लोगों के लिए। FreshRSS MuckScraper की तुलना में RSS-एकत्रकर्ता भूमिका को बेहतर तरीके से कवर करता है, अधिक योगदानकर्ता हैं, पैकेज किए गए Docker इमेज, और एक्सटेंशन की एक इकोसिस्टम है। यह LLM पूर्वाग्रह स्कोरिंग को कवर नहीं करता है, जो MuckScraper का विभेदक है।

कौन सा स्व-होस्ट किए गए फीड पाठक AI सारांश का समर्थन करता है?

Miniflux के पास 2.1 चक्र के बाद से निर्मित AI सारांश है। इसे OpenAI, Anthropic, या स्थानीय Ollama endpoint पर इशारा करें और यह इनलाइन लेखों को सारांशित करता है। यह एक बनाए गए परियोजना में MuckScraper की LLM सुविधा के लिए सबसे करीबी मिलान है।

क्या मैं इनमें से कोई भी सर्वर के बिना चला सकता हूँ?

हाँ। Yarr एक एकल बाइनरी है जो आप अपने लैपटॉप पर चलाते हैं जो एक ब्राउज़र टैब को अपने UI के रूप में खोलता है। कोई सर्वर नहीं, कोई पोर्ट फॉरवर्डिंग नहीं, कोई Docker नहीं। यह केवल एकल-उपयोगकर्ता है।

Raspberry Pi पर क्या चलता है?

FreshRSS, Miniflux, Selfoss और Yarr Raspberry Pi 3 या अधिक नए पर आराम से चलते हैं। Tiny Tiny RSS चलता है लेकिन चिकनी प्रदर्शन के लिए Pi 4 चाहता है। Feedbin स्व-होस्ट किया गया नहीं है।