गाइड

Telegram बॉट के लिए AI ज्ञान-कोष: क्या डालें (2026)

आठ स्रोत types, हर एक की ingest cost और उसकी वजह, चढ़ाना और पहले जवाब के बीच क्या होता है, और ख़ाली जगहें सूची चढ़ाना से ज़्यादा क्यों मायने रखती है।

AdminHub

संक्षेप में। ज्ञान-कोष उतना ही जवाब देता है जितना उसमें जवाब है, एक शब्द आगे नहीं — पर यह सहायक के आधे स्रोत भर है; दूसरा आधा आपकी दुकान का जीवंत डेटा है। AdminHub आठ तरह के स्रोत लेता है — वेबसाइट crawl से आवाज़ note तक — और हर एक का शुल्क अलग है, क्योंकि काम अलग है: paste किए पाठ के 5 क्रेडिट, PDF के 30, audio की हर शुरू हुई minute के 5, CSV के शून्य। AI ने जो निकाला वह जीवंत होने से पहले समीक्षा क़तार में रुकता है। और छह महीने बाद कोष अच्छा है या नहीं, यह चढ़ाना नहीं — ख़ाली जगहें सूची तय करती है, जहाँ इंसान को सौंपी गई हर बातचीत अपने आप दर्ज होती है।

अपने data पर बॉट train करने की हर गाइड एक ही जगह ख़त्म होती है: फ़ाइल चढ़ाना कीजिए, प्रगति bar देखिए, अब बॉट को पता है। आसान आधा हिस्सा यहीं ख़त्म होता है।

कोष की एक ईमानदार ख़ासियत कोई चढ़ाना screen नहीं दिखाती: जिन सवालों को वह cover नहीं करता, वे अदृश्य हैं। वे तब मिलते हैं जब ग्राहक पूछता है और काम का कुछ वापस नहीं आता। इसलिए यह लेख कोष के बारे में है: उसमें क्या डालें, अंदर उस सामग्री का क्या होता है, और बिना-जवाब सवाल ज़्यादा कीमती क्यों हैं। शुरू करने से पहले एक बात जान लेना ठीक रहेगा: कोष सहायक का इकलौता स्रोत नहीं है। ऑर्डर की स्थिति, ट्रैकिंग, ग्राहक की बुकिंग, आपका कैटलॉग और काम के घंटे आपकी दुकान से जीवंत पढ़े जाते हैं, और इनके लिए कोई प्रवेश नहीं चाहिए। सहायक बातचीत में कैसा बर्ताव करता है, इसके लिए देखें Telegram पर AI ग्राहक सहायता

आठ चीज़ें जो आप इसमें डाल सकते हैं

स्रोतकिस काम के लिएIngest cost
वेबसाइटएक डोमेन के 10 pages तक crawl15 क्रेडिट
Paste किया पाठएक block में copy होने वाली नीति5 क्रेडिट
CSVजोड़े जो आप पहले लिख चुके हैंमुफ़्त
PDFManuals, शर्तें, spec sheets30 क्रेडिट
DOCXवही चीज़, Word रूप में30 क्रेडिट
YouTube वीडियोएक बार रिकॉर्ड किया walkthrough10 क्रेडिट
आवाज़ फ़ाइलजवाब जो सिर्फ़ आपके दिमाग़ में हैंहर शुरू हुई minute के 5 क्रेडिट
हाथ से प्रवेशवही जवाब जो बार-बार टाइप करते हैंमुफ़्त

CSV और हाथ से प्रविष्टियाँ मुफ़्त हैं क्योंकि कुछ generate नहीं होता — जोड़े पहले से लिखे हैं। बाकी सब एक model से गुज़रता है जो सामग्री पढ़कर जोड़े निकालता है; आप उसी pass के पैसे देते हैं।

Notion pages का importer लिखा हुआ है पर चालू नहीं: उसे एक अलग जोड़ चाहिए जो अभी जुड़ी नहीं है, और ऐप में उसकी tile उसी के साथ दिखती है। तब तक पन्ना निर्यात करके उसे पाठ की तरह paste कर दीजिए।

हर स्रोत पर ceilings लागू हैं: crawl अधिकतम 10 pages तक जाता है, एक ingest करीब 30,000 tokens पढ़कर रुकता है, PDF और DOCX 10 MB तक, आवाज़ 25 MB और 30 minutes तक। 400 पन्नों का हाथ से पूरा नहीं जाएगा — और चाहिए भी नहीं, क्योंकि ग्राहक के काम का हिस्सा शायद छह पन्ने है।

कीमतें अलग हैं क्योंकि काम अलग है

यह tiers वाली दाम सूची नहीं, नीचे चल रहे काम का आकार ऊपर दिखना है।

Paste किया पाठ 5 क्रेडिट का है और कुछ सौ शब्दों का। PDF 30 का — इसलिए नहीं कि documents premium सुविधा हैं, बल्कि इसलिए कि एक document पूरी input ceiling भर सकता है। वही extraction pass, पर दसियों गुना ज़्यादा पाठ के साथ।

आवाज़ अकेला स्रोत है जिसकी कीमत अवधि से तय होती है, हर शुरू हुई minute के 5 क्रेडिट, क्योंकि पढ़ना शुरू होने से पहले पूरा एक अतिरिक्त कदम सिर्फ़ यहीं चाहिए: recording transcribe करनी पड़ती है, और उसकी लागत सिर्फ़ लंबाई पर निर्भर है। दस minute की आवाज़ 50 क्रेडिट; वही सामग्री पाठ में paste हो तो 5। यह बोलने की सज़ा नहीं, अतिरिक्त कदम की कीमत है।

YouTube बीच में 10 पर: audio process नहीं होता, published transcript पाठ की तरह लिया जाता है, पर transcripts लंबे होते हैं। वेबसाइट 15 का, क्योंकि वह extraction से पहले एक बाहरी crawl जोड़ता है।

Free योजना पर — एक स्रोत और महीने के 30 क्रेडिट — अकेला PDF पूरा महीना खा जाता है। अगर जवाब कहीं लिखे हैं, तो CSV शून्य लागत का है। सिर्फ़ इसलिए कि वही फ़ाइल desktop पर थी, 100 पन्नों का कैटलॉग चढ़ाना उन्हीं छह जवाबों तक का सबसे महंगा रास्ता है।

चढ़ाना और पहले जवाब के बीच

Extraction. सामग्री सवाल-जवाब जोड़ों में बदलता है, हर जोड़ा सामान्य सवाल, उत्पाद description, नियम या अन्य के रूप में tag होता है। अनुवाद है, नकल नहीं: 40 पन्नों का document ग्यारह जोड़े दे सकता है।

समीक्षा. AI ने जो निकाला वह inactive आता है, समीक्षा क़तार में, और मंज़ूरी तक किसी को जवाब नहीं देता। CSV अकेला अपवाद — वे जोड़े आपने खुद लिखे।

Deduplication. जिन जोड़ों का सवाल पहले से है, वे चुपचाप हट जाते हैं। इससे अलग, एक duplicate finder उन जीवंत प्रविष्टियाँ को दिखाता है जो अर्थ में 0.85 या उससे ज़्यादा मिलती हैं — वे करीबी जुड़वाँ जिन्हें exact matching नहीं पकड़ता, जैसे एक ही भेजाई नियम जो दो बार अलग शब्दों में आया।

Indexing. मंज़ूर प्रविष्टियाँ embedding क़तार में जाती हैं, जिसे एक worker हर 15 seconds में batches में खाली करता है। यही कदम खोज को शब्दों नहीं, अर्थ पर चलाता है, और किसी भी भाषा में: “कब पहुँचेगा” वह भेजाई प्रवेश ढूँढ़ लेता है जिसमें यह वाक्यांश है ही नहीं, और एक भाषा में पूछा सवाल दूसरी भाषा में लिखी प्रवेश तक पहुँच जाता है।

Retrieval. ग्राहक लिखता है तो model के सामने पूरा कोष नहीं, सबसे करीबी 5 प्रविष्टियाँ रखी जाती हैं। बीच में विषय बदले तो सहायक एक और targeted खोज से 5 तक और ला सकता है।

इससे दो बातें निकलती हैं। हर प्रवेश ऐसे लिखें कि अकेली टिके: जो जवाब सिर्फ़ पड़ोसी के साथ समझ आता है, वह अक्सर पड़ोसी बिना पहुँचेगा। और बड़ा कोष अपने आप बेहतर नहीं: 300 धुँधली प्रविष्टियाँ में सही 5 का ऊपर आना 60 पैनी प्रविष्टियाँ से कठिन है।

कोष में जिनकी जगह ही नहीं

यहाँ सबसे महंगी ग़लती ख़राब चढ़ाना नहीं है — वह लिखना है जो सहायक पहले से देख सकता है।

ऑर्डर की स्थिति, भुगतान की हालत, पहुँचाना का तरीक़ा, ट्रैकिंग संख्या, ग्राहक का ऑर्डर इतिहास, उसकी आने वाली बुकिंग, किसी सर्विस के ख़ाली समय-खाने, अभी कैटलॉग में क्या है और आपके काम के घंटे क्या हैं — यह सब सवाल के वक़्त आपकी दुकान से जीवंत पढ़ा जाता है। “ऑर्डर 312 शुक्रवार को जाएगा” वाली प्रवेश शुक्रवार बीतते ही बासी हो जाती है। सहायक एक बुकिंग रद्द भी कर सकता है और callback की अनुरोध भी ले सकता है — दोनों तभी जब ग्राहक confirm दबाए, और इसके लिए भी कोष में कुछ लिखने की ज़रूरत नहीं।

तो कोष अपनी जगह वहीं कमाता है जो कोई रिकॉर्ड रख ही नहीं सकता: रिफ़ंड की अवधि और उसके अपवाद, डिलीवरी असल में कैसे चलती है, पार्सल लेने से मना कर दिया तो क्या होगा, दो मिलते-जुलते प्रोडक्ट में फ़र्क़, और दोबारा बेचने पर warranty बचती है या नहीं।

ख़ाली जगहें सूची ही वह हिस्सा है जो जुड़ता जाता है

यही वह तंत्र है जहाँ तक “चढ़ाना किया, हो गया” वाली guides नहीं पहुँचतीं। जब सहायक कोष से भरोसे के साथ जवाब नहीं दे पाता, वह सुधार नहीं करता: बातचीत इंसान को सौंपता है और ख़ाली जगहें सूची में एक लाइन लिख देता है। हर सौंपी गई बातचीत, अपने आप, एक ही जगह।

उस लाइन में क्या होगा, यह जगह पर निर्भर है: बॉट की चैट से वह सहायक का अपना छोटा नोट है कि उसने क्यों हार मानी, 200 अक्षर तक; Telegram Business की चैट से वह ग्राहक का संदेश ही है। दोनों हाल में सूची दोहराव के लिए पढ़ी जाती है, हर लाइन की शब्दावली के लिए नहीं।

वह सूची कोष की कमी का इकलौता ईमानदार नक्शा है, क्योंकि उसे ग्राहकों के असली सवाल लिखते हैं, आपके अनुमान नहीं। कोई पहले से नहीं भाँपता कि लोग पूछेंगे कि दोबारा बेचने पर warranty बचती है या नहीं। पर तीसरी बार ख़ाली जगहें में दिखने पर जगह पता होती है।

छूटा जवाब AI से भी मसौदा करा सकते हैं, 2 क्रेडिट में। वह कोष में जो पहले से है उसे पढ़कर उसी सामग्री पर टिका जोड़ा सुझाता है, और जीवंत होने से पहले आप उसे मंज़ूर या edit करते हैं। जब सामग्री से जवाब नहीं बनता, तो गढ़ने के बजाय कारण सहित साफ़ “यहाँ इतना काफ़ी नहीं” लौटता है।

असली चक्र यह है: अधूरा कोष चालू करें, ग्राहकों को किनारों से टकराने दें, और दोहराते ख़ाली जगहें भरें। एक महीने की यह मेहनत ऐसा कोष देती है जो असली ग्राहकों से गढ़ा हो, न कि उनकी कल्पना से।

Extraction क्या लिखने से इनकार करता है

Non-answers सीधे ख़ारिज होते हैं: “आपकी ज़रूरत पर निर्भर”, “हमसे संपर्क करें”, “हर मामले में अलग तय होता है”। यह पाठ है, information नहीं; इससे भरा कोष ऐसा सहायक देता है जो मददगार लगता है, हल कुछ नहीं करता।

जल्दी बासी होने वाले तथ्य जानबूझकर छूटते हैं — कीमतें, तारीख़ें, आज स्टॉक है या नहीं। ये बदलते हैं और कोष साथ नहीं बदलता; भरोसे से कही ग़लत कीमत जवाब न होने से ज़्यादा नुकसान करती है।

और जो सामग्री में शब्दशः नहीं है, वह प्रवेश नहीं बनता। बिना तथ्यों वाला marketing पन्ना दीजिए, तो बहुत कम जोड़े मिलेंगे या शून्य — ख़राबी नहीं: उस पन्ना पर ग्राहक को बताने लायक कुछ था ही नहीं।

यह कहाँ सही औज़ार नहीं रह जाता

  • यह खोज है, विवेक नहीं। सहायक आपके documents और आपकी दुकान के records पढ़ता है। ऐसा कुछ पूछिए जिसमें खोज नहीं, विवेक चाहिए — सही नतीजा इंसान को सौंपना है, जवाब नहीं।
  • सामग्री नहीं तो जवाब नहीं। कोई तथ्य कभी लिखा ही नहीं गया और किसी रिकॉर्ड में भी नहीं है, तो कोई स्रोत उसे नहीं गढ़ता। कमी मान लेना ईमानदार क़दम है, ख़ाली जगहें सूची इसीलिए है।
  • मोलभाव और विवादित मामलों में इंसान चाहिए। Discounts, शिकायतें, और वह सब जहाँ जवाब इस पर टिका है कि पूछ कौन रहा है।
  • नियमन वाले विषय — कानूनी, चिकित्सा, वित्तीय। इन्हें जानबूझकर हाथ से रखिए: वहाँ अंदाज़न जवाब सुविधा नहीं, जोखिम है।
  • बिना देखभाल कोष पुराना पड़ता है। स्रोत खुद को दोबारा नहीं पढ़ते: re-sync एक बटन है, और वह उतने ही क्रेडिट दोबारा लेता है।

अब क्या करें

  • जो पहले से लिखा है, उससे शुरू करें। CSV मुफ़्त है और बिना समीक्षा के तुरंत जीवंत होता है।
  • जो दुकान पहले से जानती है, वह मत लिखिए। ऑर्डर की स्थिति, ट्रैकिंग, बुकिंग, समय-खाने, काम के घंटे और कैटलॉग जीवंत पढ़े जाते हैं।
  • सब एक साथ नहीं, एक स्रोत डालें। छोटे batch पर extraction आँकना आसान है।
  • समीक्षा क़तार पढ़ें। आधा ख़ारिज करना सामान्य और स्वस्थ नतीजा है।
  • हफ़्ते में एक बार ख़ाली जगहें देखें। वह आपकी सामग्री योजना है, जिसे ख़रीदार लिखते हैं।

सहायक उस कोष को बातचीत में कैसे इस्तेमाल करता है, यह दूसरा आधा हिस्सा है: Telegram पर AI ग्राहक सहायता। उत्पाद नज़रिया AI सहायता पर है; और अगर ग्राहकों के सवाल अभी नहीं आ रहे, Telegram पर कैसे बेचें से शुरू करें।

लोग आमतौर पर क्या पूछते हैं

पाठ फ़ाइल के अलावा ज्ञान-कोष में और क्या डाला जा सकता है?
आठ स्रोत types हैं: वेबसाइट crawl, paste किया हुआ पाठ, तैयार सवाल-जवाब जोड़ों वाली CSV, PDF, DOCX, YouTube वीडियो, आवाज़ recording, और वे प्रविष्टियाँ जो आप खुद टाइप करते हैं।
PDF process करना पाठ paste करने से महंगा क्यों है?
क्योंकि काम सचमुच अलग है। Paste किया पाठ 5 क्रेडिट का है और आम तौर पर कुछ सौ शब्दों का होता है, जबकि PDF या DOCX 30 क्रेडिट का है क्योंकि एक document पूरी 30,000 टोकन की input ceiling भर सकता है। आवाज़ हर शुरू हुई minute के 5 क्रेडिट लेता है, क्योंकि audio को पढ़ने से पहले transcribe करना पड़ता है। तैयार जोड़ों वाली CSV बिल्कुल मुफ़्त है, क्योंकि उस पर कोई model चलता ही नहीं।
निकाले गए जवाब क्या तुरंत जीवंत हो जाते हैं?
नहीं। AI ने जो कुछ निकाला वह inactive हालत में समीक्षा क़तार में आता है और आपकी मंज़ूरी तक वहीं रहता है। एकमात्र अपवाद CSV है: वे जोड़े तुरंत जीवंत होते हैं, क्योंकि उन्हें आपने खुद लिखा है।
जब ग्राहक ऐसा कुछ पूछे जो कोष में नहीं है तो क्या होता है?
सहायक अंदाज़ा नहीं लगाता। वह बातचीत इंसान को सौंप देता है और ख़ाली जगहें सूची में एक लाइन गिरती है, ताकि आप देख सकें कि कोष कहाँ ख़त्म होता है और उसे भर सकें। बॉट की चैट से वह लाइन सहायक का अपना छोटा नोट होती है कि उसने क्यों हार मानी; Telegram Business में वहाँ ग्राहक का संदेश ही रहता है।
क्या हर सवाल के लिए प्रवेश चाहिए, ऑर्डर की स्थिति के लिए भी?
नहीं, और यही सबसे आम फ़ालतू मेहनत है। दुकान का जीवंत डेटा सहायक खुद पढ़ता है: ऑर्डर की स्थिति और ट्रैकिंग, ग्राहक के ऑर्डर और बुकिंग, कैटलॉग, ख़ाली समय-खाने, काम के घंटे। कोष उसके लिए है जो किसी रिकॉर्ड में नहीं होता: रिफ़ंड के नियम, डिलीवरी कैसे काम करती है, दो प्रोडक्ट में फ़र्क़ क्या है।