Basis pengetahuan AI untuk bot Telegram: isinya (2026)
Delapan jenis sumber, berapa biaya prosesnya dan kenapa berbeda, apa yang terjadi antara unggahan dan jawaban pertama, dan kenapa daftar celah lebih penting.
Ringkasnya. Basis pengetahuan menjawab tepat sejauh ia punya jawaban, tidak satu kata lebih jauh — tapi ia hanya separuh dari yang dipakai asisten; separuh lainnya adalah data langsung toko kamu. AdminHub menerima delapan jenis sumber, dari penelusuran situs sampai catatan suara, dan menagih berbeda untuk tiap jenis karena pekerjaannya memang berbeda: 5 kredit untuk teks tempel, 30 untuk PDF, 5 per menit yang dimulai untuk audio, nol untuk CSV yang sudah kamu punya. Semua yang ditarik AI menunggu di antrean tinjauan sebelum aktif. Dan yang menentukan bagus atau tidaknya basis enam bulan lagi bukan unggahannya, melainkan daftar celah, tempat setiap penyerahan ke manusia tercatat otomatis.
Hampir semua panduan tentang melatih bot dengan data sendiri berhenti di titik yang sama: unggah berkas, tunggu bilah progres, bot kini tahu. Persis di situlah separuh yang mudah berakhir.
Basis punya satu sifat jujur yang tak ditampilkan layar unggahan: pertanyaan yang tidak tercakup itu tak terlihat. Kamu menemukannya saat pelanggan bertanya dan tak ada yang berguna kembali. Jadi tulisan ini tentang basisnya sendiri: apa yang bisa diisikan, apa yang terjadi pada materi itu di dalam, dan kenapa pertanyaan tanpa jawaban lebih berharga daripada yang terjawab. Satu hal perlu diketahui sejak awal: basis bukan satu-satunya sumber asisten. Status pesanan, resi, jadwal pelanggan, katalog, dan jam buka dibaca langsung dari tokomu, dan tak satu pun butuh entri. Soal bagaimana asisten berperilaku dalam percakapan hidup, lihat dukungan pelanggan dengan AI di Telegram.
Delapan hal yang bisa kamu isikan
| Sumber | Untuk apa | Biaya proses |
|---|---|---|
| Situs web | Menelusuri hingga 10 halaman satu domain | 15 kredit |
| Teks tempel | Aturan yang bisa disalin sekali blok | 5 kredit |
| CSV | Pasangan yang sudah kamu tulis | gratis |
| Manual, syarat, lembar spesifikasi | 30 kredit | |
| DOCX | Sama saja, dalam bentuk Word | 30 kredit |
| Video YouTube | Panduan yang sekali kamu rekam | 10 kredit |
| Berkas suara | Jawaban yang hanya ada di kepalamu | 5 kredit per menit dimulai |
| Entri manual | Satu jawaban yang selalu kamu ketik ulang | gratis |
CSV dan entri manual gratis karena tidak ada yang dihasilkan: pasangannya sudah ada. Sisanya melewati model yang membaca materi dan menarik pasangan tanya-jawab, dan lintasan itulah yang kamu bayar.
Pengimpor halaman Notion sudah ditulis tetapi belum dinyalakan: ia butuh integrasi terpisah yang belum terhubung, dan ubinnya baru muncul di aplikasi bersama integrasi itu. Sampai saat itu, ekspor halamannya dan tempel sebagai teks.
Ada plafon yang berlaku untuk sumber mana pun: penelusuran mengikuti paling banyak 10 halaman, satu proses membaca sekitar 30.000 token lalu berhenti, PDF dan DOCX dibatasi 10 MB, suara 25 MB dan 30 menit. Manual 400 halaman tidak akan masuk utuh, dan memang tidak perlu: bagian yang dibutuhkan pelanggan mungkin hanya enam halaman.
Harganya berbeda karena pekerjaannya berbeda
Ini bukan daftar tarif berjenjang, melainkan bentuk pekerjaan yang menyembul ke permukaan.
Teks tempel 5 kredit dan biasanya beberapa ratus kata. PDF 30, bukan karena dokumen itu fitur premium, melainkan karena satu dokumen sanggup mengisi seluruh plafon masukan. Lintasan ekstraksi yang sama, dengan teks puluhan kali lebih banyak masuk ke dalamnya.
Suara adalah satu-satunya sumber yang dihargai per durasi, 5 kredit per menit yang dimulai, karena hanya ia yang menuntut satu langkah tambahan penuh sebelum pembacaan bisa dimulai: rekaman harus ditranskrip, dan biaya itu bergantung pada panjang dan tidak pada hal lain. Sepuluh menit suara sama dengan 50 kredit; isi yang sama ditempel sebagai teks hanya 5. Itu bukan denda karena berbicara, melainkan harga langkah tambahannya.
YouTube berada di angka 10, di tengah: tidak ada audio yang diproses karena transkrip yang sudah terbit diambil sebagai teks, tetapi transkrip itu panjang. Situs web 15 karena menambahkan penelusuran eksternal sebelum ekstraksi.
Di paket gratis, dengan satu sumber dan 30 kredit sebulan, satu PDF menghabiskan sebulan penuh. Kalau jawabanmu sudah tertulis di suatu tempat, CSV berbiaya nol. Mengunggah katalog 100 halaman hanya karena berkas itu yang ada di layar adalah jalur termahal menuju enam jawaban yang sama.
Antara unggahan dan jawaban pertama
Ekstraksi. Materi dibaca dan diubah menjadi pasangan tanya-jawab, masing-masing ditandai sebagai pertanyaan umum, deskripsi produk, aturan, atau lainnya. Ini penerjemahan, bukan penyalinan: dokumen 40 halaman wajar saja menghasilkan sebelas pasang.
Tinjauan. Semua yang ditarik AI tiba dalam keadaan nonaktif, di antrean tinjauan, dan tidak menjawab siapa pun sampai kamu setujui. CSV satu-satunya pengecualian, dengan alasan pasangan itu kamu sendiri yang menulis.
Deduplikasi. Pasangan yang pertanyaannya sudah ada dibuang diam-diam di pintu masuk. Terpisah dari itu, pencari duplikat menampilkan entri aktif yang kemiripan maknanya 0,85 atau lebih: si kembar dekat yang tak tertangkap pencocokan persis, seperti satu aturan pengiriman yang datang dua kali dengan kata berbeda.
Pengindeksan. Entri yang disetujui masuk antrean vektorisasi, dan pekerja mengurasnya per kelompok setiap 15 detik. Langkah inilah yang membuat pencarian bekerja berdasarkan makna, bukan kata, dan dalam bahasa apa pun: “kapan sampai” menemukan entri pengiriman yang sama sekali tidak memakai frasa itu, dan pertanyaan dalam satu bahasa menemukan entri yang ditulis dalam bahasa lain.
Pengambilan. Saat pelanggan menulis, 5 entri terdekat diletakkan di depan model, bukan seluruh basis. Kalau orangnya berganti topik di tengah obrolan, asisten bisa mencari sekali lagi secara terarah dan menarik hingga 5 entri lagi.
Dua hal mengikuti dari angka itu. Tulis tiap entri agar berdiri sendiri: jawaban yang hanya masuk akal berdampingan dengan tetangganya akan sering datang tanpa tetangga itu. Dan basis yang lebih besar tidak otomatis lebih baik: di antara 300 entri kabur, 5 yang tepat lebih sulit muncul daripada di antara 60 entri tajam.
Yang sama sekali tak perlu masuk basis
Kesalahan termahal di sini bukan unggahan yang buruk, melainkan menuliskan hal yang sebenarnya bisa dicari sendiri oleh asisten.
Status pesanan, keadaan pembayaran, cara pengiriman, nomor resi, riwayat pesanan pelanggan, jadwal terdekatnya, slot kosong untuk sebuah layanan, apa yang sekarang ada di katalog, dan berapa jam buka kamu: semuanya dibaca langsung dari tokomu pada saat pertanyaan datang. Entri berbunyi “pesanan 312 dikirim Jumat” basi begitu Jumat lewat. Asisten juga bisa membatalkan jadwal dan menerima permintaan dihubungi balik, keduanya baru setelah pelanggan menekan tombol konfirmasi — dan untuk itu pun tak ada yang perlu ditulis ke basis.
Jadi basis membayar dirinya pada semua yang tak bisa disimpan sebuah catatan: masa pengembalian dan pengecualiannya, bagaimana pengiriman benar-benar bekerja, apa yang terjadi kalau paket ditolak, beda dua produk yang mirip, apakah garansi tetap berlaku setelah dijual kembali.
Daftar celah adalah bagian yang menumpuk
Inilah mekanisme yang tak pernah dicapai panduan bergaya “unggah lalu selesai”. Ketika asisten tak bisa menjawab dengan yakin dari basis, ia tidak berimprovisasi: ia menyerahkan percakapan ke manusia dan menuliskan satu baris ke daftar celah. Setiap penyerahan, tercatat otomatis, di satu tempat.
Isi baris itu bergantung pada sisinya: dari obrolan bot, itu catatan singkat asisten sendiri tentang kenapa ia menyerah, dibatasi 200 karakter; dari obrolan Telegram Business, itu pesan pelanggannya sendiri. Bagaimanapun, daftar itu dibaca untuk pengulangan, bukan untuk kalimat satu per satu.
Daftar itu satu-satunya peta jujur tentang apa yang kurang, karena yang menulisnya pertanyaan pelanggan yang nyata, bukan tebakanmu tentang mereka. Tak ada yang menebak lebih dulu bahwa orang akan bertanya apakah garansi tetap berlaku setelah dijual kembali. Tetapi pada kemunculan ketiga di daftar celah, kamu tahu persis tempatnya.
Jawaban yang hilang juga bisa kamu minta didraf AI, seharga 2 kredit. Ia membaca isi basis yang ada lalu mengusulkan pasangan yang bersandar pada materi itu, dan kamu menyetujui atau menyuntingnya sebelum tayang. Kalau materinya tidak menopang jawaban, yang kembali adalah “di sini belum cukup” beserta alasannya, bukan karangan.
Jadi lingkaran sesungguhnya begini: rilis basis yang belum lengkap, biarkan pelanggan menabrak tepinya, isi celah yang berulang. Sebulan begitu menghasilkan basis yang dibentuk pelanggan nyata, bukan bayanganmu tentang mereka.
Yang ditolak dicatat oleh ekstraksi
Bukan-jawaban ditolak mentah-mentah: “tergantung kebutuhan Anda”, “hubungi kami”, “dibahas per kasus”. Itu teks, bukan informasi, dan basis yang penuh begitu melahirkan asisten yang terdengar ramah tetapi tak menyelesaikan apa pun.
Fakta berumur pendek sengaja dilewati: harga tertentu, tanggal, ada tidaknya stok hari ini. Semua itu berubah tanpa basisnya ikut berubah, dan harga keliru yang disebut dengan yakin lebih merusak daripada jawaban yang tak ada.
Dan tidak ada yang menjadi entri kalau tidak ada secara harfiah di materinya. Beri halaman promosi tanpa fakta, hasilnya sangat sedikit pasangan atau nol. Itu bukan kerusakan: halaman itu memang tak punya apa pun untuk disampaikan ke pelanggan.
Ketika ini bukan alat yang tepat
- Ini pencarian, bukan pertimbangan. Asisten membaca dokumenmu dan catatan tokomu. Tanyakan hal yang menuntut pertimbangan alih-alih pencarian, dan hasil yang benar adalah penyerahan ke manusia, bukan sebuah jawaban.
- Tanpa materi tak ada jawaban. Kalau sebuah fakta tak pernah ditulis dan tak ada catatan yang menyimpannya, tak ada jenis sumber yang memunculkannya. Mengakui celah itu langkah jujur, dan untuk itulah daftar celah ada.
- Negosiasi langsung dan kasus yang diperdebatkan butuh manusia. Diskon, keluhan, semua yang jawabannya bergantung pada siapa yang bertanya.
- Topik yang diatur ketat: hukum, medis, keuangan. Itu sengaja dipegang manual. Di sana jawaban yang kira-kira adalah risiko, bukan kenyamanan.
- Basis yang tak dirawat menua. Sumber tidak membaca ulang dirinya sendiri: sinkronisasi ulang adalah tombol yang kamu tekan, dan biayanya kredit yang sama lagi.
Yang bisa dilakukan sekarang
- Mulai dari yang sudah tertulis. CSV gratis dan langsung aktif, tanpa antrean tinjauan.
- Jangan menuliskan yang sudah diketahui toko. Status pesanan, resi, jadwal, slot kosong, jam buka, dan katalog dibaca langsung.
- Isi satu sumber, bukan semuanya sekaligus. Mutu ekstraksi lebih mudah dinilai pada kumpulan kecil.
- Baca antrean tinjauan. Menolak separuhnya adalah hasil yang normal dan sehat.
- Periksa celah tiap pekan. Daftar itu adalah rencana kontenmu, ditulis oleh orang yang membeli darimu.
Bagaimana asisten memakai basis itu dalam percakapan adalah separuh lainnya, di dukungan pelanggan dengan AI di Telegram. Untuk tampilan produknya lihat dukungan AI; kalau pertanyaan pelanggan belum datang, mulailah dari cara berjualan di Telegram.
Yang biasanya ditanyakan
- Selain file teks, apa lagi yang bisa dimasukkan ke basis pengetahuan?
- Ada delapan jenis sumber: penelusuran situs web, teks yang ditempel, CSV berisi pasangan tanya-jawab yang sudah jadi, PDF, DOCX, video YouTube, rekaman suara, dan entri yang kamu ketik sendiri.
- Kenapa memproses PDF lebih mahal daripada menempel teks?
- Karena pekerjaannya memang berbeda. Teks tempel berbiaya 5 kredit dan biasanya hanya beberapa ratus kata; PDF atau DOCX berbiaya 30 karena satu dokumen bisa mengisi seluruh plafon 30.000 token. Suara berbiaya 5 kredit per menit yang dimulai, sebab audio harus ditranskrip dulu sebelum apa pun bisa dibaca. CSV yang sudah jadi tidak berbiaya sama sekali, karena tidak ada model yang berjalan di atasnya.
- Apakah jawaban hasil ekstraksi langsung aktif?
- Tidak. Semua yang ditarik AI masuk ke antrean tinjauan dalam keadaan nonaktif sampai kamu menyetujuinya. Satu-satunya pengecualian adalah CSV: pasangan itu langsung aktif, karena kamu sendiri yang menulisnya.
- Apa yang terjadi kalau pelanggan menanyakan hal yang tidak ada di basis?
- Asisten tidak menebak. Ia menyerahkan percakapan ke manusia, dan satu baris jatuh ke daftar celah, sehingga kamu tahu di mana basis berhenti dan bisa melengkapinya. Dari obrolan bot, baris itu adalah catatan singkat asisten sendiri tentang kenapa ia menyerah; di Telegram Business, yang tersimpan adalah pesan pelanggan.
- Apakah setiap pertanyaan butuh entri, termasuk status pesanan?
- Tidak, dan inilah pekerjaan berlebih yang paling sering terjadi. Data langsung toko dibaca asisten sendiri: status pesanan dan resi, pesanan dan jadwal pelanggan, katalog, slot kosong, jam buka. Basis dipakai untuk hal yang tak tersimpan di catatan mana pun: aturan pengembalian, cara pengiriman bekerja, beda dua produk.