Lewati ke konten

Knowledge Base & RAG

Knowledge Base adalah fondasi bot AI Anda. Unggah dokumen nyata organisasi Anda — bot belajar dari data ini dan menjawab pertanyaan menggunakan pipeline RAG (Retrieval-Augmented Generation) yang cerdas.

Knowledge Base — Document List

  1. Buka Knowledge Base di menu sebelah kiri.

  2. Klik Upload Document dan pilih file (PDF, DOCX, atau TXT).

  3. Tunggu sistem memproses dan mengindeks dokumen. Status akan menampilkan Ready saat selesai.

  4. Uji bot di panel Test Bot di sebelah kanan untuk memverifikasi bahwa bot dapat menjawab pertanyaan dari dokumen yang diunggah.

Upload Document Dialog

Selain unggahan file, Anda dapat membuat entri knowledge base langsung dari teks:

  1. Klik Create from Text
  2. Masukkan Title untuk referensi yang mudah
  3. Tempel atau ketik konten di editor teks
  4. Klik Save — sistem akan langsung mengindeks

Ini berguna untuk FAQ, kebijakan, atau konten apa pun yang ingin Anda tulis langsung tanpa file.

Saat pengguna mengajukan pertanyaan, sistem memprosesnya melalui pipeline RAG 4 langkah:

  1. Hybrid Search — Mencari di seluruh dokumen menggunakan pencarian kata kunci dan pencarian vektor semantik secara bersamaan, memastikan tidak ada konten relevan yang terlewat.

  2. Query Rewriting — Menulis ulang pertanyaan pengguna agar lebih tepat dan ramah pencarian, meningkatkan akurasi pengambilan data meskipun pertanyaan tidak jelas.

  3. Re-ranking — Menilai dan mengurutkan ulang potongan dokumen yang diambil berdasarkan relevansi, sehingga konten paling relevan diteruskan ke model AI terlebih dahulu.

  4. Generate Answer — Model AI menghasilkan jawaban dalam bahasa alami yang berlandaskan konten yang diambil, disertai referensi sumber.

FiturDeskripsi
Hybrid SearchMenggabungkan pencarian kata kunci + vektor semantik untuk recall yang lebih tinggi
Query RewritingMerumuskan ulang pertanyaan pengguna secara otomatis untuk meningkatkan akurasi pengambilan data
Re-rankingRe-ranking cross-encoder untuk menampilkan potongan paling relevan
Smart Model RoutingMerutekan kueri ke model yang sesuai berdasarkan kompleksitas dan biaya

Kendalikan seberapa ketat bot tetap berada dalam knowledge base:

ModePerilaku
StrictBot hanya menjawab dari dokumen yang diunggah. Menolak menjawab jika tidak ada konten relevan yang ditemukan.
HybridBot terutama menggunakan knowledge base tetapi dapat melengkapi dengan pengetahuan umum bila diperlukan.
OpenBot menggunakan knowledge base sebagai konteks tetapi dapat menjawab secara bebas dari data pelatihannya.

Gunakan panel Test Bot untuk memverifikasi knowledge base Anda sebelum ditayangkan:

Test Bot Page

  • Ketik pertanyaan seperti yang dilakukan pengguna
  • Periksa apakah jawaban berlandaskan dokumen Anda
  • Gunakan tampilan Source untuk melihat potongan dokumen mana yang diambil bot
  • Sesuaikan mode guardrail dan uji ulang bila diperlukan

Perubahan pada knowledge base langsung berlaku di Test Bot — tidak perlu deployment ulang.

v1.6.0

KB Auto-Suggest

Fitur auto-suggest menganalisis pertanyaan yang tidak terjawab dari dasbor Analytics dan secara otomatis menghasilkan draf artikel knowledge base untuk mengisi kesenjangan konten:

  1. Sistem mengidentifikasi topik dari pertanyaan yang tidak terjawab yang tidak memiliki dokumen yang cocok
  2. Sistem menghasilkan dokumen draf dengan konten yang disarankan berdasarkan pola pertanyaan
  3. Draf muncul di bagian Analytics → Unanswered dengan lencana “Suggested Draft”
  4. Tinjau, edit, dan publikasikan draf untuk segera meningkatkan cakupan bot
v1.6.10

Pipeline RAG mendukung pengambilan data lintas bahasa — pengunjung dapat mengajukan pertanyaan dalam satu bahasa dan menerima jawaban yang bersumber dari dokumen yang ditulis dalam bahasa yang berbeda.

Ini bekerja melalui dua mekanisme:

  1. Terjemahan kueri — Layanan penulisan ulang kueri secara otomatis menerjemahkan kueri non-Inggris ke dalam bahasa Inggris sebelum mencari, sehingga dokumen berbahasa Inggris dapat ditemukan terlepas dari bahasa pengunjung.
  2. Jaring pencarian yang lebih luas — Saat reranker diaktifkan, sistem menggunakan ambang batas kemiripan awal yang lebih rendah untuk memastikan kueri lintas bahasa dan kolokial dengan kemiripan kosinus yang lebih rendah tetapi relevansi semantik yang tinggi tidak tersaring sebelum reranker dapat mengevaluasinya.

Tidak diperlukan konfigurasi — pencarian lintas bahasa diaktifkan secara default saat fitur penulisan ulang kueri dan re-ranking pipeline RAG aktif. Jika terjemahan kueri tidak tersedia, sistem kembali mencari dengan kueri asli. Peningkatan ini sangat terlihat bagi organisasi dengan knowledge base berbahasa Inggris yang melayani pengunjung multibahasa.