- Asisten, bukan model
- Setiap asisten membawa endpoint OpenAI-compatible self-hosted miliknya sendiri, system prompt, dan persona. Pengguna memilih asisten, jadi satu pilihan sekaligus menentukan model, instruksinya, dan pengetahuan yang bisa ia jangkau.
- Chat streaming
- Jawaban datang token demi token dan dirender sebagai markdown. Jika modelnya mendukung, proses penalarannya tampil di blok yang bisa Anda tutup.
- ExA Insight RAG
- Ingestion, chunking, embedding, dan retrieval atas korpus yang disetujui, semuanya di dalam jaringan. Dataset dipetakan ke asisten, sehingga jawaban hanya menarik korpus yang memang menjadi hak asisten tersebut.
- Penelusuran sumber di chat
- Saat retrieval mengembalikan konteks, jawaban membawa sitasi bernomor dan daftar sumber yang bisa dibuka. Mengunduh sumber melewati pemeriksaan akses yang sama dengan retrieval-nya.
- Web Search Proxy
- Ketika pengetahuan on-premise belum cukup, arahkan pencarian lewat proxy self-hosted milik Anda. Penyedia pencarian cloud yang didukung sifatnya opsional, dan nonaktif sampai kebijakan Anda mengizinkan.
- ExA Insight MCP
- Asisten yang sama bisa memanggil tool dan backend yang disetujui lewat MCP — pencarian, API internal, dan konektor berikutnya — masing-masing dengan izin eksplisit.
- Mode percakapan
- Thread permanen menyimpan riwayat dan judul. Temporary chat tidak meninggalkan jejak, untuk eksplorasi sekali pakai.