Model & Context

Buka di CMS

Halaman Model & Context berisi pengaturan yang memengaruhi AI model mana yang dipakai agent untuk percakapan, apa yang boleh dilampirkan user pada pesan mereka, dan seberapa banyak riwayat percakapan yang "diingat" agent.

Buka Conversation โ†’ Model & Context di sidebar kiri. CMS menempatkan halaman ini di bawah Conversation; dalam dokumentasi ini halaman tersebut termasuk tahap Menyempurnakan Kualitas Jawaban, karena pengaturan default sudah cocok untuk sebagian besar agent dan biasanya Anda baru mengubahnya untuk menyelesaikan masalah tertentu.


Sebelum memulai

  • Selesaikan dasar-dasarnya terlebih dahulu: Memberi Identitas pada Agent, Mengajari Agent Anda, dan Membentuk Percakapan.
  • Catat masalah yang ingin Anda selesaikan (misalnya "jawaban terlalu lambat", "user perlu mengirim foto", atau "agent lupa apa yang dibicarakan sebelumnya") dan beberapa pertanyaan uji yang menunjukkan masalah tersebut.

Model Capability

Conversation AI Model

AI model utama yang dipakai untuk semua percakapan dengan user. Model ini menangani setiap pesan yang dikirim user dan menghasilkan respons yang terlihat.

Model ini juga yang menjawab selama voice call Natural conversation, kecuali halaman Voice memilih Answering AI model yang berbeda.

Pilih berdasarkan pertimbangan antara kualitas respons, kecepatan, dan biaya:

PertimbanganPanduan
Membutuhkan akurasi tinggiPakai model paling mumpuni yang tersedia
Volume tinggi / sensitif terhadap biayaPakai model yang lebih kecil dan lebih cepat
Kebutuhan campuranNyalakan User to Change AI Model di bawah

Level model dan model +

Model bawaan Qlar tersedia dalam enam level, dari yang tercepat dan termurah sampai yang berpikir paling dalam. Pemilih model menampilkan deskripsi setiap model dan perkiraan rasio credit-nya, yaitu seberapa besar biayanya dibandingkan model lain.

ModelRasio creditPaling cocok untuk
Light1.5xBot FAQ, balasan otomatis, format sederhana; menjawab tanpa bernalar terlebih dahulu
Smart3xCustomer service sehari-hari, pemesanan, penjualan dasar
Analyst35xWorkflow terstruktur: form, orkestrasi API, otomatisasi berbasis aturan
Insight45xTanya jawab knowledge base dan support yang membutuhkan konteks
Thinker90xPenalaran kompleks dan bertahap: analisis data, pemeriksaan kepatuhan
Sage230xKeputusan strategis dengan taruhan tinggi

Setiap level juga punya versi +: Light+, Smart+, Analyst+, Insight+, Thinker+, Sage+. Model + adalah model yang sama, berpikir dengan cara yang persis sama, tetapi berjalan dengan Fast mode: jawabannya keluar sekitar 1,5 sampai 2 kali lebih cepat, dengan rasio credit dua kali lipat (Light+ 3x, Smart+ 6x, Analyst+ 70x, Insight+ 90x, Thinker+ 180x, Sage+ 460x). Pilih model + saat waktu tunggu penting (chat yang ramai, voice call), bukan untuk jawaban yang lebih baik. Saat beban tinggi, sebuah jawaban sesekali bisa berjalan dengan kecepatan normal; jawaban itu lalu ditagih dengan tarif normal. Pekerjaan di latar belakang seperti ringkasan dan training knowledge base tidak pernah memakai Fast mode, sehingga biayanya sama untuk kedua versi.

Enable User to Change AI Model

Mengizinkan end user berpindah antar AI model selama percakapan. Saat dinyalakan, pemilih model muncul di antarmuka chat.

Allowed Conversation AI Models

Hanya terlihat saat Enable User to Change AI Model menyala. Pilih model mana saja yang boleh dipilih user. User tidak bisa memilih model di luar daftar ini. Jika Allow Image Upload menyala, sertakan setidaknya satu model yang menerima gambar.

Model pertama dalam daftar menjadi default, yaitu model yang dipakai agent di awal setiap percakapan sebelum user memilih.

Enforce Thinking

Saat dinyalakan, AI diwajibkan bernalar tentang pendekatannya sebelum menghasilkan respons akhir. Ini meningkatkan kualitas jawaban untuk pertanyaan yang kompleks atau bertahap.

Gunakan ini untuk agent yang menangani analisis, troubleshooting, atau tugas apa pun yang membutuhkan penalaran cermat.

Konsekuensinya: proses berpikir menambah latensi. Respons muncul sedikit lebih lama.


Attachments

Pengaturan ini menentukan apa yang boleh dilampirkan user, baik di text chat maupun selama voice call immersive. Pengaturan ini ada di halaman ini karena bisa tidaknya sebuah gambar dibaca bergantung pada model yang dipilih di atas.

Allow Image Upload

Mengizinkan user melampirkan gambar (JPG, PNG, WEBP) pada pesan mereka. Di text chat, Conversation AI Model harus menerima input gambar; jika tidak (atau, saat pergantian model menyala, jika tidak ada satu pun model yang diizinkan yang menerimanya), halaman menampilkan peringatan dan user tidak bisa mengirim gambar di chat. Voice call Turn-by-turn tidak terpengaruh: style tersebut selalu membaca gambar. Dalam Natural conversation, gambar dikirim ke Answering AI model di halaman Voice, sehingga bisa tidaknya gambar dikirim dalam panggilan bergantung pada model tersebut; lihat Voice โ†’ Lampiran.

Allow Document/File Upload

Mengizinkan user melampirkan dokumen (PDF, TXT, MD). Teks dokumen diekstrak secara terpisah dari AI model (PDF hasil scan melalui OCR), sehingga pengaturan ini tidak dipengaruhi kemampuan model.

Kedua switch berlaku sama untuk chat dan voice call immersive. Matikan keduanya, maka input chat maupun voice call tidak menawarkan opsi lampiran.

Document Upload Restrictions

Field teks bebas tempat Anda menjelaskan apa yang tidak boleh diunggah user. Setiap file yang dilampirkan (gambar atau dokumen, di chat maupun dalam voice call) diperiksa terhadap teks ini saat diunggah, dan file yang melanggarnya ditolak beserta alasannya, sebelum sempat masuk ke percakapan.

Contoh pembatasan:

Cegah unggahan dokumen yang berisi informasi identitas pribadi seperti nomor KTP, nomor paspor, atau dokumen dengan foto seseorang. Blokir file yang berisi data keuangan sensitif seperti nomor kartu kredit atau detail rekening bank.

Biarkan field ini kosong untuk mengizinkan semua file yang didukung.


Context Window

Pengaturan ini mengontrol seberapa banyak riwayat percakapan yang "diingat" agent saat menyusun setiap respons.

Summarize Previous Answer

Saat dinyalakan, agent meringkas respons sebelumnya sebelum memasukkannya ke context window. Ini mengurangi jumlah token yang dipakai untuk merepresentasikan giliran sebelumnya, sehingga percakapan yang lebih panjang bisa muat dalam batas konteks model.

Gunakan ini untuk agent yang menangani percakapan panjang dengan banyak giliran.

Konsekuensinya: ringkasan bisa menghilangkan detail halus dari jawaban sebelumnya. Jika ketepatan dalam merujuk respons sebelumnya penting, biarkan pengaturan ini mati.

Keep Function Tools Answer

Saat dinyalakan, output dari tool eksternal atau function call (misalnya respons API, hasil query database) tetap disimpan di konteks percakapan untuk giliran lanjutan.

Gunakan ini bila user kemungkinan akan mengajukan pertanyaan lanjutan tentang data yang diambil oleh sebuah tool (misalnya "Bisa diurutkan berdasarkan tanggal?" setelah query database).

User Messages to Carry Over

Jumlah pesan user terbaru yang dimasukkan ke context window saat memulai segmen percakapan baru atau setelah pemisahan thread.

NilaiPerilaku
0Tidak ada riwayat yang dibawa ke segmen baru
10 (default)10 pesan user terakhir beserta responsnya disertakan
Nilai lebih tinggiKesinambungan lebih baik tetapi pemakaian token lebih tinggi

Atur nilai ini berdasarkan seberapa penting kesinambungan percakapan bagi agent Anda dan seberapa panjang percakapan pada umumnya.

Max Response Token

Jawaban terpanjang yang boleh ditulis agent, dalam token. 0 (default) mengikuti batas maksimum model itu sendiri. Nilai positif menghentikan respons secara paksa pada jumlah token tersebut, berguna untuk membatasi biaya, dengan risiko jawaban panjang terpotong.


Menyimpan perubahan

Klik Save setelah mengubah pengaturan apa pun. Publish agent Anda agar perubahan diterapkan ke end user.


Periksa hasilnya

Setelah menyimpan, klik tombol reload di panel preview di sisi kanan halaman untuk memulai percakapan baru, lalu ulangi pertanyaan uji yang sudah Anda catat. Bandingkan kecepatan dan kualitas jawabannya dengan sebelumnya. Jika Anda mengizinkan lampiran, coba kirim gambar atau dokumen dan pastikan agent bisa membacanya.

Preview menjalankan draft Anda. End user baru mendapatkan pengaturan model dan konteks yang baru setelah Anda publish. Lihat Preview dan Publish Perubahan.


Langkah berikutnya

  • Retrieval: atur cara agent mencari di knowledge Anda (langkah berikutnya).
  • Chat: bahasa, dikte, format, dan pengaturan percakapan teks lainnya.
  • Berbicara dengan Suara: voice call, termasuk lampiran selama panggilan immersive.

Mencari timezone default? Pengaturannya ada di Profile.