Menggunakan Ollama AI Self-hosted
Menggunakan Ollama AI Self-hosted
Apa itu Ollama?
Ollama adalah tool open-source untuk menjalankan large language model (LLM) secara lokal di server Anda sendiri. Kinexa mengintegrasikan Ollama sebagai provider AI self-hosted, memberikan Anda:
- Tanpa biaya per request — Tidak ada biaya API, tidak ada biaya token
- Privasi data — Data Anda tidak pernah meninggalkan server Anda
- Kontrol penuh — Pilih model dan konfigurasi Anda sendiri
- Tanpa rate limit — Hanya dibatasi oleh kapasitas hardware Anda
Model Ollama yang Tersedia
| Model | Parameter | RAM Dibutuhkan | Terbaik Untuk |
|---|---|---|---|
| Qwen 2.5 | 7B | 8 GB | General purpose, multilingual (sangat baik untuk Bahasa Indonesia) |
| Llama 3.2 | 8B | 8 GB | General purpose, reasoning |
| Gemma 2 | 9B | 10 GB | Pengetahuan, ringkasan |
| Phi-3 | 3.8B | 4 GB | Ringan, respons cepat |
| Mistral | 7B | 8 GB | Mengikuti instruksi, coding |
Kapan Menggunakan Ollama
Tier Free/Starter:
Ollama adalah provider AI default untuk paket Free dan Starter. Anda mendapat respons AI yang capable tanpa biaya per request.
Enterprise Dedicated:
Pelanggan Enterprise bisa men-deploy instance Ollama dedicated dengan model yang lebih besar (misal: Qwen 2.5 72B, Llama 3.1 70B) untuk AI self-hosted premium.
Cara Setup
Jika Anda di tier Free/Starter, Ollama sudah dikonfigurasi sebagai default. Untuk mengganti model:
- Buka Settings > AI > Provider
- Pilih Ollama (Self-hosted)
- Pilih model yang diinginkan dari dropdown
- Klik Simpan
Perubahan langsung berlaku untuk semua percakapan AI baru.
Tips
- Qwen 2.5 direkomendasikan untuk bisnis Indonesia — memiliki dukungan multilingual yang sangat baik
- Phi-3 adalah opsi tercepat jika kecepatan respons menjadi prioritas Anda
- Untuk use case customer support, Qwen 2.5 atau Llama 3.2 memberikan kualitas terbaik