KinexaSupport

Menggunakan Ollama AI Self-hosted

Menggunakan Ollama AI Self-hosted

Apa itu Ollama?

Ollama adalah tool open-source untuk menjalankan large language model (LLM) secara lokal di server Anda sendiri. Kinexa mengintegrasikan Ollama sebagai provider AI self-hosted, memberikan Anda:

  • Tanpa biaya per request Tidak ada biaya API, tidak ada biaya token
  • Privasi data Data Anda tidak pernah meninggalkan server Anda
  • Kontrol penuh Pilih model dan konfigurasi Anda sendiri
  • Tanpa rate limit Hanya dibatasi oleh kapasitas hardware Anda

Model Ollama yang Tersedia

ModelParameterRAM DibutuhkanTerbaik Untuk
Qwen 2.57B8 GBGeneral purpose, multilingual (sangat baik untuk Bahasa Indonesia)
Llama 3.28B8 GBGeneral purpose, reasoning
Gemma 29B10 GBPengetahuan, ringkasan
Phi-33.8B4 GBRingan, respons cepat
Mistral7B8 GBMengikuti instruksi, coding

Kapan Menggunakan Ollama

Tier Free/Starter:

Ollama adalah provider AI default untuk paket Free dan Starter. Anda mendapat respons AI yang capable tanpa biaya per request.

Enterprise Dedicated:

Pelanggan Enterprise bisa men-deploy instance Ollama dedicated dengan model yang lebih besar (misal: Qwen 2.5 72B, Llama 3.1 70B) untuk AI self-hosted premium.

Cara Setup

Jika Anda di tier Free/Starter, Ollama sudah dikonfigurasi sebagai default. Untuk mengganti model:

  1. Buka Settings > AI > Provider
  2. Pilih Ollama (Self-hosted)
  3. Pilih model yang diinginkan dari dropdown
  4. Klik Simpan

Perubahan langsung berlaku untuk semua percakapan AI baru.

Tips

  • Qwen 2.5 direkomendasikan untuk bisnis Indonesia — memiliki dukungan multilingual yang sangat baik
  • Phi-3 adalah opsi tercepat jika kecepatan respons menjadi prioritas Anda
  • Untuk use case customer support, Qwen 2.5 atau Llama 3.2 memberikan kualitas terbaik
Apakah artikel ini membantu?

Butuh bantuan lebih lanjut? Hubungi tim support kami