BotConnector
Masuk Workspace Buka Aplikasi
Nol Biaya Cloud · 100% Privat · Di Perangkat Sendiri

Jalankan AI di komputer Anda sendiri.
Tanpa biaya komputasi cloud.

BotConnector AI Lokal mencocokkan model terbuka, tingkat quantization, dan runtime dengan spesifikasi komputer Anda. Jaga data tetap berada di perangkat dengan eksekusi loopback, sambil tetap menikmati alur kerja terpadu bersama model cloud.

100% Privasi Tanpa Egress Data
Rp 0 Biaya Inferensi Cloud
Quantization Sesuai Kapasitas Hardware
Mendukung Ollama & Runtime OpenAI-Compatible
ADVISOR PERANGKAT KERAS

Sesuaikan model dengan kapasitas workstation Anda

Menjalankan AI lokal membutuhkan keseimbangan antara jumlah parameter model, quantization (bit depth), dan kapasitas RAM/VRAM yang tersedia. Pilih profil perangkat Anda di bawah ini untuk melihat rekomendasi optimal.

Tier 1 · RAM 8 GB
Ringan · Cepat

Laptop Standar & Thin Clients

Cocok untuk laptop harian dengan memori 8 GB terpadu atau workstation standar.

Qwen 2.5 Coder 3B Q4_K_M · ~2.2 GB RAM
LFM 2.5 2.6B Q4_K_M · ~1.8 GB RAM
Llama 3.2 3B Instruct Q4_K_M · ~2.4 GB RAM
  • ✓ Generasi token instan (40–70 token/detik)
  • ✓ Tanpa risiko memori paging / komputer hang
  • ✓ Ideal untuk penulisan cepat, autocompletion kode, dan ringkasan
Tier 3 · 32 GB+ / Dedicated GPU
Power Workstation

Workstation Performa Tinggi & GPU

Komputer dengan RAM 32 GB+ atau NVIDIA RTX 3080/4070/4090 (12GB–24GB VRAM).

Qwen 2.5 32B Instruct Q4_K_M · ~20.5 GB RAM
Command R+ 104B / Llama 3.3 70B Q3_K_S · ~36 GB RAM
Mistral Small 24B Q5_K_M · ~16.8 GB RAM
  • ✓ Kecerdasan kelas frontier berjalan offline di perangkat
  • ✓ Akselerasi tensor GPU melalui CUDA, Metal, atau Vulkan
  • ✓ Sesi rekayasa otonom multi-agent berskala besar
ARSITEKTUR & PRIVASI

Batas Eksekusi Lokal yang Ketat

Ketika Anda memilih AI Lokal, BotConnector berkomunikasi dengan runtime lokal Anda melalui alamat loopback standar. Kode, dokumen, dan prompt Anda tidak pernah keluar ke infrastruktur cloud.

Nol Egress Data (Zero Egress)

Inferensi berjalan pada alamat loopback (127.0.0.1:11434 untuk Ollama atau 127.0.0.1:1234 untuk LM Studio). Bobot model, state memori, dan buffer prompt tersimpan aman hanya di RAM/VRAM Anda.

Bebas Tagihan Bulanan Cloud

Inferensi lokal berjalan sepenuhnya memanfaatkan komputasi dan listrik perangkat keras Anda. Jalankan jutaan token secara offline tanpa biaya komputasi tambahan atau takut kehabisan kuota.

Peralihan Hybrid yang Mulus

Beralih antara model Qwen lokal untuk kode rahasia proyek internal dan model DeepSeek / GLM cloud untuk konteks raksasa—semuanya dalam satu sesi terminal BCCLI atau Web App yang sama.

PANDUAN CEPAT

Tiga langkah menjalankan AI Lokal dengan BotConnector

1

Jalankan Runtime Lokal

Instal dan jalankan Ollama atau LM Studio di perangkat Anda.

ollama run qwen2.5-coder:14b
2

Deteksi di BCCLI

BCCLI secara otomatis mendeteksi Ollama pada port loopback 127.0.0.1:11434.

bccli models
3

Mulai Alur Kerja Anda

Buka sesi coding interaktif atau jalankan tugas langsung dengan model lokal Anda.

bccli -m local/qwen2.5-coder:14b
Siap menjalankan model lokal yang sesuai dengan perangkat Anda?