Jalankan AI di komputer Anda sendiri.
Tanpa biaya komputasi cloud.
BotConnector AI Lokal mencocokkan model terbuka, tingkat quantization, dan runtime dengan spesifikasi komputer Anda. Jaga data tetap berada di perangkat dengan eksekusi loopback, sambil tetap menikmati alur kerja terpadu bersama model cloud.
Sesuaikan model dengan kapasitas workstation Anda
Menjalankan AI lokal membutuhkan keseimbangan antara jumlah parameter model, quantization (bit depth), dan kapasitas RAM/VRAM yang tersedia. Pilih profil perangkat Anda di bawah ini untuk melihat rekomendasi optimal.
Laptop Standar & Thin Clients
Cocok untuk laptop harian dengan memori 8 GB terpadu atau workstation standar.
- ✓ Generasi token instan (40–70 token/detik)
- ✓ Tanpa risiko memori paging / komputer hang
- ✓ Ideal untuk penulisan cepat, autocompletion kode, dan ringkasan
Workstation Rekayasa Standar
Apple Silicon M-Series (16GB) atau PC dengan GPU 6GB–8GB VRAM / RAM 16GB.
- ✓ Refactoring repository multi-file & analisis logika mendalam
- ✓ Budget context window 16k–32k yang nyaman
- ✓ Kemampuan penalaran tinggi dan dukungan tool-use kompleks
Workstation Performa Tinggi & GPU
Komputer dengan RAM 32 GB+ atau NVIDIA RTX 3080/4070/4090 (12GB–24GB VRAM).
- ✓ Kecerdasan kelas frontier berjalan offline di perangkat
- ✓ Akselerasi tensor GPU melalui CUDA, Metal, atau Vulkan
- ✓ Sesi rekayasa otonom multi-agent berskala besar
Batas Eksekusi Lokal yang Ketat
Ketika Anda memilih AI Lokal, BotConnector berkomunikasi dengan runtime lokal Anda melalui alamat loopback standar. Kode, dokumen, dan prompt Anda tidak pernah keluar ke infrastruktur cloud.
Nol Egress Data (Zero Egress)
Inferensi berjalan pada alamat loopback (127.0.0.1:11434 untuk Ollama atau 127.0.0.1:1234 untuk LM Studio). Bobot model, state memori, dan buffer prompt tersimpan aman hanya di RAM/VRAM Anda.
Bebas Tagihan Bulanan Cloud
Inferensi lokal berjalan sepenuhnya memanfaatkan komputasi dan listrik perangkat keras Anda. Jalankan jutaan token secara offline tanpa biaya komputasi tambahan atau takut kehabisan kuota.
Peralihan Hybrid yang Mulus
Beralih antara model Qwen lokal untuk kode rahasia proyek internal dan model DeepSeek / GLM cloud untuk konteks raksasa—semuanya dalam satu sesi terminal BCCLI atau Web App yang sama.
Tiga langkah menjalankan AI Lokal dengan BotConnector
Jalankan Runtime Lokal
Instal dan jalankan Ollama atau LM Studio di perangkat Anda.
ollama run qwen2.5-coder:14b
Deteksi di BCCLI
BCCLI secara otomatis mendeteksi Ollama pada port loopback 127.0.0.1:11434.
bccli models
Mulai Alur Kerja Anda
Buka sesi coding interaktif atau jalankan tugas langsung dengan model lokal Anda.
bccli -m local/qwen2.5-coder:14b