
Enam tahun lalu, semasa saya di AINNA, saya pernah jumpa setup serupa: notebook murah yang menjalankan 'enjin chatbot' menerusi sambungan Chrome pada Lubuntu.
Tapi pada 2026, China yang ubah permainan.
Hari ini, dari sudut operasi, anda boleh deploy beribu-ribu instance VPS, setiap satunya jalankan detached system sendiri dan diurus oleh ejen AI, dengan kos lebih rendah daripada notebook tersebut enam tahun lalu.
Bayangkan ini:
USD10–12 setahun untuk satu instance VPS yang mampu jalankan ratusan lightweight detached system, kebanyakannya microservices PHP.
Sistem-sistem ini boleh dibina, dipantau, diselenggara, diuji, dan diuruskan oleh lima jenis ejen AI yang berbeza.
Tambah kira-kira USD20–30 sebulan untuk penggunaan LLM, dan keseluruhan infrastruktur boleh beroperasi 24 jam sehari, tanpa henti.
Ekonominya jadi lebih menarik kalau anda sudah ada mesin GPU - ramai permainanrs dan juga syarikat kecil di Malaysia ada.
Jalankan vLLM dengan LLM tempatan yang cukup berkemampuan, sambungkan instance VPS anda secara selamat, dan kos model inference boleh jadi hampir sifar selain daripada elektrik dan perkakasan.
VPS murah.
Inference tempatan.
Ejen AI autonomi.
Ratusan detached system.
Operasi berterusan.
Ini bukan lagi sekadar bina chatbot untuk perkhidmatan pelanggan.
Ia tentang membina tenaga kerja digital yang teragih dan autonomi dengan kos amat rendah - sesuatu yang pasukan operasi perlu ambil tahu.
Dan cuma soal masa sebelum pihak kerajaan, korporat, rangkaian jenayah, dan organisasi ketenteraan mula 'weaponize' arkitektur ini.
Teknologi ini semakin murah.
Soalan sebenar bukan lagi sama ada ia boleh dilakukan.
Soalannya: siapa yang akan deploy dahulu, dan untuk tujuan apa?
Hehe.