FreeToken menjalankan model MoE 290B di PC konsumen
2026-09-21 · #AI
FreeToken adalah mesin inference edge-native yang dirancang menyajikan model Mixture-of-Experts berskala frontier di perangkat keras pribadi. Ia menyatukan GPU, CPU, dan memori host menjadi satu platform elastis untuk mencapai kecepatan interaktif pada model 290 miliar parameter ke atas. Tersedia aplikasi desktop untuk Windows dan Linux yang menangani setup dan penyetelan awal.
Layak dilirik kalau Anda punya perangkat keras konsumen kelas atas dan butuh akses lokal ke model MoE besar tanpa klaster datacenter. Proyeknya masih muda dan bersandar pada abstraksi perangkat keras yang rumit, jadi siapkan diri untuk gesekan konfigurasi. Ini bukan pengganti langsung untuk tumpukan serving kelas produksi seperti vLLM di lingkungan cloud.
sumber: https://github.com/FlashML-org/FreeToken
versi bahasa Inggris: https://home.wordpress.com/2026/09/21/freetoken-runs-290b-moe-models-on-consumer-pcs/
$ cd ~/