Liquid AI merilis model multimodal d1 untuk tugas klasifikasi
Liquid AI meluncurkan d1-3B dan d1-omni-600M, dua model decision yang dirancang untuk tugas klasifikasi dan ekstraksi dalam satu forward pass. Model ini tidak menggunakan generative token output sehingga mampu memproses data pada hardware edge seperti Jetson AGX Orin dengan latensi di bawah 50 milidetik. Versi 3B menangani input teks, vision, dan audio, sementara versi 600M ditujukan untuk lingkungan dengan keterbatasan resource. Model ini layak diuji untuk kebutuhan structured data pipeline pada edge guna menghindari overhead generative LLM. Namun, penggunaan custom inference architecture memerlukan trust_remote_code yang menciptakan ketergantungan pada implementasi spesifik mereka. Perlu diingat bahwa model ini bukan chatbot, sehingga tidak cocok digunakan sebagai general-purpose conversational agent. sumber: huggingface.co/open-d1 my other side: setyadi.com