26 May 2026
Replymessage unavailable
Kyk-nya beda kak. Soalnya yg satu nge-pull dari ollama, yg satunya lagi dari Huggingface hub.
Dita Aji PratamaKyk-nya beda kak. Soalnya yg satu nge-pull dari ollama, yg satunya lagi dari Huggingface hub.
belum tentu, kalau cuma tempat numpang taruh file
Replymessage unavailable
Ollama jg runtimenya make llama.cpp yg emg lebih performant dipanding pytorch yg dipake transformers
Usamah Jundi AbdillahOllama jg runtimenya make llama.cpp yg emg lebih performant dipanding pytorch yg dipake transformers
berarti llama.cpp memang lebih bagus kah?
Irvan Putraada definisi quantization di artikel ini @DitaAjiPratama 😅
Cek sendiri deh kak source nya. Memang namanya ga ada buntutannya 🙂
Dita Aji PratamaKuantisasi itu apa?
Bobot modelnya kan biasanya float32 ato float16, dipindah jadi representasi yg bitnya lebih dikit kayak int8, int4
lebih dikit bit= model lebih kecil dan operasi lebih kenceng. Tradeoffnya kemampuan modelnya turun
Usamah Jundi AbdillahBobot modelnya kan biasanya float32 ato float16, dipindah jadi representasi yg bitnya lebih dikit kayak int8, int4
lebih dikit bit= model lebih kecil dan operasi lebih kenceng. Tradeoffnya kemampuan modelnya turun
Kalau yg cepet int4 bukan? saya setting pakai float16. Karena saya ga tau juga gunanya buat apa 🥲
Dita Aji PratamaCek sendiri deh kak source nya. Memang namanya ga ada buntutannya 🙂
ya ngapain, aku percaya kamu kok, cuma kan penamaan bisa saja kurang 😃
Dita Aji PratamaKalau yg cepet int4 bukan? saya setting pakai float16. Karena saya ga tau juga gunanya buat apa 🥲
gunanya buat lebih kecil dan lebih cepat, tapi kualitas modelnya bisa saja berkurang
Replymessage unavailable
bisa lebih cepet lg kalo make yg lebih dikit bitnya, tapi ya makin bodoh modelnya
int8 paling bagus tradeoffnya kalo nyari yg masih mendekati model aslinya
Dita Aji PratamaBit sama Parameter hal yg berbeda kan ya?
Parameter itu ya bobot2nya (bisa juga ngacu ke hal lain), setiap bobot direpresentasiin dengan sejumlah bit, kan komputer ngolahnya binary
ya tipe data biasa aja, float32, float16, etc etc
Irvan Putrayuk2 meetup Jakarta 😁
Kak, yg komunitas build ai itu ada ketemuannya juga kah tiap bulan? atau kyk ada basecamp-nya mungkin