Kamus AI
Istilah · GenAI & LLM
Vision Model
Model yang bisa memahami gambar atau video, termasuk objek, teks, dan hubungan visual.
Apa itu Vision Model
Model yang bisa memahami gambar atau video, termasuk objek, teks, dan hubungan visual. Hubungkan istilah ini dengan Multimodal dan Text-to-Image agar kamu melihat perannya di sistem, bukan sekadar menghafal definisi.
Kelihatan seperti apa di praktik
Dalam praktik GenAI & LLM, Vision Model biasanya muncul saat kamu bekerja dengan Multimodal, lalu perlu memastikan hasilnya tetap cocok dengan tujuan kerja.
Kenapa istilah ini penting
Vision Model penting karena membantu kamu memakai model generatif dengan batas input, biaya, dan kualitas output yang lebih jelas.
Yang sering keliru dipahami
Mengira Vision Model sama dengan Multimodal. Keduanya berkaitan, tetapi perannya berbeda dalam alur kerja AI.