Kamus AI
Istilah · GenAI & LLM

Vision Model

Model yang bisa memahami gambar atau video, termasuk objek, teks, dan hubungan visual.

GenAI & LLMLevel Pemula
Penjelasan

Apa itu Vision Model

Model yang bisa memahami gambar atau video, termasuk objek, teks, dan hubungan visual. Hubungkan istilah ini dengan Multimodal dan Text-to-Image agar kamu melihat perannya di sistem, bukan sekadar menghafal definisi.

Contoh

Kelihatan seperti apa di praktik

Dalam praktik GenAI & LLM, Vision Model biasanya muncul saat kamu bekerja dengan Multimodal, lalu perlu memastikan hasilnya tetap cocok dengan tujuan kerja.

Kenapa relevan

Kenapa istilah ini penting

Vision Model penting karena membantu kamu memakai model generatif dengan batas input, biaya, dan kualitas output yang lebih jelas.

Hati-hati

Yang sering keliru dipahami

Mengira Vision Model sama dengan Multimodal. Keduanya berkaitan, tetapi perannya berbeda dalam alur kerja AI.