Entry № 080
Vision Transformer (ViT)
(ViT)ဗီဂျင်း ထရန်စဖော်မာ (Vision Transformer / ViT)
Advanced
Computer Vision
Deep Learning
Curriculum progress
#80 / 100
V
Vision Transformer (ViT) — Concept plate
ဗီဂျင်း ထရန်စဖော်မာ (Vision Transformer / ViT) — Vision Transformer (ViT) ဆိုတာ စာသားအတွက် သုံးတဲ့ Transformer နည်းကို ရုပ်ပုံအတွက် ယူသုံးလိုက်တာ။ ဓာတ်ပုံကို ကွက်ကလေးတွေ (patch) အဖြစ် ဖြတ်ပြီး၊ အဲဒီ patch တွေကို 'စကားလုံး' တွေလို သဘောထားကာ Transformer ရဲ့ attention နဲ့ ဘယ် patch တွေ ဆက်စပ်နေလဲ ကြည့်တယ်။ CNN မသုံးဘဲ ရုပ်ပုံကို နားလည်တာပါ။
Vision Transformer (ViT) ဆိုတာ စာသားအတွက် သုံးတဲ့ Transformer နည်းကို ရုပ်ပုံအတွက် ယူသုံးလိုက်တာ။ ဓာတ်ပုံကို ကွက်ကလေးတွေ (patch) အဖြစ် ဖြတ်ပြီး၊ အဲဒီ patch တွေကို 'စကားလုံး' တွေလို သဘောထားကာ Transformer ရဲ့ attention နဲ့ ဘယ် patch တွေ ဆက်စပ်နေလဲ ကြည့်တယ်။ CNN မသုံးဘဲ ရုပ်ပုံကို နားလည်တာပါ။
