12/01/2026
📦 Data Engineering with AWS 101: Amazon S3 ဆိုတာ ဘာလဲ? 🚀
Data Engineering လောကထဲ ခြေလှမ်းစလိုက်ပြီဆိုတာနဲ့ "S3" ဆိုတဲ့ စကားလုံးကို နေ့တိုင်း ကြားရပါလိမ့်မယ်။ S3 ဆိုတာ ဘာလဲ? ဘာလို့ အရေးကြီးတာလဲ? Beginner တွေအတွက် ရှင်းပြပေးပါမယ်။
🔹 Amazon S3 ဆိုတာ ဘာလဲ?
S3 ရဲ့ အရှည်က "Simple Storage Service" ပါ။ ရိုးရိုးရှင်းရှင်း ပြောရရင်တော့ Internet ပေါ်မှာရှိတဲ့ "အကန့်အသတ်မရှိတဲ့ ဂိုဒေါင်ကြီး" တစ်ခုပါပဲ။ ကျွန်တော်တို့ Computer ထဲက Hard Drive ဒါမှမဟုတ် Google Drive လိုမျိုးပဲ Data တွေကို သိမ်းထားလို့ရတဲ့နေရာပါ။
🔹 S3 မှာ ဘာတွေ သိမ်းလို့ရလဲ?
Data Engineering မှာ S3 ကို Data Lake အဖြစ် အသုံးများပါတယ်။
Structured Data (Excel, CSV, SQL files)
Unstructured Data (Images, Videos, Logs, JSON)
ဘာမဆို သိမ်းထားလို့ ရပါတယ်။
🔹 Data Engineer တစ်ယောက်အနေနဲ့ သိထားသင့်တဲ့ S3 Concept (၃) ခု
၁။ Buckets (ပုံးများ):
S3 ထဲမှာ Data သိမ်းဖို့ ပထမဆုံး "Bucket" တစ်ခု ဆောက်ရပါတယ်။ ဒါကို Folder အကြီးကြီး တစ်ခုလို့ မှတ်ယူနိုင်ပါတယ်။ (မှတ်ချက် - Bucket နာမည်ဟာ တစ်ကမ္ဘာလုံးမှာ ထပ်လို့မရပါဘူး)။
၂။ Objects (ပစ္စည်းများ):
Bucket ထဲကို ထည့်လိုက်တဲ့ ဖိုင်မှန်သမျှကို "Object" လို့ ခေါ်ပါတယ်။ Object တစ်ခုမှာ Data ကိုယ်တိုင်ရယ်၊ အဲဒီဖိုင်အကြောင်း ဖော်ပြတဲ့ Metadata ရယ် ပါဝင်ပါတယ်။
၃။ Storage Classes:
Data ကို ခဏခဏ ပြန်ကြည့်မှာလား၊ ဒါမှမဟုတ် သိမ်းပဲ သိမ်းထားမှာလားပေါ်မူတည်ပြီး ဈေးနှုန်းသက်သာအောင် ရွေးချယ်လို့ရပါတယ်။
S3 Standard: အမြဲကြည့်မယ့် data အတွက်။
S3 Glacier: သိမ်းရုံပဲသိမ်းထားပြီး ကြာမှတစ်ခါ ပြန်ကြည့်မယ့် data အတွက် (ဈေးအရမ်းသက်သာပါတယ်)။
🔹 ဘာလို့ S3 က နာမည်ကြီးတာလဲ?
Unlimited Scalability: Data ဘယ်လောက်များများ သိမ်းသိမ်း ဆံ့ပါတယ်။
Durability (ခိုင်မာမှု): AWS က သင့် data တွေ ပျောက်မသွားဖို့ 99.999999999% (11 nines) အထိ အာမခံပါတယ်။
Cost Effective: သုံးသလောက်ပဲ ပေးရလို့ စရိတ်သက်သာပါတယ်။
💡 My 2026 Insight:
ကျွန်တော်တို့ Data Solution တည်ဆောက်တဲ့အခါ Raw Data တွေကို S3 ထဲ အရင်ပစ်ထည့်ထားလေ့ရှိပါတယ်။ ပြီးမှ AWS Glue လို Tool မျိုးနဲ့ သန့်စင်ပြီး Snowflake သို့မဟုတ် Redshift ထဲ ပို့တာပါ။ S3 ကို ပိုင်နိုင်တာဟာ Cloud Data Architecture ရဲ့ အခြေခံအုတ်မြစ်ကို ပိုင်နိုင်တာနဲ့ အတူတူပါပဲ။
နောက်နေ့တွေမှာလည်း AWS Service တွေအကြောင်း တစ်ခုချင်းစီ ဆက်ပြောပြသွားပါမယ်။