AI-For-Beginners/translations/ur/lessons/4-ComputerVision/12-Segmentation
leestott c6463675e6 🌐 Update translations via Co-op Translator 2025-08-28 04:44:09 +00:00
..
lab 🌐 Update translations via Co-op Translator 2025-08-28 04:44:09 +00:00
README.md 🌐 Update translations via Co-op Translator 2025-08-26 12:09:18 +00:00
SemanticSegmentationPytorch.ipynb 🌐 Update translations via Co-op Translator 2025-08-28 04:44:09 +00:00
SemanticSegmentationTF.ipynb 🌐 Update translations via Co-op Translator 2025-08-28 04:44:09 +00:00

README.md

تقسیم

ہم نے پہلے آبجیکٹ ڈیٹیکشن کے بارے میں سیکھا تھا، جو ہمیں تصویر میں موجود اشیاء کو ان کے باؤنڈنگ باکسز کی پیش گوئی کے ذریعے تلاش کرنے کی اجازت دیتا ہے۔ تاہم، کچھ کاموں کے لیے ہمیں صرف باؤنڈنگ باکسز کی ضرورت نہیں ہوتی بلکہ اشیاء کی زیادہ درست لوکلائزیشن کی ضرورت ہوتی ہے۔ اس کام کو تقسیم کہا جاتا ہے۔

لیکچر سے پہلے کا کوئز

تقسیم کو پکسل کی درجہ بندی کے طور پر دیکھا جا سکتا ہے، جہاں تصویر کے ہر پکسل کے لیے ہمیں اس کی کلاس کی پیش گوئی کرنی ہوتی ہے (بیک گراؤنڈ بھی ایک کلاس ہوتی ہے)۔ تقسیم کے دو اہم الگورتھم ہیں:

  • سیمینٹک تقسیم صرف پکسل کی کلاس بتاتی ہے اور ایک ہی کلاس کی مختلف اشیاء کے درمیان فرق نہیں کرتی۔
  • انسٹینس تقسیم کلاسز کو مختلف انسٹینسز میں تقسیم کرتی ہے۔

انسٹینس تقسیم کے لیے، یہ بھیڑیں مختلف اشیاء ہیں، لیکن سیمینٹک تقسیم کے لیے تمام بھیڑیں ایک کلاس کے طور پر دکھائی جاتی ہیں۔

تصویر اس بلاگ پوسٹ سے لی گئی ہے۔

تقسیم کے لیے مختلف نیورل آرکیٹیکچرز موجود ہیں، لیکن ان سب کی ساخت ایک جیسی ہوتی ہے۔ ایک لحاظ سے، یہ اس آٹو اینکوڈر سے مشابہ ہے جس کے بارے میں آپ نے پہلے سیکھا تھا، لیکن اصل تصویر کو ڈی کنسٹرکٹ کرنے کے بجائے، ہمارا مقصد ایک ماسک کو ڈی کنسٹرکٹ کرنا ہے۔ اس طرح، تقسیم کا نیٹ ورک درج ذیل حصے رکھتا ہے:

  • اینکوڈر ان پٹ تصویر سے فیچرز نکالتا ہے۔
  • ڈی کوڈر ان فیچرز کو ماسک تصویر میں تبدیل کرتا ہے، جس کا سائز اور چینلز کی تعداد کلاسز کی تعداد کے مطابق ہوتی ہے۔

تصویر اس اشاعت سے لی گئی ہے۔

ہم خاص طور پر اس نقصان کے فنکشن کا ذکر کریں گے جو تقسیم کے لیے استعمال ہوتا ہے۔ جب کلاسیکل آٹو اینکوڈرز استعمال کیے جاتے ہیں، تو ہمیں دو تصاویر کے درمیان مماثلت کو ماپنے کی ضرورت ہوتی ہے، اور ہم اس کے لیے میین اسکوائر ایرر (MSE) استعمال کر سکتے ہیں۔ تقسیم میں، ہدف ماسک تصویر میں ہر پکسل کلاس نمبر کی نمائندگی کرتا ہے (تیسری جہت کے ساتھ ون-ہاٹ-اینکوڈڈ)، لہذا ہمیں درجہ بندی کے لیے مخصوص نقصان کے فنکشنز استعمال کرنے کی ضرورت ہوتی ہے - کراس اینٹروپی نقصان، جو تمام پکسلز پر اوسط کیا جاتا ہے۔ اگر ماسک بائنری ہو - بائنری کراس اینٹروپی نقصان (BCE) استعمال کیا جاتا ہے۔

ون-ہاٹ اینکوڈنگ ایک طریقہ ہے جس کے ذریعے کلاس لیبل کو کلاسز کی تعداد کے برابر لمبائی والے ویکٹر میں اینکوڈ کیا جاتا ہے۔ اس مضمون میں اس تکنیک کے بارے میں مزید جانیں۔

طبی امیجنگ کے لیے تقسیم

اس سبق میں، ہم تقسیم کو عملی طور پر دیکھیں گے، جہاں نیٹ ورک کو طبی تصاویر میں انسانی نیوی (جسے تل بھی کہا جاتا ہے) کو پہچاننے کے لیے تربیت دی جائے گی۔ ہم PH2 ڈیٹا بیس کے ڈرمو سکوپی تصاویر کو بطور تصویر ذریعہ استعمال کریں گے۔ اس ڈیٹا سیٹ میں تین کلاسز کی 200 تصاویر شامل ہیں: عام نیوی، غیر معمولی نیوی، اور میلانوما۔ تمام تصاویر کے ساتھ ایک ماسک بھی شامل ہے جو نیوی کو نمایاں کرتا ہے۔

یہ تکنیک خاص طور پر اس قسم کی طبی امیجنگ کے لیے موزوں ہے، لیکن آپ اور کون سی حقیقی دنیا کی ایپلیکیشنز کا تصور کر سکتے ہیں؟

navi

تصویر PH2 ڈیٹا بیس سے لی گئی ہے۔

ہم ایک ماڈل کو تربیت دیں گے تاکہ کسی بھی نیوی کو اس کے بیک گراؤنڈ سے الگ کر سکے۔

✍️ مشقیں: سیمینٹک تقسیم

نیچے دیے گئے نوٹ بکس کھولیں تاکہ مختلف سیمینٹک تقسیم آرکیٹیکچرز کے بارے میں مزید جان سکیں، ان کے ساتھ کام کرنے کی مشق کریں، اور انہیں عملی طور پر دیکھیں۔

لیکچر کے بعد کا کوئز

نتیجہ

تقسیم ایک بہت طاقتور تکنیک ہے جو تصویر کی درجہ بندی کو باؤنڈنگ باکسز سے آگے لے جا کر پکسل لیول کی درجہ بندی تک لے جاتی ہے۔ یہ طبی امیجنگ سمیت دیگر ایپلیکیشنز میں استعمال ہونے والی تکنیک ہے۔

🚀 چیلنج

جسم کی تقسیم تصاویر میں لوگوں کے ساتھ کیے جانے والے عام کاموں میں سے ایک ہے۔ دیگر اہم کاموں میں اسکلیٹن ڈیٹیکشن اور پوز ڈیٹیکشن شامل ہیں۔ اوپن پوز لائبریری کو آزمائیں تاکہ دیکھ سکیں کہ پوز ڈیٹیکشن کیسے استعمال کیا جا سکتا ہے۔

جائزہ اور خود مطالعہ

یہ ویکیپیڈیا مضمون اس تکنیک کے مختلف ایپلیکیشنز کا ایک اچھا جائزہ پیش کرتا ہے۔ انسٹینس تقسیم اور پیناپٹک تقسیم کے ذیلی شعبوں کے بارے میں مزید جانیں۔

اسائنمنٹ

اس لیب میں، کگل سے انسانی جسم کی تقسیم کے لیے Segmentation Full Body MADS Dataset استعمال کریں۔

ڈس کلیمر:
یہ دستاویز AI ترجمہ سروس Co-op Translator کا استعمال کرتے ہوئے ترجمہ کی گئی ہے۔ ہم درستگی کے لیے کوشش کرتے ہیں، لیکن براہ کرم آگاہ رہیں کہ خودکار ترجمے میں غلطیاں یا عدم درستگی ہو سکتی ہیں۔ اصل دستاویز کو اس کی اصل زبان میں مستند ذریعہ سمجھا جانا چاہیے۔ اہم معلومات کے لیے، پیشہ ور انسانی ترجمہ کی سفارش کی جاتی ہے۔ اس ترجمے کے استعمال سے پیدا ہونے والی کسی بھی غلط فہمی یا غلط تشریح کے لیے ہم ذمہ دار نہیں ہیں۔