Myopic Bayesian Decision Theory for Batch Active Learning with Partial Batch Label Sampling
Hu, Mussmann
Over the past couple of decades, many active learning acquisition functions have been proposed, leaving practitioners with an unclear choice of which to use. Bayesian Decision Theory (BDT) offers a universal principle to guide decision-making. In this work, we derive BDT for (Bayesian) active learning in the myopic framework, where we imagine we only have one more point to label. This derivation leads to effective algorithms such as Expected Error Reduction (EER), Expected Predictive Information Gain (EPIG), and other algorithms that appear in the literature. Furthermore, we show that BAIT (active learning based on V-optimal experimental design) can be derived from BDT and asymptotic approximations. A key challenge of such methods is the difficult scaling to large batch sizes, leading to either computational challenges (BatchBALD) or dramatic performance drops (top-$B$ selection). Here, using a particular formulation of the decision process, we derive Partial Batch Label Sampling (ParBaLS) for the EPIG algorithm. We show experimentally for several datasets that ParBaLS EPIG gives superior performance for a fixed budget and Bayesian Logistic Regression on Neural Embeddings. Our code is available at https://github.com/ADDAPT-ML/ParBaLS.
academic
ব্যাচ অ্যাক্টিভ লার্নিংয়ের জন্য আংশিক ব্যাচ লেবেল স্যাম্পলিং সহ মায়োপিক বেইজিয়ান সিদ্ধান্ত তত্ত্ব
গত কয়েক দশকে অসংখ্য অ্যাক্টিভ লার্নিং অধিগ্রহণ ফাংশন প্রস্তাব করা হয়েছে, কিন্তু অনুশীলনকারীরা প্রায়শই উপযুক্ত পদ্ধতি নির্বাচন করতে অসুবিধা পান। বেইজিয়ান সিদ্ধান্ত তত্ত্ব (BDT) সিদ্ধান্ত গ্রহণের নির্দেশনা দেওয়ার জন্য একটি সর্বজনীন নীতি প্রদান করে। এই পেপারটি মায়োপিক কাঠামোর অধীনে (বেইজিয়ান) অ্যাক্টিভ লার্নিংয়ের জন্য BDT প্রকাশ করে, যেখানে অনুমান করা হয় যে শুধুমাত্র একটি অতিরিক্ত ডেটা পয়েন্ট লেবেল করার প্রয়োজন। এই প্রকাশনা কার্যকর অ্যালগরিদম তৈরি করে, যেমন প্রত্যাশিত ত্রুটি হ্রাস (EER), প্রত্যাশিত পূর্বাভাস তথ্য লাভ (EPIG) ইত্যাদি। অধিকন্তু, লেখকরা প্রমাণ করেছেন যে BAIT কে BDT এবং অ্যাসিম্পটোটিক অনুমান থেকে প্রকাশ করা যায়। এই ধরনের পদ্ধতির মূল চ্যালেঞ্জ হল বড় ব্যাচ আকারে স্কেল করা কঠিন, যা গণনামূলক চ্যালেঞ্জ (BatchBALD) বা কর্মক্ষমতা তীব্র হ্রাস (শীর্ষ-B নির্বাচন) সৃষ্টি করে। এই পেপারটি নির্দিষ্ট সিদ্ধান্ত প্রক্রিয়া সূত্রের মাধ্যমে EPIG অ্যালগরিদমের জন্য আংশিক ব্যাচ লেবেল স্যাম্পলিং (ParBaLS) পদ্ধতি প্রকাশ করে। পরীক্ষা-নিরীক্ষা দেখায় যে নির্দিষ্ট বাজেট এবং নিউরাল এমবেডিংয়ে বেইজিয়ান লজিস্টিক রিগ্রেশন সেটিংয়ের অধীনে, ParBaLS EPIG একাধিক ডেটাসেটে উৎকৃষ্ট কর্মক্ষমতা প্রদর্শন করে।
অ্যাক্টিভ লার্নিং বৃহৎ পরিমাণ অলেবেল করা ডেটা থেকে সবচেয়ে তথ্যপূর্ণ ডেটা নির্বাচন করার লক্ষ্য রাখে যাতে সীমিত লেবেলিং বাজেটের অধীনে মডেল কর্মক্ষমতা সর্বাধিক করা যায়। বিদ্যমান পদ্ধতিগুলির মধ্যে রয়েছে হিউরিস্টিক পদ্ধতি এবং সম্ভাব্য পদ্ধতি, কিন্তু স্পষ্ট নির্বাচন নির্দেশিকা নীতির অভাব রয়েছে।
ব্যবহারিক চাহিদা: আধুনিক মেশিন লার্নিংয়ে, ডেটা সাধারণত ব্যাচ আকারে লেবেল করা হয় বরং পৃথকভাবে নয়
পদ্ধতি নির্বাচনের অসুবিধা: বিদ্যমান অ্যালগরিদমগুলি ব্যাখ্যাযোগ্যতার অভাব রয়েছে, অনুশীলনকারীরা কখন এবং কোন অ্যালগরিদম কার্যকর তা নির্ধারণ করতে অসুবিধা পান
স্কেলেবিলিটি চ্যালেঞ্জ: বিদ্যমান পদ্ধতিগুলি বড় ব্যাচ আকারে গণনামূলক বা কর্মক্ষমতা সমস্যার সম্মুখীন হয়
বেইজিয়ান সিদ্ধান্ত তত্ত্বের মাধ্যমে একটি একীভূত তাত্ত্বিক কাঠামো প্রদান করা, বিদ্যমান অ্যালগরিদমের কাজের নীতি ব্যাখ্যা করা এবং ব্যাচ নির্বাচন কার্যকরভাবে পরিচালনা করতে পারে এমন নতুন পদ্ধতি প্রস্তাব করা।
ইনপুট ডোমেইন X, আউটপুট ডোমেইন Y এবং অলেবেল করা পুল ডেটাসেট D⊂X দেওয়া, লক্ষ্য হল T টি ব্যাচ S⊂D পুনরাবৃত্তিমূলকভাবে নির্বাচন করা, প্রতিটি ব্যাচ আকার |S|=B লেবেল করা, যাতে লেবেল করা সেটে প্রশিক্ষণের পরে পরীক্ষার ক্ষতি ন্যূনতম হয়।
চিত্র 2 টেবিলার ডেটাসেটে দেখায় যে ParBaLS পদ্ধতি সম্পূর্ণ শেখার প্রক্রিয়া জুড়ে সুবিধা বজায় রাখে, বিশেষত কম বাজেট সেটিংয়ে আরও উল্লেখযোগ্য কর্মক্ষমতা প্রদর্শন করে।
ParBaLS বনাম ParBaLS-MAP: সম্পূর্ণ ParBaLS সাধারণত শুধুমাত্র MAP লেবেল ব্যবহার করা সংস্করণের চেয়ে উন্নত
ব্যাচ আকার প্রভাব: বৃহত্তর ব্যাচ (B=20) এ ParBaLS এর সুবিধা আরও স্পষ্ট
একক পয়েন্ট বনাম ব্যাচ: পরিশিষ্ট পরীক্ষা দেখায় যে যদিও একক পয়েন্ট নির্বাচন (B=1) ভাল কর্মক্ষমতা প্রদান করে, ব্যাচ নির্বাচন ব্যবহারিক প্রয়োগে আরও দক্ষ
EER সরাসরি কর্মক্ষমতা মেট্রিক্স যেমন শূন্য-এক ক্ষতি এবং লগ সম্ভাবনা ক্ষতির উপর ফোকাস করে, আরও ভাল ব্যাখ্যাযোগ্যতা প্রদান করে। সম্পর্কিত কাজে হিউরিস্টিক পদ্ধতির সাথে সংমিশ্রণ এবং কম বাজেট পরিস্থিতিতে অভিযোজিত পদ্ধতি অন্তর্ভুক্ত।
ব্যাচ অ্যাক্টিভ লার্নিং পদ্ধতি (কিরশ এট আল., 2019, 2023)
প্রত্যাশিত ত্রুটি হ্রাস পদ্ধতি (রয় এবং ম্যাককলাম, 2001; মাসম্যান এট আল., 2022)
সামগ্রিক মূল্যায়ন: এটি অ্যাক্টিভ লার্নিং ক্ষেত্রে উল্লেখযোগ্য তাত্ত্বিক এবং ব্যবহারিক মূল্য সহ একটি পেপার। MBDT এর মাধ্যমে বিদ্যমান অ্যালগরিদম একীভূত করে এবং ব্যাচ নির্বাচন সমস্যা সমাধানের জন্য ParBaLS প্রস্তাব করে, এটি এই ক্ষেত্রে নতুন গবেষণা দিকনির্দেশনা প্রদান করে। যদিও গণনামূলক দক্ষতা এবং তাত্ত্বিক কঠোরতার ক্ষেত্রে উন্নতির অবকাশ রয়েছে, তবে এর অবদান উল্লেখযোগ্য।