යන්ත්‍ර ඉගෙනුම් ඇල්ගොරිතම ක්‍රියා කරන ආකාරය

යන්ත්‍ර ඉගෙනුම් ඇල්ගොරිතම ක්‍රියා කරන ආකාරය

යන්ත්‍ර ඉගෙනීම හෙවත් ML යනු පරිගණකවලට දත්ත වලින් ඉගෙන ගැනීමට සහ ඒ මත පදනම්ව තීරණ හෝ අනාවැකි ගැනීමට හැකියාව ලබා දෙන කෘතිම බුද්ධියේ (AI) ශාඛාවකි. යන්ත්‍ර ඉගෙනුම් ඇල්ගොරිතම ක්‍රියා කරන්නේ දත්තවල රටා හඳුනාගෙන ඒවා භාවිතා කර එක් එක් කාර්යය සඳහා පැහැදිලිව වැඩසටහන්ගත නොකර තීරණ හෝ අනාවැකි ලබා ගැනීමෙනි. මෙම ලිපියෙන්, ප්‍රධාන අදියර සහ භාවිතා කරන විවිධ වර්ගයේ ඇල්ගොරිතම ඇතුළුව යන්ත්‍ර ඉගෙනුම් ඇල්ගොරිතම විස්තරාත්මකව ක්‍රියා කරන ආකාරය අපි පැහැදිලි කරන්නෙමු.

1. යන්ත්‍ර ඉගෙනීම පිළිබඳ හැඳින්වීම

යන්ත්‍ර ඉගෙනීම මඟින් පරිගණක පද්ධතිවලට දත්ත වලින් ඉගෙන ගැනීමට, කාලයත් සමඟ ඒවායේ ක්‍රියාකාරිත්වය වැඩි දියුණු කිරීමට සහ ස්වාධීන අනාවැකි පළ කිරීමට හැකියාව ලැබේ. සාම්ප්‍රදායික ක්‍රමලේඛනය මෙන් නොව, උපදෙස් ක්‍රමලේඛකයින් විසින් පැහැදිලිව කේතනය කරනු ලැබේ, යන්ත්‍ර ඉගෙනීම ආකෘති පුහුණු කිරීම සඳහා දත්ත සහ ඇල්ගොරිතම භාවිතා කරයි, පසුව ඒවා අනාවැකි පළ කිරීමට හෝ තීරණ ගැනීමට භාවිතා කරයි.

2. යන්ත්‍ර ඉගෙනීමේ ප්‍රධාන අදියර

යන්ත්‍ර ඉගෙනුම් ඇල්ගොරිතම ක්‍රියා කරන ආකාරය තේරුම් ගැනීමට, යන්ත්‍ර ඉගෙනුම් ක්‍රියාවලියේ ප්‍රධාන අදියර හඳුනා ගැනීම වැදගත් වේ:

අ. දත්ත රැස් කිරීම

බොහෝ යන්ත්‍ර ඉගෙනුම් ව්‍යාපෘතිවල පළමු පියවර වන්නේ දත්ත රැස් කිරීමයි. දත්ත යන්ත්‍ර ඉගෙනීමේ ඉන්ධනය වන අතර, එහි ගුණාත්මකභාවය සහ ප්‍රමාණය අවසාන ප්‍රතිඵල කෙරෙහි සැලකිය යුතු ලෙස බලපානු ඇත. පොදු දත්ත කට්ටල, සංවේදක, සමාගම් දත්ත සමුදායන් හෝ වෙබ් සීරීම් වැනි විවිධ මූලාශ්‍රවලින් දත්ත රැස් කළ හැක.

B. දත්ත පූර්ව සැකසුම් කිරීම

එකතු කරන ලද දත්ත යන්ත්‍ර ඉගෙනීම සඳහා වහාම සූදානම් වන්නේ කලාතුරකිනි. එහි අස්ථානගත වූ අගයන්, බාහිර හෝ අදාළ නොවන විශේෂාංග අඩංගු විය හැකිය. දත්ත පෙර සැකසුම්කරණයට දත්ත පිරිසිදු කිරීම, සාමාන්‍යකරණය, විශේෂාංග පරිවර්තනය සහ මානයන් අඩු කිරීම ඇතුළත් වන අතර, එහි ඉලක්කය වන්නේ අමු දත්ත යන්ත්‍ර ඉගෙනීමේ ඇල්ගොරිතම සඳහා සුදුසු ආකාරයක් බවට පරිවර්තනය කිරීමයි.

C. ආකෘතිය සහ ඇල්ගොරිතම තේරීම

දත්ත සූදානම් වූ පසු, ඊළඟ පියවර වන්නේ සුදුසු යන්ත්‍ර ඉගෙනුම් ආකෘතිය සහ ඇල්ගොරිතම තෝරා ගැනීමයි. විවිධ යන්ත්‍ර ඉගෙනුම් ඇල්ගොරිතම ඇත, ඒ සෑම එකක්ම නිශ්චිත කාර්යයකට ගැලපේ. උදාහරණයක් ලෙස, අඛණ්ඩ අගයන් පුරෝකථනය කිරීම සඳහා රේඛීය ප්‍රතිගමනය සුදුසු වන අතර, තීරණ ගස් හෝ අහඹු වනාන්තර වර්ගීකරණය සඳහා වඩා හොඳය.

D. ආදර්ශ පුහුණුව

මෙම අදියරේදී, සැකසූ දත්ත ආකෘතිය පුහුණු කිරීම සඳහා භාවිතා කරයි. ආදාන (විශේෂාංග) ප්‍රතිදාන (ලේබල්) වෙත නිවැරදිව සිතියම්ගත කිරීම සඳහා ආකෘතිය එහි අභ්‍යන්තර පරාමිතීන් සකස් කිරීමෙන් ඉගෙන ගනී. මෙම පුහුණු ක්‍රියාවලියට සාමාන්‍යයෙන් දත්ත කට්ටලය කොටස් දෙකකට බෙදීම ඇතුළත් වේ: පුහුණු දත්ත සහ පරීක්ෂණ දත්ත. පුහුණු දත්ත ආකෘතිය පුහුණු කිරීම සඳහා භාවිතා කරන අතර, පරීක්ෂණ දත්ත ආකෘතියේ කාර්ය සාධනය ඇගයීම සඳහා භාවිතා කරයි.

E. ආදර්ශ ඇගයීම

පරීක්ෂණ දත්ත සමඟ ආකෘතිය කෙතරම් හොඳින් ක්‍රියා කරයිද යන්න තක්සේරු කිරීම සඳහා ආකෘති ඇගයීම සිදු කරනු ලැබේ. පොදු ඇගයීම් ක්‍රම අතරට නිරවද්‍යතාවය, නිරවද්‍යතාවය, නැවත කැඳවීම සහ ග්‍රාහක මෙහෙයුම් ලක්ෂණ වක්‍රය යටතේ ඇති ප්‍රදේශය (AUC-ROC) වැනි මිනුම් ඇතුළත් වේ. ඇගයීමේ ප්‍රතිඵල මත පදනම්ව, ආකෘතිය පිරිපහදු කළ හැකිය හෝ වැඩිදියුණු කළ හැකිය.

එෆ්. පුරෝකථනය හෝ ක්‍රියාත්මක කිරීම

ආකෘතිය ඇගයීමට ලක් කර සකස් කළ පසු, අවසාන අදියර වන්නේ නව දත්ත පිළිබඳ අනාවැකි පළ කිරීමට හෝ විශාල යෙදුමක එය ක්‍රියාත්මක කිරීමට ආකෘතිය භාවිතා කිරීමයි.

3. යන්ත්‍ර ඉගෙනුම් වර්ග

යන්ත්‍ර ඉගෙනුම් ඇල්ගොරිතම ඒවා ආමන්ත්‍රණය කරන කාර්යය වර්ගය අනුව වර්ගීකරණය කළ හැකිය. යන්ත්‍ර ඉගෙනීමේ ප්‍රධාන වර්ග තුනක් තිබේ:

අ. අධීක්ෂණය කරන ලද ඉගෙනීම

අධීක්ෂණය කරන ලද ඉගෙනීමේදී, ආදාන-ප්‍රතිදාන යුගල (විශේෂාංග-ලේබල්) වලින් සමන්විත දත්ත කට්ටලයක් මත ආකෘතියක් පුහුණු කරනු ලැබේ. අධීක්ෂණය කරන ලද ඉගෙනුම් ආකෘතියක ඉලක්කය වන්නේ ආදාන සහ ප්‍රතිදාන අතර සිතියමක් ඉගෙන ගැනීමයි. අධීක්ෂණය කරන ලද ඉගෙනීමේදී භාවිතා වන පොදු ඇල්ගොරිතම අතර රේඛීය ප්‍රතිගමනය, සැපයුම් ප්‍රතිගමනය, තීරණ ගස් සහ ආධාරක දෛශික යන්ත්‍ර (SVMs) ඇතුළත් වේ.

ආ. අධීක්ෂණය නොකළ ඉගෙනීම

අධීක්ෂණය කරන ලද ඉගෙනීම මෙන් නොව, අධීක්ෂණය නොකරන ලද ඉගෙනීමට ප්‍රතිදාන ලේබල නොමැත. ආකෘතිය ලේබල් නොකළ දත්තවල ව්‍යුහයන් හෝ රටා සොයා ගත යුතුය. අධීක්ෂණය නොකරන ලද ඉගෙනීමේ ප්‍රධාන ඇල්ගොරිතම අතරට පොකුරුකරණය (උදා: K-Means) සහ ප්‍රධාන සංරචක විශ්ලේෂණය (PCA) ඇතුළත් වේ.

C. අර්ධ අධීක්ෂණය කරන ලද ඉගෙනීම

අර්ධ වශයෙන් අධීක්ෂණය කරන ලද ඉගෙනීම අධීක්ෂණය කරන ලද සහ අධීක්ෂණය නොකරන ලද ඉගෙනීම් අතර කොහේ හරි වැටේ. මෙම ආකාරයේ ඉගෙනීමේදී, ආකෘතිය අර්ධ වශයෙන් ලේබල් කරන ලද දත්ත සහිත දත්ත කට්ටලයක් මත පුහුණු කරනු ලැබේ. සියලුම දත්ත සඳහා ලේබල් ජනනය කිරීම මිල අධික හෝ කාලය ගතවන විට මෙය විශේෂයෙන් ප්‍රයෝජනවත් වේ.

D. ශක්තිමත් කිරීමේ ඉගෙනීම

ශක්තිමත් කිරීමේ ඉගෙනීමේදී, නියෝජිතයන් තම පරිසරයෙන් ලැබෙන ත්‍යාග හෝ දඬුවම් ආකාරයෙන් ප්‍රතිපෝෂණ ලබා ගැනීමෙන් තීරණ ගැනීමට ඉගෙන ගනී. නියෝජිතයින් අත්හදා බැලීම් සහ දෝෂ හරහා දිගුකාලීන ලාභ උපරිම කිරීමට උත්සාහ කරයි. මෙම කාණ්ඩයේ ප්‍රසිද්ධ ඇල්ගොරිතම වන්නේ Q-Learning සහ Deep Q-Networks (DQN) ය.

4. යන්ත්‍ර ඉගෙනුම් ඇල්ගොරිතම යෙදීමේ උදාහරණ

අ. නිර්දේශ පද්ධතිය

පරිශීලකයින්ට නිෂ්පාදන හෝ අන්තර්ගත යෝජනා ලබා දීම සඳහා බොහෝ මාර්ගගත වේදිකා විසින් නිර්දේශ පද්ධති භාවිතා කරයි. උදාහරණයක් ලෙස, Netflix විසින් පරිශීලකයාගේ පෙර මනාපයන් මත පදනම්ව චිත්‍රපට සහ රූපවාහිනී වැඩසටහන් නිර්දේශ කිරීමට යන්ත්‍ර ඉගෙනුම් ආකෘති භාවිතා කරයි.

ආ. වංචා අනාවරණය

බැංකු සහ ක්‍රෙඩිට් කාඩ් සමාගම් සැක සහිත ක්‍රියාකාරකම් හෝ වංචා හඳුනා ගැනීමට යන්ත්‍ර ඉගෙනුම් ඇල්ගොරිතම භාවිතා කරයි. ගනුදෙනු රටා විශ්ලේෂණය කිරීමෙන්, ආකෘතිවලට සිදුවිය හැකි වංචා පෙන්නුම් කරන විෂමතා හඳුනාගත හැකිය.

C. ස්වභාවික භාෂා සැකසුම් (NLP)

භාෂා පරිවර්තනය, හැඟීම් විශ්ලේෂණය සහ චැට්බෝට් වැනි කාර්යයන් සඳහා ස්වාභාවික භාෂා සැකසුම් වලදී යන්ත්‍ර ඉගෙනුම් ඇල්ගොරිතම බහුලව භාවිතා වේ. ගැඹුරු ඉගෙනීම මත පදනම් වූ BERT සහ GPT-3 වැනි ආකෘති NLP ක්ෂේත්‍රයේ විප්ලවීය වෙනසක් සිදු කර ඇත.

5. යන්ත්‍ර ඉගෙනීමේ අභියෝග

යන්ත්‍ර ඉගෙනීමට බොහෝ වාසි තිබුණත්, විසඳිය යුතු අභියෝග කිහිපයක් තිබේ:

අ. දත්ත ගුණාත්මකභාවය

දුර්වල හෝ නියෝජනය නොකරන දත්ත හේතුවෙන් ආකෘති ඌන ක්‍රියාකාරීත්වයට හේතු විය හැක. එබැවින්, නිසි දත්ත රැස් කිරීම සහ පෙර සැකසුම් කිරීම ඉතා වැදගත් වේ.

B. අධික ලෙස සවි කිරීම සහ යට සවි කිරීම

ආකෘතියක් පුහුණු දත්ත වලින් ශබ්දය ඇතුළුව ඕනෑවට වඩා විස්තර ග්‍රහණය කර ගන්නා විට සහ එමඟින් නව දත්ත මත දුර්වල ලෙස ක්‍රියා කරන විට අධික සවි කිරීම සිදු වේ. අනෙක් අතට, ආකෘතියක් දත්තවල රටා ග්‍රහණය කර ගැනීමට ඉතා සරල වූ විට අඩු සවි කිරීම සිදු වේ.

ඇ. ආචාර ධර්ම සහ පෞද්ගලිකත්වය

යන්ත්‍ර ඉගෙනුම් ආකෘතිවල දත්ත භාවිතය පෞද්ගලිකත්වය සහ සදාචාරාත්මක ගැටළු මතු කරයි. අදාළ රෙගුලාසිවලට අනුකූලව දත්ත ලබා ගැනීම සහ භාවිතා කිරීම සහතික කිරීම වැදගත් වන අතර සදාචාරාත්මක ඇඟවුම් සලකා බලයි.

6 කෙසිම්පුලන්

යන්ත්‍ර ඉගෙනුම් ඇල්ගොරිතමවල ක්‍රියාකාරිත්වයට දත්ත රැස් කිරීමේ සිට ආකෘති ඇගයීම දක්වා විවිධ අදියරයන් ඇතුළත් වේ. කාර්ය වර්ගය සහ දත්ත ලක්ෂණ මත පදනම්ව නිවැරදි ඇල්ගොරිතම සහ ක්‍රමය තෝරා ගැනීමෙන්, යන්ත්‍ර ඉගෙනුම් ආකෘතිවලට නිවැරදි හා ප්‍රයෝජනවත් අනාවැකි සැපයිය හැකිය. අභියෝග තිබියදීත්, බොහෝ අංශ පරිවර්තනය කිරීමට යන්ත්‍ර ඉගෙනීමේ හැකියාව අධිතක්සේරු කළ නොහැක.

මෙම වේගවත් සංවර්ධනයේදී, යන්ත්‍ර ඉගෙනුම් ඇල්ගොරිතම ක්‍රියා කරන ආකාරය සහ ඒවා මුහුණ දෙන අභියෝග පිළිබඳ ස්ථිර අවබෝධයක් අනාගත නවෝත්පාදනය සඳහා තීරණාත්මක පදනමක් වනු ඇත.

අදහස අත්හැර