
éåŠç¿ïŒOverfittingïŒïŒÂ AI ã·ã¹ãã ã®éçºã«ãããæ¬è³ªçãªåé¡
ã以åãéååŠç¿ãã亀差æ€èšŒã«é¢ããèšäºããŸãæ©æ¢°åŠç¿ã®ECãžã®å¿çšã«é¢ããèšäºçã§ãç¹°ãè¿ããAIã·ã¹ãã ã«ãããã¢ãã«ã®ããã¹ããã¹ãé«ãããéåŠç¿ïŒOverfittingïŒããããã«é²ãã§ãããã倧äºã§ãããšè¿°ã¹ãŸããã
ãä»åã¯ããããããã®ãéåŠç¿ããšã¯äœãªã®ããšããããšã«ã€ããŠç°¡åã«è¿°ã¹ãããšæããŸããæ©æ¢°åŠç¿ããŒã¹ã® AI ã·ã¹ãã ã®æ§ç¯ã«ãããŠã¯ãšãŠãæ¬è³ªçãªãæ©ãŸããåé¡ã§ãããåžžã«åé¿çãæ éã«èããå®è¡ããŠããå¿ èŠããããŸãã
ããŸããéåŠç¿ã¯æ©æ¢°åŠç¿ã®ä»£è¡šçãªäºåéããæåž«ããåŠç¿ãããæåž«ãªãåŠç¿ãã®ã©ã¡ãã«ãããŠãèµ·ããåé¡ã§ããïŒäŸãã°ãããŒã¿ã衚çŸããå€ã«éè€ããããªã©ã®ãã€ãºãæãã±ãŒã¹ã§ããïŒã§ãããéåŠç¿ãèãããšãã¯æåž«ããåŠç¿ã®ã±ãŒã¹ã®æ¹ããããããããããæåž«ããåŠç¿ãäŸã«èª¬æããŸããæåž«ããåŠç¿ã§ã¯ãäºåã«äžãããããµã³ãã«ãšãªãããŒã¿ãããã°ãæåž«ããã®äŸé¡ïŒæåž«æ å ±ïŒããšã¿ãªããŠããããåèã«æ³åæ§ãå°åºããŸããæ³åæ§ã®å°åºã¯ãã¢ãã«ã®ãã£ããã£ã³ã°ãšè¡šçŸããããšãäžè¬çã§ããããã«ãããŠéåŠç¿ãšã¯æåéããåŠç¿ããããç¶æ ãæããŸãããµã³ãã«ããŒã¿ã«å¯ŸããŠæ¥µç«¯ã«å¿ å®ãªæ³åæ§ãå°åºãããããªãã¡ãµã³ãã«ããŒã¿ã«ãã£ããããããã¢ãã«ãäœã£ãŠããŸã ïŒOverfittingïŒ ãšããããšã§ããããã«ããããµã³ãã«ããŒã¿ã¯å®ç§ã«åŠçã§ããããå®éã®æ¬çªã§çºçããããŒã¿ã«å¯ŸããŠã¯æè»ã«å¯Ÿå¿ã§ãããAIã宿Šã§å šç¶ç²ŸåºŠãåºããŠãããªããããªäºæ ã«ãªããŸããåéšå匷ãäŸã«ããã°ãåèæžãæèšããŠããŸã£ãã®ã§åèæžã®äŸé¡ã¯100ïŒ è§£ããã®ã ãã©ãå®éã®å€§åŠå ¥è©Šã§çè§£åãåãäžæ©èžã¿èŸŒãã åé¡ãåºãããŠããŸã£ããå šã察å¿ã§ããªããã¿ãããªæãã§ãããããïŒããããã®äŸã¯å®ã¯èª¬æäžã®ãã®ã«çãŸãããéåŠç¿ãé²ãããã®æŠç¥ãèããäžã§ã¯æå€ãšåœ¹ã«ç«ã€èŠç¹ã§ããïŒ
ãéåŠç¿ã¯ããµã³ãã«ããŒã¿ãå®éã®æ¬çªã«ãããŠçºçãããããŒã¿ã®ååžãã©ãã ãã«ããŒãããããšããããšã«ãã£ãŠèµ·ããåé¡ã§ããããŸãããµã³ãã«ããŒã¿ãæ¬çªããŒã¿ãšåæ§ã«è¿ããå€ã®æ§æãååžã§ã§ããŠããã®ã§ããã°éåŠç¿ã¯èµ·ãããŸããããããããµã³ãã«ããŒã¿ããã®ãããªå®ç§ãªç¶æ ã§äœããããšãããšçŸå®ã«ã¯é£ããããã§ãããµã³ãã«ããŒã¿ã¯åžžã«ãã®äœçœ®ã¥ãããããŒã¿éãå¿ èŠååãªéãããå°ãªããªã宿åœã«ãããŸããããã§ã¯ãšããããšã§åŠç¿æžã¿ã¢ãã«ãåçšããŠããããæè¿ãæµè¡ãã€ã€ãã Data Augmentation ãã¯ããã¯ã«ãã£ãŠãµã³ãã«ããŒã¿éãå¢ããããšã§å¯Ÿå¿ãããšããŠãããããæ¬çªããŒã¿ã®ååžã«èããåããŠãããéåŠç¿ãæããŸãããŸãããµã³ãã«ããŒã¿ãå®ç§ã«ã€ãããªãã£ããšããŠãããµã³ãã«ããŒã¿ã«ããã£ãããïŒïŒbiasãå°ãªãïŒãå®éã®æ¬çªããŒã¿ã«ããã£ããããïŒïŒvarianceãå°ãªãïŒç¶æ ã«ã¢ãã«ãå°éã§ããã°ããã§ãããããªæ°ãããŸããããããã¯æ²ããããªãã¬ãŒããªãã®é¢ä¿ã«ãããéä»»ããªé¢ããããŸããããããéåŠç¿ã¯é¿ããããããã€æ ¹ãæ·±ãåé¡ã«ãªããŸãã
ãå®éã®ãããžã§ã¯ãã§ã¯ããããžã§ã¯ãã®æ±ããç¶æ³ãåãããã¢ãããŒãã«ãã£ãŠã©ãããŠããµã³ãã«ããŒã¿ããšãŠãå°ãªããªãã±ãŒã¹ããã¢ãã«ã«çµã¿èŸŒãã§ããªãã¢ãã«ã®å€ã®ç°å¢ã®èŠå ãéå°è©äŸ¡ããŠããŸã£ãŠããŠãå€éšç°å¢å€åã«å¯Ÿå¿ã§ããªãã±ãŒã¹çããããŸããäŸãã°éèååã®å€æ®µãäºæž¬ããŠããã¢ãã«ãäœã£ãŠããµã³ãã«ãšãªãããŒã¿ããç©äœèªèã§ã®ç»åããŒã¿çãšããã¹ãŠå§åçã«å°ãªãã§ãããäŸãã°çœå®³ãæ¿æ²»ååããããã¯æ°ããéèèŠå¶ã®æŽåãªã©ã®åœ±é¿ãå®éã¯å€§ããåããŸããããŸããããã¯éå»ã«äŸã®ãªãããšã§ãæ®éã«èµ·ããã®ã§ãã©ãããŠãããã¯ãã¹ãã¯å®ç§ãªã®ã«å®éã®äºæž¬ã§ã¯æãããã«ãããªãã¿ãããªããšããããŸãããŸããã€ã³ãããããŒã¿ãé«å質åããŠããŸããšããã±ãŒã¹ããããŸããäœè§£å床ã®ç»åããŒã¿ã§åŠç¿ããå»çAIã¯ããã®åŸã®ã«ã¡ã©ã®é²åã§ãã€ã³ãããããŒã¿ãé«è§£å床ã«ãªã£ãŠããŸããéåŠç¿ã«ãã誀蚺æãè¡ããå Žåã«ãã£ãŠã¯äººåœãå±éºã«ããã䟵襲æ§ã®ããæ€æ»ãåŠçœ®ãžãšã€ãªããŠããŸãå¯èœæ§ãããããŸããã€ã³ãããããŒã¿ã®é«å質åã«ãããã¢ãã«ãéåŠç¿ç¶æ
ãžãšå€ãã£ãŠããŸããšããã®ã¯ããçš®ã®ç²ç¹ã§ãã
ããããã¯ããµã³ãã«ããŒã¿ã«ãªããæ¬çªããŒã¿ã§çµ¶å¯Ÿã«å
¥ãããšã®ãªãããŒã¿ïŒããªãã¡ãééãïŒãæ··å
¥ããŠãããšããæ²ããããšãå®éã®ãããžã§ã¯ãã§ã¯èµ·ããããŸãããããã¯ãæ¬çªã®ããŒã¿ã®ååžããšãŠã€ããªããŠããŒã¯ã§ïŒãããã¯ãã¡ããã¡ãã§ãããïŒããµã³ãã«ããŒã¿ãã©ã®ããã«ã©ããŸã§ãšãã®ããé£ããçã®ã±ãŒã¹ãèããããŸãããŸããã®ãããªç¹ç°æ§ãã«ããŒããããšè€éãªã¢ãã«ãç®æããŠããŸããåŠç¿ãããŸããããªãããšãããããã§ãããããããã¯ã©ããåºæ¬çãªæ©æ¢°åŠç¿ã«ãããŠã¯éåŠç¿ã«ã€ãªãã£ãŠãããŸããéã«åçŽãããã¢ãã«ãç®æããŠããŸããšãéåŠç¿ïŒOverfittingïŒã®éã® Underfitting ãæãããšããããŸãã
ããã®ãããæåž«ããåŠç¿ã®é©çšæã«ã¯ãå®éã«çºçããæ¬çªããŒã¿ãžã®çè§£ããã£ãããã¡ãã¢ãã«ã®èªç±åºŠãè€éãããŸãåŠç¿çµæããµã³ãã«ããŒã¿ãšã¯å¥ã«çšæããããã¹ãããŒã¿ãçšãã亀差æ€èšŒãéããŠç¹æ€ãã€ã€ãå¿
èŠã§ããã°ããŒã¿ãçž®çŽãããã颿£åãããããŠããŒã¿ã®æã¡æ¹ãå€ããã¢ãã«ã®è€éããé©åºŠã«ãããã€ã€ãéåŠç¿ãã§ãããããé²ãã§ããå¿æ§ããå¿
èŠã§ãã
ïŒãšããã§ã倧éã«ãµã³ãã«ããŒã¿ã確ä¿ã§ãã Deep Learning ã§ã®åŠç¿ã«ãããŠã¯ãäžèšã®ãããªéåŠç¿ã®æããããã±ãŒã¹ã«çœ®ããŠããã¢ããªã±ãŒã·ã§ã³ã«ãã£ãŠã¢ãã«ã倧ããã»ã©ããã¹ããã¹ãé«ãæ±åæ§èœãé«ããªãããšãããã®ã§ãã¢ãã«ã®è€éããšéåŠç¿ã®é¢ä¿ã¯äžæŠã«ã¯ãããŸããããŸãããããéç·åœ¢ã§ãã©ã¡ãŒã¿ãŒæ°ãéåžžã«å€§ããåŠç¿ãšãã Deep Learning ã®äžçã®å¥¥æ·±ãã§ããããŸããäœè«ã§ãããïŒ
ããŸã
æ¬æäžã§ãData Augmentation ã«ã€ããŠèšåããŠãããŸãããå¥é以äžã®èšäºãšããŠå·çããŠãããŸãããã¡ãããåç §ãã ããã