2 / 39
Π§ΡΠΎ ΡΠ°ΠΊΠΎΠ΅ Π³ΡΠ°Π΄ΠΈΠ΅Π½ΡΠ½ΡΠΉ ΡΠΏΡΡΠΊ ΠΈ Π·Π°ΡΠ΅ΠΌ ΠΎΠ½ Π½ΡΠΆΠ΅Π½ Π² ΠΌΠ°ΡΠΈΠ½Π½ΠΎΠΌ ΠΎΠ±ΡΡΠ΅Π½ΠΈΠΈ?
ΠΡΠ°Π΄ΠΈΠ΅Π½ΡΠ½ΡΠΉ ΡΠΏΡΡΠΊ β ΠΈΡΠ΅ΡΠ°ΡΠΈΠ²Π½ΡΠΉ Π°Π»Π³ΠΎΡΠΈΡΠΌ ΠΎΠΏΡΠΈΠΌΠΈΠ·Π°ΡΠΈΠΈ, ΠΊΠΎΡΠΎΡΡΠΉ ΠΌΠΈΠ½ΠΈΠΌΠΈΠ·ΠΈΡΡΠ΅Ρ ΡΡΠ½ΠΊΡΠΈΡ ΠΏΠΎΡΠ΅ΡΡ, Π΄Π²ΠΈΠ³Π°Ρ ΠΏΠ°ΡΠ°ΠΌΠ΅ΡΡΡ ΠΌΠΎΠ΄Π΅Π»ΠΈ Π² Π½Π°ΠΏΡΠ°Π²Π»Π΅Π½ΠΈΠΈ, ΠΏΡΠΎΡΠΈΠ²ΠΎΠΏΠΎΠ»ΠΎΠΆΠ½ΠΎΠΌ Π³ΡΠ°Π΄ΠΈΠ΅Π½ΡΡ. Π€ΠΎΡΠΌΡΠ»Π° ΠΎΠ΄Π½ΠΎΠ³ΠΎ ΡΠ°Π³Π°: ΞΈ β ΞΈ β Ξ± Β· βL(ΞΈ), Π³Π΄Π΅ Ξ± β learning rate. ΠΡΠΎ Π±Π°Π·ΠΎΠ²ΡΠΉ Π΄Π²ΠΈΠΆΠΎΠΊ ΠΎΠ±ΡΡΠ΅Π½ΠΈΡ ΠΏΠΎΡΡΠΈ Π²ΡΠ΅Ρ
ML- ΠΈ DL-ΠΌΠΎΠ΄Π΅Π»Π΅ΠΉ: Π»ΠΈΠ½Π΅ΠΉΠ½ΠΎΠΉ/Π»ΠΎΠ³ΠΈΡΡΠΈΡΠ΅ΡΠΊΠΎΠΉ ΡΠ΅Π³ΡΠ΅ΡΡΠΈΠΈ, SVM, Π½Π΅ΠΉΡΠΎΡΠ΅ΡΠ΅ΠΉ. ΠΠ°ΡΠΈΠ°Π½ΡΡ: batch (Π²Π΅ΡΡ Π΄Π°ΡΠ°ΡΠ΅Ρ), stochastic (ΠΎΠ΄ΠΈΠ½ ΠΏΡΠΈΠΌΠ΅Ρ), mini-batch (ΡΡΠ°Π½Π΄Π°ΡΡ Π² DL).