Қазақтың ұлттық үстел ойындарына өз-өзімен ойнау арқылы нығайтумен оқытуды қолдану: тоғызқұмалақ мысалында

Авторлар

DOI:

https://doi.org/10.26577/jpcsit4220261

Кілт сөздер:

Көп агентті нығайтумен оқыту, жинақталған марапат, Q-оқыту, нөлдік нәтиже ойыны, Монте-Карло ағаш іздеу әдісі

Аңдатпа

Бұл мақалада нөлдік нәтиже ұғымына негізделген қазақтың ұлттық тоғызқұмалақ ойынын мысалға ала отырып, бәсекелі үстел ойындарына арналған агенттерді оқыту нәтижелері ұсынылады. AlphaZero тәжірибесі көрсеткендей, адам сарапшысының білімінсіз және бақылаулы оқытусыз чемпионды дайындауға болады. Алайда әрбір ойынның өзіне тән ерекшеліктері бар, сондықтан мықты ойыншыны әзірлеу үшін арнайы зерттеу қажет. Бұл жұмыста агенттерді оқыту үшін модельге тәуелді емес және модельге негізделген екі түрлі тәсіл қолданылды. Оқу барысында өз-өзімен ойнау (self-play) әдісі тиімді пайдаланылды. Нәтижесінде агенттер тоғызқұмалақты бәсекелі деңгейде ойнай алатын деңгейге жетті.

##plugins.themes.default.displayStats.downloads##

##plugins.themes.default.displayStats.noStats##

Автор өмірбаяны

  • Dinara Zhussupova, Institute of Mathematics and Mathematical Modeling, Astana, Kazakhstan

    Dinara Zhussupova, PhD. Dr. Dinara Zhussupova is a Leading Researcher at the Institute of Mathematics and Mathematical Modeling (Almaty, Kazakhstan). She received her PhD in Mathematics from L.N. Gumilyov Eurasian National University. Her academic and research work focuses on mathematical modeling, numerical methods, artificial intelligence, and reinforcement learning. She has experience in interdisciplinary research at the intersection of mathematics, computer science, and intelligent systems.

Жарияланды

2026-06-19