Қазақтың ұлттық үстел ойындарына өз-өзімен ойнау арқылы нығайтумен оқытуды қолдану: тоғызқұмалақ мысалында

Автор(и)

DOI:

https://doi.org/10.26577/jpcsit4220261

Ключові слова:

Көп агентті нығайтумен оқыту, жинақталған марапат, Q-оқыту, нөлдік нәтиже ойыны, Монте-Карло ағаш іздеу әдісі

Анотація

Бұл мақалада нөлдік нәтиже ұғымына негізделген қазақтың ұлттық тоғызқұмалақ ойынын мысалға ала отырып, бәсекелі үстел ойындарына арналған агенттерді оқыту нәтижелері ұсынылады. AlphaZero тәжірибесі көрсеткендей, адам сарапшысының білімінсіз және бақылаулы оқытусыз чемпионды дайындауға болады. Алайда әрбір ойынның өзіне тән ерекшеліктері бар, сондықтан мықты ойыншыны әзірлеу үшін арнайы зерттеу қажет. Бұл жұмыста агенттерді оқыту үшін модельге тәуелді емес және модельге негізделген екі түрлі тәсіл қолданылды. Оқу барысында өз-өзімен ойнау (self-play) әдісі тиімді пайдаланылды. Нәтижесінде агенттер тоғызқұмалақты бәсекелі деңгейде ойнай алатын деңгейге жетті.

Завантажити

Дані для завантаження поки недоступні.

Біографія автора

  • автор Dinara Zhussupova, афіліація Institute of Mathematics and Mathematical Modeling, Astana, Kazakhstan

    Dinara Zhussupova, PhD. Dr. Dinara Zhussupova is a Leading Researcher at the Institute of Mathematics and Mathematical Modeling (Almaty, Kazakhstan). She received her PhD in Mathematics from L.N. Gumilyov Eurasian National University. Her academic and research work focuses on mathematical modeling, numerical methods, artificial intelligence, and reinforcement learning. She has experience in interdisciplinary research at the intersection of mathematics, computer science, and intelligent systems.

Завантаження

Опубліковано

2026-06-19

Як цитувати

Қазақтың ұлттық үстел ойындарына өз-өзімен ойнау арқылы нығайтумен оқытуды қолдану: тоғызқұмалақ мысалында. (2026). Journal of Problems in Computer Science and Information Technologies, 4(2), 3-13. https://doi.org/10.26577/jpcsit4220261