Elektrotehničko i računarsko inženjerstvo
God. 41 Br. 08 (2026): Зборник радова Факултета техничких наука
Систем за адаптацију стратегије у поновљеним неодређеним играма нулте суме са два играча
Apstrakt
Тема овог рада је прављење платформе која учи понашање човека у игри папиркамен-маказе, и сходне томе адаптивно бира стратегију помоћу које га побеђује. У првом делу рада биће приказане стратегије које ће се користити, прављења софтверске и хардверске платформе. У другом делу ће бити приказани резултати експеримената.
Reference
- [1] Figurska M, Stańczyk M, Kulesza K. (2008).
- “Humans cannot consciously generate random
- numbers sequences: Polemic study”
- [2] Schulz, MA., Baier, S., Timmermann, B. (2021). “A
- cognitive fingerprint in human random number
- generation”
- [3] Hasselt, H., Guez, A., & Silver, D. (2015). “Deep
- Reinforcement Learning with Double Q-learning”
- [4] Wang, Z., Xu, B. & Zhou, HJ. (2014).“Social cycling
- and conditional responses in the Rock-Paper-Scissors
- game”
- [5] Kumar, D. (2024).“DDQN: Tackling Overestimation
- Bias in Deep Reinforcement Learning”