##navigation.skip.nav## ##navigation.skip.main## ##navigation.skip.footer##

Elektrotehničko i računarsko inženjerstvo

God. 41 Br. 08 (2026): Зборник радова Факултета техничких наука

Систем за адаптацију стратегије у поновљеним неодређеним играма нулте суме са два играча

  • Đorđe Mirosavić
DOI:
https://doi.org/10.24867/
Predato
September 7, 2026
Objavljeno
2026-09-09

Apstrakt

Тема овог рада је прављење платформе која учи понашање човека у игри папиркамен-маказе, и сходне томе адаптивно бира стратегију помоћу које га побеђује. У првом делу рада биће приказане стратегије које ће се користити, прављења софтверске и хардверске платформе. У другом делу ће бити приказани резултати експеримената. 

Reference

  1. [1] Figurska M, Stańczyk M, Kulesza K. (2008).
  2. “Humans cannot consciously generate random
  3. numbers sequences: Polemic study”
  4. [2] Schulz, MA., Baier, S., Timmermann, B. (2021). “A
  5. cognitive fingerprint in human random number
  6. generation”
  7. [3] Hasselt, H., Guez, A., & Silver, D. (2015). “Deep
  8. Reinforcement Learning with Double Q-learning”
  9. [4] Wang, Z., Xu, B. & Zhou, HJ. (2014).“Social cycling
  10. and conditional responses in the Rock-Paper-Scissors
  11. game”
  12. [5] Kumar, D. (2024).“DDQN: Tackling Overestimation
  13. Bias in Deep Reinforcement Learning”