i think the only thing i'm lacking now is RL to give the model the goal of winning, not just pure imitation of player habits. also more data, there is really no limit to the amount of replay data i would like to have, it's clearly still overfocusing on a few weird rounds (e.g. the backdash habit)
Публикация
Обсуждение
0 прямых ответов
Показаны не все ответы
Публичный счётчик показывает 1, а источник передал 0. Остальные ответы могли быть удалены, скрыты или не выданы публично.
Ответов пока нет
Обсуждение ещё не началось.