Параметры эксперимента
IdleРезультат
Нет данныхПоследние запуски
| ID | Symbol | Interval | PNL | Balance | LR | Epsilon | Created |
|---|---|---|---|---|---|---|---|
| История еще не загружена | |||||||
Q(a) — текущая ценность действия, α — обучаемость, r — reward шага; новая оценка это смесь прошлого знания и нового результата.
| ID | Symbol | Interval | PNL | Balance | LR | Epsilon | Created |
|---|---|---|---|---|---|---|---|
| История еще не загружена | |||||||