Agent
- actionsBuffer
- agentConfig
- currentReward
- done
- forwardPasses
- inputsBuffer
- lossesHistory
- memory
- model
- name
- netInputWindowSize
- rewardsHistory
- statesBuffer
- addReward
- createNeuralNetInput
- createTrainingDataFromMemento
- forward
- getTrackingInformation
- learn
- listen
- memorize
- policy
- reset
- setReward
⊕ new Agent(model: Model, agentConfig?: AgentConfig, name?: string): Agent
Defined in reimprove/agent.ts:44
Parameters:
| Param | Type |
|---|---|
| model | Model |
Optional agentConfig |
AgentConfig |
Optional name |
string |
Returns: Agent
● actionsBuffer: Array<number>
Defined in reimprove/agent.ts:33
● agentConfig: AgentConfig
Defined in reimprove/agent.ts:42
● currentReward: number
Defined in reimprove/agent.ts:31
● done: boolean
Defined in reimprove/agent.ts:30
● forwardPasses: number
Defined in reimprove/agent.ts:44
● inputsBuffer: Array<MementoTensor>
Defined in reimprove/agent.ts:35
● lossesHistory: TypedWindow<number>
Defined in reimprove/agent.ts:37
● memory: Memory
Defined in reimprove/agent.ts:41
● model: Model
Defined in reimprove/agent.ts:47
● name: string
Defined in reimprove/agent.ts:47
● netInputWindowSize: number
Defined in reimprove/agent.ts:39
● rewardsHistory: TypedWindow<number>
Defined in reimprove/agent.ts:38
● statesBuffer: Array<Tensor>
Defined in reimprove/agent.ts:34
getConfig(): AgentConfig
Defined in reimprove/agent.ts:209
Returns: AgentConfig
getName(): stringsetName(name: string): void
Defined in reimprove/agent.ts:217
Returns: string
Defined in reimprove/agent.ts:213
Parameters:
| Param | Type |
|---|---|
| name | string |
Returns: void
▸ addReward(value: number): void
Defined in reimprove/agent.ts:194
Parameters:
| Param | Type |
|---|---|
| value | number |
Returns: void
▸ createNeuralNetInput(input: Tensor): Tensor
Defined in reimprove/agent.ts:65
Parameters:
| Param | Type |
|---|---|
| input | Tensor |
Returns: Tensor
▸ createTrainingDataFromMemento(memento: Memento, gamma: number): object
Defined in reimprove/agent.ts:145
Parameters:
| Param | Type |
|---|---|
| memento | Memento |
| gamma | number |
Returns: object
▸ forward(input: number[], epsilon: number, keepTensors?: boolean): number
Defined in reimprove/agent.ts:90
Parameters:
| Param | Type | Default value |
|---|---|---|
| input | number[] |
- |
| epsilon | number |
- |
Default value keepTensors |
boolean |
true |
Returns: number
▸ getTrackingInformation(): AgentTrackingInformation
Defined in reimprove/agent.ts:221
Returns: AgentTrackingInformation
▸ learn(gamma: number): Promise<void>
Defined in reimprove/agent.ts:167
Parameters:
| Param | Type |
|---|---|
| gamma | number |
Returns: Promise<void>
▸ listen(input: number[], epsilon: number): number
Defined in reimprove/agent.ts:158
Parameters:
| Param | Type |
|---|---|
| input | number[] |
| epsilon | number |
Returns: number
▸ memorize(): void
Defined in reimprove/agent.ts:130
Returns: void
▸ policy(input: Tensor): number
Defined in reimprove/agent.ts:86
Parameters:
| Param | Type |
|---|---|
| input | Tensor |
Returns: number
▸ reset(): void
Defined in reimprove/agent.ts:202
Returns: void
▸ setReward(value: number): void
Defined in reimprove/agent.ts:198
Parameters:
| Param | Type |
|---|---|
| value | number |
Returns: void