Models / Deep Learning / Reinforcement Learning

Reinforcement Learning

planned

Học chính sách hành động qua thử và phần thưởng.

Đang trong kế hoạch

Giả định

Môi trường mô phỏng được và phần thưởng định nghĩa đúng.

Hỏng khi nào

Thị trường thật không mô phỏng lại được — chính sách học trong backtest không đối mặt với tác động thị trường của chính nó.

Dùng trong ngành

Gaming AnalyticsGhép trận, AI NPC, mô phỏng kinh tế trong game Robotics & AutomationSLAM, hoạch định đường đi, hợp nhất cảm biến Trading & InvestmentGiao dịch thuật toán, phân tích thị trường, quản lý danh mục

Cùng nhóm Deep Learning

LSTM

Mạng hồi tiếp có cổng nhớ dài hạn.

GRU

Bản gọn của LSTM, ít tham số hơn.

Transformer

Cơ chế attention, nắm quan hệ xa.

Temporal Convolutional Network

Tích chập nhân quả với receptive field kiểm soát được.

CNN

Tích chập cho dữ liệu có cấu trúc không gian.