Машинное обучение в трейдинге: теория, модели, практика и алготорговля - страница 2808

[Удален]  
Valeriy Yastremskiy #:

А что либа не учитывает тип? Тип данных это как бы данные для самых дешевых расчетов. Тот же матрикс должен быть заопчен под расчеты.

не нашел аналог numpy для R, а матрицы там не то чтобы быстрые и сам R жрет много памяти за счет своей парадигмы

конечно сторонняя либа может работать медленно, кто бы проверял

не знаю что с чем сравнивать поэтому, гигабайтный датасет не охото грузить чтобы сравнить скорость
 
Алексей Тарабанов #:

Никак 

А обучение с подкрепление? 
[Удален]  
mytarmailS #:
А обучение с подкрепление? 

топикстартер писал статью по DQN на хабре на R

надо понимать, что обучение с подкреплением это просто хитровыдуманная оптимизация

может зайти в каких-то случаях, может нет

 
Maxim Dmitrievsky #:

не нашел аналога numpy для R.. 

..
А что именно требуется?  Если скорость то  data table, если быстрый аналог датафреймы то  tibble,  если большой объем данных то big matrix

[Удален]  
mytarmailS #:
..
А что именно требуется?  Если скорость то  data table, если быстрый аналог датафреймы то  tibble,  если большой объем данных то big matrix

хотел облегчить страдания Алексея ) Там конечно проще с разбегу.. но все равно

 
Maxim Dmitrievsky #:

топикстартер писал статью по DQN на хабре на R

надо понимать, что обучение с подкреплением это просто хитровыдуманная оптимизация

может зайти в каких-то случаях, может нет

Ну в контексте вопроса про память..
У РЛ можно вечно обновлять матрицу матрицу действий и матрицу оценки состояний или оценки действий,   те как бы память с постоянным обновление.. Но хз верно ли я думаю
[Удален]  
mytarmailS #:
Ну в контексте вопроса про память..
У РЛ можно вечно обновлять матрицу матрицу действий и матрицу оценки состояний или оценки действий,   те как бы память с постоянным обновление.. Но хз верно ли я думаю

оно состояния может корректировать с учетом новых данных, но все это на уровне или по типу Машки, то есть с запаздыванием

там более важно вознаграждение подобрать, то есть целевую по сути. А сделки оно будет само в разные стороны накидывать и на каждой итерации все лучше и лучше

 
Maxim Dmitrievsky #:

хотел облегчить страдания Алексея ) Там конечно проще с разбегу.. но все равно

Если бы Алексей хотел думать и слушать, то там с моим скриптом все рашаеться на 2 минуты.. 
[Удален]  
Maxim Dmitrievsky #:

оно состояния может корректировать с учетом новых данных, но все это на уровне или по типу Машки, то есть с запаздыванием

там более важно вознаграждение подобрать, то есть целевую по сути. А сделки оно будет само в разные стороны накидывать и на каждой итерации все лучше и лучше

память - это НС с весами обученная, ты на каждом шаге ее дообучаешь, немного двигаешь веса.. не намного, поэтому запаздывание

и в терминал это хрен перенесешь потом

 
Maxim Dmitrievsky #:

память - это НС с весами обученная, ты на каждом шаге ее дообучаешь, немного двигаешь веса.. не намного, поэтому запаздывание

.
Обученая сеть или любой АМО обученый или даже Машка, это память..  Да,  можно принять такую аналогию.. 

Но когда ты "дообучаешь" обученую нейронку, ты изменяешь веса,  те забываешь прошлое в угоду текущему... 

Те это не дообучение,  переобучение на каждом шаге,  та же Машка в скользящем окне,  что за пределами скользящего окна она не помнит, хоть и была там..