Машинное обучение в трейдинге: теория, модели, практика и алготорговля - страница 3306

 
Aleksey Vyazmikin #:

Т.е. никто не додумался провести эти тесты?

Почему предполагается что эти тесты существовали всегда? Большинство всех стат-тестов было придумано (и главное - обосновано) только в 20-м веке, после создания теорвера. Разложение Фурье же было придумано лет на сто раньше.
 
Да, какая эпоха ушла) Какие люди были - Шурик, Колдун, ...)
 
Aleksey Nikolayev #:
Да, какая эпоха ушла) Какие люди были - Шурик, Колдун, ...)

Alexey Burnakov ,   Dr. Trader ...


один сотни стоит..

 
mytarmailS #:
Кто-нибудь может мне обяснить проблему множественного тестирования.
Почему чем больше было итераций при оптимизации тем больше вероятность переобучения


Нет я понимаю что чем больше ищешь(итерации) тем больше вероятность найти что то случайное что будет выглядеть как НЕслучайное..  

Но если мы придумали какую то идею ,а  потом подобрали параметры к ней за 10 итераций , а не за 10000 то можно ли это считать непереобучной моделью?

Ведь сама фраза "мы придумали" подразумевает  тоже некий мыслительный перебор (итерации)

Откуда конечной модели знать какие это были итерации, мозговые или копютерные и есть ли разница между тем и другим?

Вопрос возник после почтения статьи Прадо

дело в том, что оптимум можно найти и за 1000 итераций и за 100, если говорим об оптимизации каких то параметров модели. с увеличением количества итераций просто растёт вероятность нахождения.

говорил ранее, что очень важно применять такую оценку, которая даёт максимальное значение того, что требуется найти. использование неправильной оценки приводит к гаданию на кофейной гуще.

[Удален]  

Алексей уперся в DQN и дальше не пошел, предпочтя писать повести о Валере. ДР трейдер связался с Александром, и тот его погубил, поскольку первый не имел своего мнения.

Единственным персонажем был Визард, который явно что-то немного понимал, но был слишком нервным, а когда понял, что его скоро догонят - сбежал.

Показательно, что все писали на R, поэтому ничего не добились, ибо R разрушает сознание
 
Aleksey Vyazmikin #:

Переобучение возникает в связи с запоминанием редких явлений. Эти явления выделяются чисто статистически, так как нет модели, описывающей причину и следствие.

При этом убыток - не всегда значит, что модель переобучена.

Andrey Dik #:

дело в том, что оптимум можно найти и за 1000 итераций и за 100, если говорим об оптимизации каких то параметров модели. с увеличением количества итераций просто растёт вероятность нахождения.

говорил ранее, что очень важно применять такую оценку, которая даёт максимальное значение того, что требуется найти. использование неправильной оценки приводит к гаданию на кофейной гуще.


Вы даже сути моего вопроса не поняли

 
mytarmailS #:


Вы даже сути моего вопроса не поняли

я говорил об одном, Алексей о другом.

и не ожидал, что моя мысль будет сходу воспринята.

представьте, что нужный вам сет параметров существует в полном множестве всех вариантов. теперь подумайте, какой должна быть оценка, что бы при любом количестве итераций можно было найти только и именно этот сет? если с ростом итераций растет подгонка, то значит не сет неправильно находиться, а используется неправильная его оценка.

 
Andrey Dik #:

я говорил об одном, Алексей о другом.

И обое не о том..


Почитайте статью , потом  про проблему множественного тестирования , потом еще раз мой вопрос

 
Andrey Dik #:
что бы при любом количестве итераций можно было найти только и именно этот сет

Песнь о старом!

Никому НЕ нужен этот сет. А оптимизация в тестере ищет именно такой уникальный сет и большое число "оптимизаторов" удовлетворяется этим единственным сетом параметров, не обращая внимания на "двумерную диаграмму", по которой можно попытаться найти  набор сетов, т.е. найти плато, а не максимум.   

А оптимальный сет, который на двумерной диаграмме выглядит как зеленый остров среди бледных или белых квадратиков говорит о переобучении, т.е. выхвачена некая частность, очень оптимальная, но которая никогда более не встретится, что и называется переобучением. 

 
mytarmailS #:

И обое не о том..

Почитайте статью , потом  про проблему множественного тестирования , потом еще раз мой вопрос

как хотите, я не настаиваю.