Машинное обучение в трейдинге: теория, модели, практика и алготорговля - страница 3160

 
Maxim Dmitrievsky #:
Можно определить группы, на которых лечение оказывает больше эффект. А другие не лечить.

Ну так и делают, диагнозы это группы, лечение это тритмент))) Нормальный по сути подход, когда не хватает данных для понимания процесса. Допущение в виде замены логических доказательств подтверждающими гипотезу экспериментами в разных вариациях и сравнениях с достаточной чистотой эксперимента.

[Удален]  

Помните, _Vizard все время раздвигал какие-то точки в своих видюшках, а потом удалял их? )

https://github.com/abidlabs/contrastive

GitHub - abidlabs/contrastive: Contrastive PCA
GitHub - abidlabs/contrastive: Contrastive PCA
  • abidlabs
  • github.com
A python library for performing unsupervised machine learning on datasets with learning (e.g. PCA) in contrastive settings, where one is interested in patterns (e.g. clusters or clines) that exist one dataset, but not the other. Applications include dicovering subgroups in biological and medical data. Here are basic installation and usage...
 
Maxim Dmitrievsky #:

Помните, _Vizard все время раздвигал какие-то точки в своих видюшках, а потом удалял их? )

https://github.com/abidlabs/contrastive

Ещё есть PLS. На первый взгляд, идея похожая.

 
Aleksey Nikolayev #:

Ещё есть PLS. На первый взгляд, идея похожая.

Есть ещё t-sne,  umap, lle... И куча куча всего


Одного не пойму, в чем суть восторга?  директор ИТ отдела никогда не делал РСА ? )))

 
mytarmailS #:

Есть ещё t-sne,  umap, lle... И куча куча всего


Одного не пойму, в чем суть восторга?  директор ИТ отдела никогда не делал РСА ? )))

Эти же вроде нелинейные все, а те оба линейные как и PCA, если не путаю.

[Удален]  
Aleksey Nikolayev #:

Ещё есть PLS. На первый взгляд, идея похожая.

Там тоже дополнительный датасет используется?
В описании не увидел.
 
Maxim Dmitrievsky #:
Там тоже дополнительный датасет используется?

Нет, там постановка задачи формально другая и используются метки. Сходство мне показалось в поиске пространств, на которые делается проекция. Ещё вроде оба подхода используют в генетике, где огромная размерность признаков, большая чем число примеров.

[Удален]  
Aleksey Nikolayev #:

Нет, там постановка задачи формально другая и используются метки. Сходство мне показалось в поиске пространств, на которые делается проекция. Ещё вроде оба подхода используют в генетике, где огромная размерность признаков, большая чем число примеров.

Потом попробую, интересно что покажет на новых данных.
 
Maxim Dmitrievsky #:
Там тоже дополнительный датасет используется?
В описании не увидел.

Посмотрел повнимательнее. Да, разница более существенная, хотя насчёт линейности метода не ошибся.

сPCA, по идее, может помочь визуально находить тонкую разницу между фазами рынка. Тоже подадимся в волшебники)

[Удален]  
Aleksey Nikolayev #:

Посмотрел повнимательнее. Да, разница более существенная, хотя насчёт линейности метода не ошибся.

сPCA, по идее, может помочь визуально находить тонкую разницу между фазами рынка. Тоже подадимся в волшебники)

Да, когда шума много, то компоненты с максимальной дисперсией не могут ничего показать. Не разбирался как там участвует второй датасет, но это тоже что-то из козула и там что-то про тритмент было в его роликах.