Машинное обучение в трейдинге: теория, модели, практика и алготорговля - страница 3507

 
Aleksey Nikolayev #:
Ну вот, спросил почему считаете ваш алгоритм нежадным (в общепринятом смысле) - ответа не увидел.

Ещё раз - Вы акцентируете внимание на термины, но не на содержание. Ранее я уже пояснил, почему использовал такой термин и почему считаю это уместным. Вместо того, что бы для себя отметить, что у Вас другое мнение об уместности применения термина, и перейти к обсуждению сути, Вы акцентируете внимание на том, что я не корректно использую термин, будто от этого улучшится Ваше понимание вопроса. Т.е. получается, Вам интересно обсуждать форму изложения мыслей, а суть совершенно не интересна. Поэтому я и делаю вывод, что вопросы Вы не задаёте по существу, а хотите лишь доказать, что я не правильно использую термин, что, вероятно, придаст Вам чувство гордости и удовлетворения за счет того, что Вы знаете лучше терминологию. Таким образом, обсуждение не идёт в предметном русле, а направлено на выявление особенностей одного индивида по отношению к другому, при этом делаются некие качественные суждения об индивиде. Такой стиль приведёт к конфликту - так как это похоже на самоутверждение за счет других.

Ещё раз, поясню суть, что я закладывал в свои слова - при выборе сплита есть общепринятые метрики, с помощью которых оценивается эффект от сплита, жадный метод предполагает выбор максимального эффекта. Мой алгоритм уменьшает число кандидатов для выбора, поэтому он уже не является жадным методом относительно вариантов стандартной метрики, так как то, что было лучшим, может исчезнуть из выбора. Вот такой был смысл.

Следующее предложение буквально "И уже из них выбираем по какому то критерию - не обязательно по жадности." - тут я пишу, что да, если рассматривать мой алгоритм отдельно, то выбор так же можно считать, что будет происходить по жадности, но уже по своей оценке, которая включает в себя множество иных метрик и суммарный показатель будет максимумом. "Не обязательно по жадности" - значит, что алгоритм позволяет использовать как случайный выбор, так и намеренно эффективный относительно новых данных, кроме того, есть реализация алгоритма экономической эффективности выбора - когда оценивается цена последствий от выбора (тут публиковал ранее работу такого алгоритма - гифки).

Если уж и после столь детальных разъяснений причины выбора термина в моём сообщение, Вы желаете обсуждать допустимость его использования, то мне будет очень жаль, что желание искать недостатки в стиле изложения мыслей пересилит желание обсуждать результаты и методологию исследования.

 
mytarmailS #:
Вы не первый) 

У него есть желание обсуждать термины, и он постарался понять суть. А Вам где и что не понятно - вот написали бы конкретно - дал бы и ответ.

 
Maxim Dmitrievsky #:

забил последние несколько ваших постов в чатгпт 4:

Ну, хоть ChatGPT оценил мой подход добрым словом.

Вот даже не знаю - получается, что контекст улавливает лучше, чем человеки здешние....

Maxim Dmitrievsky #:

Отсебятина:

кто вам сказал, что ваши метки классов помогают модели определить лучшие квантрезки (кластеры), а не ухудшают результат отбора, если бы вы просто использовали кластеризацию?

Потому надо определиться, у вас model based или model agnostic подход. Можно делать и так и так, но второй предпочтительнее, потому что опирается только на данные, а не на структуру модели.

Речь не идёт о лучших или худших метках, а речь о возможности нахождения закономерности с любыми метками и отборе предикторов для этого.

Я не понимаю Ваш посыл - Вы хотите, что бы я отказался от своего метода и стал использовать только кластеризацию? В чём суть то?

[Удален]  
Aleksey Vyazmikin #:

Ну, хоть ChatGPT оценил мой подход добрым словом.

Вот даже не знаю - получается, что контекст улавливает лучше, чем человеки здешние....

Речь не идёт о лучших или худших метках, а речь о возможности нахождения закономерности с любыми метками и отборе предикторов для этого.

Я не понимаю Ваш посыл - Вы хотите, что бы я отказался от своего метода и стал использовать только кластеризацию? В чём суть то?

нет, он всегда поддакивает, поэтому часто используется на форуме в кач-ве доказательства их слов

суть чтобы свести вашу работу к научной, с нормальными определениями, которые понимают другие
 
Maxim Dmitrievsky #:

нет, он всегда поддакивает

суть чтобы свести вашу работу к научной, с нормальными определениями

Вам там нормально написали в чём отличия от кластеризации. На научную степень не претендую.

Лучше напишите, в чём Вы видите смысл применять иерархическую кластеризацию, чем она лучше K-Means и моего дерева на базе K-Means.

[Удален]  
Aleksey Vyazmikin #:

Вам там нормально написали в чём отличия от кластеризации. На научную степень не претендую.

Лучше напишите, в чём Вы видите смысл применять иерархическую кластеризацию, чем она лучше K-Means и моего дерева на базе K-Means.

я не вижу чем она лучше. Я вижу смысл применять любую кластеризацию без меток, чтобы анализировать и выбирать данные, а потом поверх них размечать и обучать любую модель. Это как-то интуитивно понятно что ли.

 
Maxim Dmitrievsky #:

я не вижу чем она лучше. Я вижу смысл применять любую кластеризацию без меток, чтобы анализировать и выбирать данные, а потом поверх них размечать и обучать любую модель. Это как-то интуитивно понятно что ли.

Да - нормальный базовый сценарий.

 
Aleksey Vyazmikin #:

Ещё раз - Вы акцентируете внимание на термины, но не на содержание. Ранее я уже пояснил, почему использовал такой термин и почему считаю это уместным. Вместо того, что бы для себя отметить, что у Вас другое мнение об уместности применения термина, и перейти к обсуждению сути, Вы акцентируете внимание на том, что я не корректно использую термин, будто от этого улучшится Ваше понимание вопроса. Т.е. получается, Вам интересно обсуждать форму изложения мыслей, а суть совершенно не интересна. Поэтому я и делаю вывод, что вопросы Вы не задаёте по существу, а хотите лишь доказать, что я не правильно использую термин, что, вероятно, придаст Вам чувство гордости и удовлетворения за счет того, что Вы знаете лучше терминологию. Таким образом, обсуждение не идёт в предметном русле, а направлено на выявление особенностей одного индивида по отношению к другому, при этом делаются некие качественные суждения об индивиде. Такой стиль приведёт к конфликту - так как это похоже на самоутверждение за счет других.

Ещё раз, поясню суть, что я закладывал в свои слова - при выборе сплита есть общепринятые метрики, с помощью которых оценивается эффект от сплита, жадный метод предполагает выбор максимального эффекта. Мой алгоритм уменьшает число кандидатов для выбора, поэтому он уже не является жадным методом относительно вариантов стандартной метрики, так как то, что было лучшим, может исчезнуть из выбора. Вот такой был смысл.

Следующее предложение буквально "И уже из них выбираем по какому то критерию - не обязательно по жадности." - тут я пишу, что да, если рассматривать мой алгоритм отдельно, то выбор так же можно считать, что будет происходить по жадности, но уже по своей оценке, которая включает в себя множество иных метрик и суммарный показатель будет максимумом. "Не обязательно по жадности" - значит, что алгоритм позволяет использовать как случайный выбор, так и намеренно эффективный относительно новых данных, кроме того, есть реализация алгоритма экономической эффективности выбора - когда оценивается цена последствий от выбора (тут публиковал ранее работу такого алгоритма - гифки).

Если уж и после столь детальных разъяснений причины выбора термина в моём сообщение, Вы желаете обсуждать допустимость его использования, то мне будет очень жаль, что желание искать недостатки в стиле изложения мыслей пересилит желание обсуждать результаты и методологию исследования.

В качестве эпиграфа, из Фауста Гёте: "Студент: Да, но словам ведь соответствуют понятья."

Акцентирую внимание на соответствии из эпиграфа. Интересуют вопросы: (1) считаете ли что ваш алгоритм даёт гарантированный (или хотя бы с бОльшей вероятностью) глобальный максимум ваших кастомных метрик? (2) Если ответ на первый вопрос "да", то за счёт чего это удаётся?

Если ответ на первый вопрос "нет", то вы просто смываете в унитаз возможность адекватного общения из-за произвольной подмены понятий.
 
Те что вся суть этого хитрого алгоритма это обучаться не на обычных данных, а на центроидах кластеров этих данных?

И потом просто отбор лучшых правил из модели по какой то метрике
 
Aleksey Vyazmikin #:
Вы акцентируете внимание на термины, но не на содержание.

Человек не понимает, или делает вид, что не понимает, что НЕ бывает терминов без содержания, а содержания без терминов - это одно целое. Если этого соответствия нет, то это просто набор слов, которые не имеют никакого значения, т.е. набор букв, не имеющих содержания.

Просмотрел последние страницы, очень похоже на специфический толлинг.