Здравствуйте, гость ( Вход | Регистрация )
7.07.2020 - 16:18
Сообщение
#1
|
|
|
Группа: Пользователи Сообщений: 7 Регистрация: 2.07.2020 Пользователь №: 39533 |
Добрый день.
Есть очень большая выборка для бинарной классификации. Нужно предсказать 2 класса(0/1) Есть огромная куча предикторов(независимых переменных), все они категориальные, и известно, что выборка содержит в себе несколько сегментов, в которых поведение предсказываемых классов будет существенно отличаться. Количество сегментов неизвестно. Как грамотно найти эти сегменты и поделить выборку для дальнейшего предсказания? Сообщение отредактировал smeilz - 7.07.2020 - 16:19 |
|
|
![]() |
![]() |
![]() |
8.07.2020 - 11:30
Сообщение
#2
|
|
|
Группа: Пользователи Сообщений: 231 Регистрация: 27.04.2016 Пользователь №: 28223 |
Уважаемый smeilz.
Что-то вы начинаете "путаться в показаниях". На другом форуме вы пишете: Есть датасет с одним бинарным признаком(зависимой переменной) 0 или 1. Распределение 57/43 На этом: Есть очень большая выборка для бинарной классификации. Нужно предсказать 2 класса(0/1) Это как бы две совершенно разные задачи. В одном случае - обучение с учителем (т.е. датасет с признаком) , в другом - обучение без учителя (признака изначально нет). Кроме того, вы так и не пояснили, что означает поведение предсказываемых классов будет существенно отличаться. как вы себе представляете "поведение класса"? В чем оно у час выражается? Что такое "сегмент" и чем он в вашем представлении отличается от "класса". Подчеркну - "предсказываемых классов" ?? Что означает Как грамотно найти эти сегменты и поделить выборку для дальнейшего предсказания? Если вы разбиваете выборку на то-ли сегменты, то-ли классы, то что вы собираетесь предсказывать дальше? Про кластеризацию, и ее возможное использование как предварительный этап классификации вам сказали что тут, что там. Но ясности как не было, так и нет. И я еще раз повторю: Поставьте четко задачу, а то создается все более уверенное впечатление, что вы вообще не очень понимаете, а что в итоге вам надо? Сообщение отредактировал passant - 8.07.2020 - 11:32 |
|
|
![]() |
![]() |
8.07.2020 - 19:41
Сообщение
#3
|
|
|
Группа: Пользователи Сообщений: 902 Регистрация: 23.08.2010 Пользователь №: 22694 |
Цитата Кроме того, вы так и не пояснили, что означает поведение предсказываемых классов будет существенно отличаться. как вы себе представляете "поведение класса"? В чем оно у час выражается? Вестимо, обострение классовой борьбы... |
|
|
![]() |
![]() |
smeilz Как грамотно поделить выборку на несколько сегментов перед предсказанием? 7.07.2020 - 16:18
ogurtsov Кластеризацию нужно сделать, а уж какую - тут мног... 7.07.2020 - 20:07
smeilz Цитата(passant @ 8.07.2020 - 11:30) ... 10.07.2020 - 15:09
ogurtsov Цитата(smeilz @ 10.07.2020 - 15:09) ... 10.07.2020 - 18:23
smeilz Цитата(ogurtsov @ 10.07.2020 - 18:23... 10.07.2020 - 22:23
100$ А мне очень интересно, как скоро в этой теме появ... 8.07.2020 - 18:42
ogurtsov Цитата(100$ @ 8.07.2020 - 18:42... 8.07.2020 - 19:05
passant Нет, коллеги. В данном случае - вы ошибаетесь. Это... 8.07.2020 - 21:31
100$ passant,
поскольку Андрей (Огурцов) ничего ошибо... 9.07.2020 - 00:17
passant Цитата(100$ @ 9.07.2020 - 00:17... 9.07.2020 - 10:55
nokh Цитата(smeilz @ 7.07.2020 - 18:18) Д... 9.07.2020 - 21:11
100$ Цитата(nokh @ 9.07.2020 - 21:11) Бол... 9.07.2020 - 21:50

nokh Цитата(100$ @ 9.07.2020 - 23:50... 10.07.2020 - 08:10

100$ Цитата(nokh @ 10.07.2020 - 08:10) Да... 10.07.2020 - 10:48
smeilz Цитата(nokh @ 9.07.2020 - 21:11) Ваш... 10.07.2020 - 15:13
comisora Всем добрый день.
Самая первая/последняя книга по... 10.07.2020 - 15:28
100$ Ну вот, господа кластеризаторы и примкнувшие к ним... 10.07.2020 - 18:32
ogurtsov Цитата(100$ @ 10.07.2020 - 18:3... 10.07.2020 - 19:14

100$ Цитата(ogurtsov @ 10.07.2020 - 19:14... 10.07.2020 - 20:30

smeilz Цитата(ogurtsov @ 10.07.2020 - 19:14... 10.07.2020 - 21:57
smeilz Цитата(100$ @ 10.07.2020 - 18:3... 10.07.2020 - 21:53

100$ Цитата(smeilz @ 10.07.2020 - 21:53) ... 10.07.2020 - 22:56
smeilz Цитата(100$ @ 10.07.2020 - 18:3... 10.07.2020 - 22:42
passant Цитата(smeilz @ 10.07.2020 - 22:42) ... 10.07.2020 - 23:18![]() ![]() |