Форум врачей-аспирантов

Здравствуйте, гость ( Вход | Регистрация )

> Вопрос по анализу данных
Alex
сообщение 3.04.2007 - 19:02
Сообщение #1





Группа: Пользователи
Сообщений: 6
Регистрация: 3.04.2007
Пользователь №: 4028



Уважаемые господа, можно ли обратиться к Вам за помощью?
Имеется база данных, основанная на анкетировании более 1500 человек, в которой категориально (да - нет) отражены такие симптомы как головные боли, боли в пояснице, боли в грудной клетке и пр. (более 30), на их основе вычисленный индекс состояния здоровья (непрерывная величина от 0 до 1). Для каждого случая естественно записаны предикты, такие как населенный пункт, возраст (или возрастная группа), пол, профессия, привычки, группа риска (на основе воздействия химических загрязнителей поллютантов - 3 группы) и пр.
Стоит задача выявить предикторы вызывающие значимое повышение отношение шансов наблюдаемых симптомов, а также оценить комплексное влияние этих факторов (предикторов).

Попытка провести данный анализ методом логистической регрессии с помощью одноименного модуля epi info 2000 (стандартная программа используемая в эпидемиалогии и лежащая в свободном доступе) дает неплохие результаты при
учете только одного из перечислденных факторов. При учете нескольких взаимодействующих факторов, получаем
неподдающиеся интерпретации результаты, что может быть вызвано однако сильной взаимосвязью предикторов, которые возможно необходимо минимизировать (что не хотелось бы, из-за потери части информации).

В связи с этим хотелось бы обратиться к Вам с вопросом, может имеет смысл воспользоваться каким-нибудь другим методом анализа?

Будем рады любому ответу...

P.S. Пользуем программу Statistica 6
Вернуться в начало страницы
 
+Ответить с цитированием данного сообщения
 
 
Открыть тему
Ответов
плав
сообщение 3.04.2007 - 23:08
Сообщение #2





Группа: Пользователи
Сообщений: 1013
Регистрация: 4.10.2006
Пользователь №: 1933



Боюсь, что тут вышла некоторая путаница frown.gif Логистическая регрессия используется в том случае, если зависимая переменная бинарная (0 или 1), т.е. для самих симптомов пойдет, а вот для индекса здоровья - нет. Соответственно, для индекса здоровья надо немного повыкручиваться (хочется использовать линейную регрессию, но интервал ограничен, соответственно, оптимально было бы - если нет большого количества 0 значений взять логарифм индекса здоровья и его использовать в качестве зависмой переменной.
Далее, не забудьте, что качественные переменные описывающие предикторы с более чем 2 группами должны быть разложены на переменные-пустышки.
Если же у Вас не идет логистическая регрессия с бинарными зависимыми переменными, то надо посмотреть настройки логистической регрессии в программе (я вот только не понял, зачем при наличии Statistica пользовать EpiInfo, если в первой модуль логистической регрессии значительно приятнее и проще используется при проблемах со схождением...)
Вернуться в начало страницы
 
+Ответить с цитированием данного сообщения
 

Сообщений в этой теме


Добавить ответ в эту темуОткрыть тему