Какие выборки считаются связанными |
Здравствуйте, гость ( Вход | Регистрация )
Какие выборки считаются связанными |
2.12.2011 - 07:39
Сообщение
#1
|
|
Группа: Пользователи Сообщений: 33 Регистрация: 31.07.2008 Пользователь №: 5185 |
Всем добрый день! Столкнулась с проблемой и просто зациклилась на ней. Пример из книги В.Ю. Урбаха : две делянки пшеницы, одна опыт, вторая контроль, измерялась урожайность раз в год.
Год| 1947|1948|1949|1950|1951|1952|1953 Опыт|22.9|20.2|19.5|30.5|35.6|31.9|27.7 Контроль|19.4|16.2|16.9|29.3|31.4|28.5|26.6 Для сравнения урожайности применяется критерий Стьюдента для парных выборок. У меня аналогичная задача, но я не могу доказать, почему эти выборки следует считать парными. На все мои объяснения, что опыт и контроль связаны годом, и что нельзя сравнивать урожайность первой делянки за 1947 год и урожайность второй делянки, например, за 1953г., а необходимо рассматривать именно пары, мне рассказывают про пациентов до и после лечения, и что там да, связанные, а здесь никакой связи нет. Может быть я не права? А если права, то, как объяснить так, чтобы не у кого не возникало никаких сомнений. Помогите, пожалуйста! Заранее большое спасибо. |
|
5.12.2011 - 05:44
Сообщение
#2
|
|
Группа: Пользователи Сообщений: 33 Регистрация: 31.07.2008 Пользователь №: 5185 |
Спасибо большое?действительно спасибо.
Буду сидеть читать, пытаться разобраться. На самом деле задача состоит в том, чтобы сказать больше всё-таки этих несчастных койко-мест в городе 2, чем в городе 1, или нет. Притом такая задача у меня возникает постоянно, когда надо сравнивать показатели в динамике в двух городах, например болезненность населения, смертность, рождаемость и т.д. При этом часто данные показатели необходимо сравнить и внутри одного города по разным группам, например болезненность мужчин и женщин, уровень инвалидизации в разных возрастных группах и т.д. Почему-то вся литература, которую я нашла, направлена на описание методов применительно к клиническим исследованиям - группа опыта, группа контроля. Если кто-то порекомендует книгу про анализ показателей здравоохранения в рамках города, региона и т.д. буду очень признательна. Я училась на информатика в сфере управления и у нас был только один курс статистики за всё время обучения, да и то на уровне что такое дисперсия и что такое среднее, а работать приходится как раз в сфере статистики и анализа (притом работа очень нравится). Читаю книги, но, к сожалению, почему-то не хватает ясности и четкости, что и когда надо делать и желательно с объяснением, почему это надо делать. С удовольствием прошла бы курсы по статистике и анализу, но в городе таковых нет, дистанционные курсы есть у Леонова, но цена этих курсов, к сожалению, для меня неподъемная. Поэтому буду рада любой помощи: ссылкам на статьи, книги, курсы? еще раз спасибо всем большое. |
|
5.12.2011 - 11:18
Сообщение
#3
|
|
Группа: Пользователи Сообщений: 902 Регистрация: 23.08.2010 Пользователь №: 22694 |
Спасибо большое?действительно спасибо. Буду сидеть читать, пытаться разобраться. На самом деле задача состоит в том, чтобы сказать больше всё-таки этих несчастных койко-мест в городе 2, чем в городе 1, или нет. Притом такая задача у меня возникает постоянно, когда надо сравнивать показатели в динамике в двух городах, например болезненность населения, смертность, рождаемость и т.д. Поэтому буду рада любой помощи: ссылкам на статьи, книги, курсы? еще раз спасибо всем большое. Тогда можно поступить следующим образом (не желая усложнять Вам жизнь): два разных города - это две независимые выборки. Тестируете критерием Стьюдента для независимых выборок (или критерием Крамера-Уэлча в терминологии проф. Орлова). Если сравнивать показатели койко-мест в динамике - то для двух этих временных рядов просто посчитайте цепные и базисные темпы роста (прироста) Не забудьте также средний темп роста (прироста) по формуле средней геометрической. И для одного из рядов (у которого средний темп окажется выше) посчитать т.н. коэффициент опережения. Успехов! Сообщение отредактировал 100$ - 5.12.2011 - 11:40 |
|
5.12.2011 - 11:59
Сообщение
#4
|
|
Группа: Пользователи Сообщений: 1091 Регистрация: 26.08.2010 Пользователь №: 22699 |
Тогда можно поступить следующим образом (не желая усложнять Вам жизнь): два разных города - это две независимые выборки. Тестируете критерием Стьюдента для независимых выборок (или критерием Крамера-Уэлча в терминологии проф. Орлова). Код > plot(density(data$"Город 1")) > rug(data$"Город 1") > plot(density(data$"Город 2")) > rug(data$"Город 2") А я бы не сравнивал это Стьюдентом. |
|
5.12.2011 - 12:34
Сообщение
#5
|
|
Группа: Пользователи Сообщений: 902 Регистрация: 23.08.2010 Пользователь №: 22694 |
А я бы не сравнивал это Стьюдентом. Скажу Вам как родному: я бы тоже не стал. Поэтому и упомянул Крамера с Уэлчем. Однако вопрос имею. Судя по данным, во втором городе значения явно выше, чем в первом. Интересно, почему при оценке плотности распределения (density) для второго города ширина окна (bandwidth=,0146) меньше, чем для первого (h=,292)? Можно ли в R задавать пользовательское значение этого параметра? P.S. Подозреваю, что если оценить плотность для второго города с параметром h=0,5, то картинка будет, как на первом графике. Такая же одномодальная. Сообщение отредактировал 100$ - 5.12.2011 - 12:44 |
|