Статистика та великі дані

Питання та відповіді для людей, зацікавлених у статистиці, машинному навчанні, аналізі даних, інтелектуальному аналізу даних та візуалізації даних

1
Яка різниця між підсумком () та завантаженнями () для princomp () об'єкта в R?
Приклад коду: (pc.cr <- princomp(USArrests)) summary(pc.cr) loadings(pc.cr) ## note that blank entries are small but not zero Я отримую різні результати від кожного, і я не впевнений, що розумію, в чому різниця. Ось вихід: > summary(pc.cr) Importance of components: Comp.1 Comp.2 Comp.3 Comp.4 Standard deviation 82.8908472 14.06956001 6.424204055 2.4578367034 Proportion …
11 r  pca 

4
Хороший текст про клінічні випробування?
Я студентка зі статистики бакалаврату, яка шукає гарного лікування аналізу клінічних випробувань. Текст повинен охоплювати основи експериментального проектування, блокування, аналізу потужності, латиноамериканського дизайну квадратів та моделей рандомізації кластерів, серед інших тем. Я маю бакалаврські знання з математичної статистики та реального аналізу, але якщо є фантастичний текст, який вимагає трохи більш …

3
Що таке перевірка консистенції?
Мені було задано таке запитання, як "Ви зробили якусь перевірку послідовності у своїй щоденній роботі?" під час телефонного інтерв'ю на посаду біостатиста. Я не знаю, що відповісти. Будь-яка інформація цінується.
11 validation 

3
Чи правильні ці формули для перетворення P, LSD, MSD, HSD, CI в SE як точну або завищену / консервативну оцінку ?
Фон Я провожу метааналіз, який включає раніше опубліковані дані. Часто повідомляються про відмінності між методами лікування з значеннями Р, найменш значущими різницями (LSD) та іншими статистичними даними, але не дають прямої оцінки дисперсії. У контексті моделі, яку я використовую, завищена дисперсія - це нормально. Проблема Ось список перетворень на де …

3
Оцінка середнього і st dev усіченої гауссової кривої без шипа
Припустимо, у мене є чорна скринька, яка генерує дані після нормального розподілу із середнім m та стандартним відхиленням s. Припустимо, однак, що коли він виводить значення <0, воно нічого не записує (навіть не можу сказати, що воно виводить таке значення). У нас усічений гауссовий розподіл без шипу. Як я можу …

6
Чи доцільно трактувати дані n-точкової шкали Лікерта як n випробувань біноміального процесу?
Мені ніколи не подобалося, як люди зазвичай аналізують дані з шкал Лікерта, ніби помилки були суцільними та гауссовими, коли є обґрунтовані очікування, що ці припущення порушені принаймні в крайніх масштабах. Що ви думаєте про наступну альтернативу: Якщо відповідь приймає значення за шкалою точок, розгорніть ці дані до випробувань, з яких …

3
Трансформація, щоб змінити перекос, не впливаючи на куртоз?
Мені цікаво, якщо є перетворення, яке змінює перекос випадкової величини, не впливаючи на куртоз. Це було б аналогічно тому, як аффінна трансформація RV впливає на середню та дисперсію, але не перекос і куртоз (почасти тому, що перекос і куртоз визначаються як інваріантні змінам масштабу). Це відома проблема?

2
Швидко оцініть (візуально) співвідношення між упорядкованими категоричними даними в R?
Я шукаю кореляції між відповідями на різні запитання в опитуванні ("гмм, давайте подивимося, чи відповідають відповіді на питання 11 кореспонденції з питаннями 78"). Усі відповіді категоричні (більшість з них варіюється від "дуже нещасних" до "дуже щасливих"), але деякі мають різний набір відповідей. Більшість з них можна вважати порядковими, тому розглянемо …

6
Як слід визначити проблему проекту 213 Проекту Ейлера ("Блошиний цирк")?
Я хотів би вирішити Project Euler 213, але не знаю, з чого почати, тому що я лайпер в галузі статистики, зауважте, що потрібна точна відповідь, щоб метод Монте-Карло не працював. Чи можете ви порекомендувати деякі теми статистики для мене для читання? Будь ласка, не публікуйте рішення тут. Цифровий цирк Сітка …

6
Як знайти підсумкову статистику для всіх унікальних комбінацій факторів у data.frame в R? [зачинено]
Зачинено. Це питання поза темою . Наразі відповіді не приймаються. Хочете вдосконалити це питання? Оновіть питання, щоб воно було тематичним для перехресної перевірки. Закрито 2 роки тому . Я хочу обчислити підсумок змінної у data.frame для кожної унікальної комбінації факторів у data.frame. Чи варто використовувати для цього plyr? Я все …

6
Наскільки проблематичним є контроль за незалежними коваріатами в спостережному (тобто не рандомізованому) дослідженні?
Міллер і Чапман (2001) стверджують, що абсолютно не доцільно контролювати незалежні коваріати, які пов'язані як із незалежними, так і залежними змінними в спостережному (не рандомізованому) дослідженні, - хоча це звичайно робиться в соціальних науках. Наскільки проблематично це зробити? Як найкраще вирішити цю проблему? Якщо ви регулярно контролюєте незалежність коваріатів у …

4
Кілька тестів на чи-квадрат
Я перехресні класифіковані дані в таблиці 2 x 2 x 6. Назвемо розміри response, Aі B. Я підхожу до логістичної регресії до даних з моделлю response ~ A * B. Аналіз відхилення цієї моделі говорить про те, що як терміни, так і їх взаємодія є важливими. Однак, дивлячись на пропорції …

5
Довідники щодо планування дослідження
У середній (середній?) Розмові про статистику ви часто виявляєте, що обговорюєте той чи інший метод аналізу того чи іншого типу даних. На мій досвід, ретельне проектування дослідження з особливою думкою щодо статистичного аналізу часто нехтують (робота в галузі біології / екології, здається, це є переважним явищем). Статистики часто опиняються в …

2
Як зрозуміти згорнуту мережу глибоких переконань для аудіо класифікації?
У « Конволюційних мережах глибоких переконань для масштабованого без нагляду вивчення ієрархічних уявлень » Лі та ін. al. ( PDF ) Запропоновано згортки DBN. Також метод оцінюється для класифікації зображень. Це звучить логічно, оскільки існують природні локальні особливості зображення, такі як невеликі кути та краї тощо. У статті " Непідконтрольне …

10
Причини, крім прогнозування побудови моделей?
Джошуа Епштейн написав документ під назвою "Чому модель?" доступний на веб- сайті http://www.santafe.edu/media/workingpapers/08-09-040.pdf, в якому наведено 16 причин: Поясніть (дуже відрізняється від передбачення) Збір даних керівництва Світлова динаміка основи Запропонуйте динамічні аналогії Відкрийте для себе нові запитання Пропагуйте наукову звичку розуму Зв'язані (дужки) результати до правдоподібних діапазонів Освітлити основні невизначеності. …
11 modeling 

Використовуючи наш веб-сайт, ви визнаєте, що прочитали та зрозуміли наші Політику щодо файлів cookie та Політику конфіденційності.
Licensed under cc by-sa 3.0 with attribution required.