Статистика та великі дані

Питання та відповіді для людей, зацікавлених у статистиці, машинному навчанні, аналізі даних, інтелектуальному аналізу даних та візуалізації даних

2
Яка ймовірність того, що букмекерський контент неціновує шанси на футбольні ігри?
Англійська футбольна команда проводить серію матчів проти різних супротивників різної здатності. Букмекер пропонує для кожного матчу шанси на те, чи буде це перемога удома, виграна в гостях чи нічия. Протягом сезону команда зіграла матчів і з них , що більше, ніж можна очікувати від шансів.nnnkkk Яка ймовірність того, що букмекер …

1
Як R я можу посилатись \ пошук у cdf стандартної нормальної таблиці розподілу?
Заблокований . Це запитання та його відповіді заблоковано, оскільки це питання поза темою, але має історичне значення. Наразі не приймає нових відповідей чи взаємодій. Я припускаю, що R має цю вбудовану. Як я можу посилатися на це?

4
Як обчислити довірчі інтервали для об'єднаних непарних коефіцієнтів у мета-аналізі?
У мене є два набори даних із досліджень, пов'язаних з геномом. Єдиною доступною інформацією є непарні коефіцієнти та їх довірчі інтервали (95%) для кожного генотипованого SNP. Я хочу створити лісову ділянку, порівнюючи ці два коефіцієнти шансів, але я не можу знайти спосіб обчислити комбіновані довірчі інтервали для візуалізації підсумкових ефектів. …

3
Чи неправильно тремтіти перед виконанням тесту Вілкоксона?
Я написав сценарій тестує дані за допомогою wilcox.test, але коли я отримав результати, всі значення p, де дорівнюють 1. Я читав на деяких веб-сайтах, що ви можете використовувати тремтіння перед тестуванням даних (щоб уникнути зв’язків, як вони сказали), Я це зробив і зараз маю прийнятний результат. Чи неправильно це робити? …
9 r  nonparametric  ties 

1
Чи є простий спосіб поєднати дві моделі glm в R?
У мене є дві моделі логістичної регресії в R, виготовлені з glm(). Вони обидва використовують однакові змінні, але були зроблені з використанням різних підмножин матриці. Чи є простий спосіб отримати середню модель, яка дає значення коефіцієнтів, а потім використовувати це за допомогою функції predict ()? [Вибачте, якщо цей тип запитань …

1
Як побудувати квадрати для точкових процесів, які сильно відрізняються за частотою?
Я хочу здійснити аналіз лічильника квадрата на декількох точкових процесах (або одному позначеному точковому процесі), щоб потім застосувати деякі методи зменшення розмірності. Мітки не однаково розподілені, тобто деякі знаки з’являються досить часто, а деякі досить рідко. Таким чином, я не можу просто розділити 2D-простір на звичайній сітці, тому що більш …

1
Чи існує назва цього типу завантажувальної програми?
Розглянемо експеримент із кількома учасниками людини, кожен вимірював кілька разів у двох умовах. Модель змішаних ефектів може бути сформульована (використовуючи синтаксис lme4 ) як: fit = lmer( formula = measure ~ (1|participant) + condition ) Тепер, скажіть, я хочу генерувати завантажені інтервали довіри для прогнозів цієї моделі. Я думаю, що …

3
Співвідношення Спірмена або Пірсона зі шкалою Лікерта, де можуть порушуватися лінійність та гомоскедастичність.
Я хочу провести кореляцію в ряді вимірювань, де використовувались шкали Лікерта. Дивлячись на розсіювачі, здається, припущення про лінійність та гомоскедастичність можуть бути порушені. З огляду на те, що, мабуть, виникають дебати навколо порядкового рівня оцінювання, що наближаються до шкали інтервального рівня, чи варто це захистити і використовувати Rho Spearman, а …

1
Дискретні функції: Покриття інтервалу довіри?
Як розрахувати дискретний інтервал покриття? Що я вмію робити: Якби у мене була модель безперервної дії, я міг би визначити 95% довірчий інтервал для кожного з моїх передбачуваних значень, а потім побачити, як часто фактичні значення знаходилися в межах довірчого інтервалу. Я можу виявити, що лише 88% часу мій інтервал …

4
Посилання на числову оптимізацію для статистиків
Я шукаю грунтовну довідку (або посилання) на методики чисельної оптимізації, спрямовані на статистиків, тобто вона застосовуватиме ці методи до деяких стандартних інфекційних проблем (наприклад, MAP / MLE у звичайних моделях). Такі речі, як градієнтний спуск (прямий і стохастичний), ЕМ та його витоки / узагальнення, імітований відпал тощо. Я сподіваюся, що …

2
Чи можливо використовувати ядро ​​PCA для вибору функцій?
Чи можливо використовувати аналіз основних компонентів ядра (kPCA) для латентної семантичної індексації (LSI) так само, як використовується PCA? Я виконую LSI в R за допомогою функції prcompPCA і добуваю функції з найвищими навантаженнями з перших компонентів. Цим я отримую функції, що описують компонент найкраще.kkk Я спробував використати kpcaфункцію (з kernlibпакета), …

4
Для чого використовується стандартна помилка?
Я використовую знайдений нами підручник і будую середні значення разом зі стандартними помилками, щоб показати свої дані. Але у мене виникають проблеми з обговоренням результатів. Мій сюжет, як показано нижче: деякі стандартні помилки (показані у вигляді рядка помилок) сильно різняться, а деякі з них дуже близькі до нуля.

2
Як знайти зв’язки між різними типами подій (визначеними їх двозначним розташуванням)?
У мене є набір даних про події, які сталися за той самий період часу. Кожна подія має тип (є кілька різних типів, менше десяти) та місцеположення, представлене у вигляді 2D точки. Я хотів би перевірити, чи є кореляція між типом подій, або між типом та місцеположенням. Наприклад, можливо, події типу …

3
Позитивний стабільний розподіл в R
Позитивні стабільні розподіли описуються чотирма параметрами: параметр перекосу , параметр масштабу , параметр розташування тощо -названий параметр індексу . Коли дорівнює нулю, розподіл симетричний навколо , коли він є позитивним (відповідно негативним), розподіл перекошено вправо (відповідно ліворуч) Стабільний розподіл дозволяє жирові хвости, коли зменшується.β∈ [ - 1 , 1 ]β∈[-1,1]\beta\in[-1,1]σ> …

3
Використання серединного лаку для вибору ознак
У статті, яку я читав нещодавно, в розділі аналізу даних я натрапив на наступний біт: Далі таблицю даних розділили на тканини та клітинні лінії, а обидві підмножини були окремо відполіровані медіаною (рядки та стовпці були ітераційно відрегульовані, щоб мати медіану 0), перш ніж вони були знову об'єднані в одну таблицю. …

Використовуючи наш веб-сайт, ви визнаєте, що прочитали та зрозуміли наші Політику щодо файлів cookie та Політику конфіденційності.
Licensed under cc by-sa 3.0 with attribution required.