Статистика та великі дані

Питання та відповіді для людей, зацікавлених у статистиці, машинному навчанні, аналізі даних, інтелектуальному аналізу даних та візуалізації даних

1
Чому не можна узагальнити тест Колмогорова-Смірнова на 2 або більше виміри?
Питання каже все це. Я читав і те, і інше не може узагальнити KS до розміру, рівного або більшого, ніж два , і що відомі такі реалізації, як у цифрових рецептах , просто неправильні. Чи можете ви поясніть, чому так?

1
Як порівняти силу двох кореляцій Пірсона?
Мене рецензент запитав, чи можна порівняти співвідношення Пірсона (r-значення), представлені в таблиці, один з одним, щоб можна було стверджувати, що один "сильніший" за інший (крім того, що просто окуляри реальні r-значення) . Як би ти пішов з цього приводу? Я знайшов цей метод http://vassarstats.net/rdiff.html але я не впевнений, якщо це …

1
Імовірний розподіл функцій випадкових величин?
У мене виникають сумніви: розглянемо реальні значущі випадкові величини і визначені на просторі ймовірностей .ХXXZZZ( Ω , F, P )(Ω,F,P)(\Omega, \mathcal{F},\mathbb{P}) Нехай , де - реально оцінена функція. Оскільки - функція випадкових змінних, це випадкова величина.Y: = g( X, Z)Y:=g(X,Z)Y:= g(X,Z)г( ⋅ )g(⋅)g(\cdot)YYY Нехай , тобто реалізацію .x : = …

2
Оцінка розміру перетину декількох множин за допомогою вибірки одного набору
Я працюю над алгоритмом, який повинен обчислити розмір набору, генерованого перетинами щонайменше 2 множин. Більш конкретно: z=|A0∩…∩An|z=|A0∩…∩An| z = \left |A_0 \cap \ldots \cap A_n \right | Набори, які перетинаються, генеруються за допомогою SQL-запитів, і, прагнучи швидко тримати речі, я отримую підрахунок кожного запиту достроково, потім беру набір з найменшим …
10 error  sample 

2
Чому алгоритм ітерації політики переходить до оптимальної функції політики та значення?
Я читав конспекти лекцій Ендрю Нґ про навчання підкріплення, і я намагався зрозуміти, чому ітерація політики перейшла до функції оптимального значенняV∗V∗V^*та оптимальна політика .π∗π∗\pi^* Нагадаємо, ітерація політики: Ініціалізуйте π випадковим чиномПовторити {Л е т V : =Vπ \ для поточної політики розв’яжіть рівняння Беллмана та встановіть його на поточний VL …

1
Як інтерпретувати P-значення GAM?
Мене звуть Х'ю, і я докторант, використовуючи узагальнені моделі добавок, щоб зробити деякий дослідницький аналіз. Я не впевнений, як інтерпретувати значення p, що надходять із пакету MGCV, і хотів перевірити своє розуміння (я використовую версію 1.7-29 та ознайомився з деякою документацією Simon Wood). Спочатку я шукав інші питання з резюме, …
10 p-value  mgcv 

2
P значення для терміну взаємодії в моделях зі змішаними ефектами з використанням lme4
Я аналізую деякі поведінкові дані, використовуючи, lme4в Rосновному дотримуючись чудових навчальних посібників Bodo Winter , але я не розумію, чи правильно обробляю взаємодію. Гірше, що ніхто більше не бере участь у цьому дослідженні, не використовує змішаних моделей, тому я трохи похитнувся, коли потрібно переконатися, що все правильно. Замість того, щоб …

3
Різні непараметричні методи оцінки розподілу ймовірності даних
У мене є деякі дані, і я намагався прилаштувати до неї плавну криву. Однак я не хочу застосовувати занадто багато попередніх переконань або занадто сильних попередніх уявлень (за винятком тих, які маються на увазі в решті мого запитання) щодо цього чи будь-яких конкретних розподілів. Мені просто хотілося встановити його з …

1
Як обчислити довірчий інтервал 95% для нелінійного рівняння?
У мене є рівняння, щоб передбачити вагу ламантетів від їх віку, в днях (діас, португальською мовою): R <- function(a, b, c, dias) c + a*(1 - exp(-b*dias)) Я моделював це в R, використовуючи nls (), і отримав цю графіку: Тепер я хочу обчислити довірчий інтервал 95% і побудувати його на …

2
Чи є функціональна різниця між коефіцієнтом шансів і коефіцієнтом небезпеки?
У логістичній регресії коефіцієнт шансів 2 означає, що подія в 2 рази більш вірогідна, якщо врахувати прогноз на один одиницю. У регресії Кокса коефіцієнт небезпеки 2 означає, що подія відбуватиметься вдвічі частіше в кожний момент часу, враховуючи прогнозування на один одиницю. Це практично не те саме? У чому ж тоді …

1
Як виміряти надійність рейтингу консенсусу (проблема з книги Kemeny-Snell)
Припустимо, що від кожного експерта пропонується класифікувати набір з об’єктів за порядком чи уподобанням. Нехай дозволяють зв'язки у рейтингу.ккkннn Джон Кемені та Лорі Снелл у своїй книзі "Математичні моделі соціальних наук" про 1962 рік пропонують вирішити наступну проблему: ПРОЕКТ . Розробіть міру надійності ранжирування консенсусу експертами. Наприклад, це може ґрунтуватися …

2
Варіаційно-коваріаційна структура для випадкових ефектів у lme4
Яка структура дисперсії-коваріації за замовчуванням для випадкових ефектів у пакеті glmerчи lmerв ньому lme4? Як можна вказати іншу структуру коваріації дисперсії для випадкових ефектів у коді? Я не зміг знайти жодної інформації щодо цього в lme4документації.

3
Що краще, stl або розкласти?
Я роблю аналіз часових рядів за допомогою Р. Я повинен розкласти свої дані на тренд, сезонну та випадкову складові. У мене є дані за тиждень протягом 3 років. Я знайшов дві функції в R - stl()і decompose(). Я читав, що stl()не годиться для мультиплікативного розкладання. Хтось може мені сказати, в …
10 r  time-series 

3
Чи обчислення "фактичної ймовірності покриття" те саме, що обчислення "достовірного інтервалу"?
Я читав підручник зі статистикою початкового рівня. У главі про максимальну оцінку ймовірності частки успішності в даних з біноміальним розподілом було дано формулу для обчислення довірчого інтервалу, а потім нестандартно згадується Розглянемо його фактичну ймовірність покриття, тобто ймовірність того, що метод виробляє інтервал, який фіксує справжнє значення параметра. Це може …

3
Ймовірність перетину від багаторазового відбору проб однієї сукупності
Ось приклад випадку: У мене населення 10 000 предметів. Кожен елемент має унікальний ідентифікатор. Я випадковим чином вибираю 100 предметів і записую ідентифікатори Я повернув 100 предметів назад серед населення Я випадковим чином знову вибираю 100 предметів, записую ідентифікатори та замінюю. Загалом я повторюю цю випадкову вибірку 5 разів Яка …

Використовуючи наш веб-сайт, ви визнаєте, що прочитали та зрозуміли наші Політику щодо файлів cookie та Політику конфіденційності.
Licensed under cc by-sa 3.0 with attribution required.