Статистика та великі дані

Питання та відповіді для людей, зацікавлених у статистиці, машинному навчанні, аналізі даних, інтелектуальному аналізу даних та візуалізації даних

2
Наскільки точний IQR для виявлення людей, що вижили
Я пишу сценарій, який аналізує час запуску процесів. Я не впевнений у їх розподілі, але хочу знати, чи процес триває "занадто довго". Поки що я використовував 3 стандартні відхилення останніх періодів запуску (n> 30), але мені сказали, що це не дає нічого корисного, якщо дані не є нормальними (що, здається, …

1
Біноміал Нег і пріоритет Джеффріса
Я намагаюся отримати попереднє значення Джефріса для негативного розподілу біномів. Я не бачу, де я помиляюся, тому, якщо хтось міг би допомогти вказати на це, це буде вдячно. Гаразд, ситуація така: я повинен порівнювати попередні розподіли, отримані за допомогою біноміального та негативного двочленів, де (в обох випадках) є випробувань і …

1
Нульова гіпотеза еквівалентності
Припустимо, - простий випадковий вибірки з нормального розподілу. ( μ , σ 2 )Х1, X2,. . ., XнX1,X2,...,XnX_1, X_2, \, ... \, , X_n( μ , σ2)(μ,σ2)(\mu,\sigma^2) Мені цікаво зробити наступний тест на гіпотезу: для заданої постійної .c > 0Н0: | мк | ≤ cН1: | мк | > c …

2
просторова автокореляція для даних часових рядів
У мене є 20-річний набір даних про щорічну кількість чисельності видів для набору багатокутників (~ 200 неправильних форм, суцільних багатокутників). Я використовую регресійний аналіз для висновку тенденцій (зміна кількості в рік) для кожного полігону, а також агрегації даних полігонів на основі меж управління. Я впевнений, що в даних є просторова …

4
Байєсовські неінформативні пріори проти часто зустрічаються нульових гіпотез: які стосунки?
Я натрапив на це зображення у публікації блогу тут . Я був розчарований, що читання заяви не викликало у мене такого самого виразу обличчя, як це для цього хлопця. Отже, що мається на увазі під твердженням, що нульовою гіпотезою є те, як часто лікарі висловлюють неінформативний поперед? Це справді правда? …

2
Чи є в цьому модельному підході надмірне обладнання
Нещодавно мені сказали, що процес, за яким я дотримувався (складова дисертації з МС), може розглядатися як надмірно придатний. Я шукаю, щоб краще зрозуміти це і побачити, чи згодні інші. Метою цієї частини статті є: Порівняйте продуктивність градієнтних підсилених регресійних дерев проти випадкових лісів на наборі даних. Подивіться на ефективність обраної …

2
Чи можу я включити розмір ефекту як незалежну змінну в метарегресію?
Моє питання полягає в тому, чи можна використовувати розмір ефекту ХXX як залежну змінну, а інший розмір ефекту YYY як незалежну змінну в метарегресії? Наприклад, я провів метааналіз на вплив фізичних вправ на проблеми з питтям і виявив значні результати та високу неоднорідність. Я хочу зробити мета-регресію та використовувати розмір …

8
Візуалізація даних високих розмірів
У мене є зразки двох класів, які є векторами у просторі великого розміру, і я хочу побудувати їх у 2D або 3D. Я знаю про методи зменшення розмірності, але мені потрібен дійсно простий і простий у використанні інструмент (в matlab, python або заздалегідь вбудований .exe). Також мені цікаво, чи буде …

2
Яка хороша візуалізація для регресій Пуассона?
Я хочу пов’язати дефекти коду з такими показниками складності коду, як близькість. Одна поширена модель полягає в тому, щоб розглядати це як процес Пуассона, де тривалість - це скільки часу витрачається на кодування, а щільність - функція складності коду. Я в змозі зробити регресію і отримати значення значущості тощо. Однак …

8
Яке статистичне програмне забезпечення підходить для викладання студентського вступного курсу статистики з соціальних наук?
Я шукаю пакет програм статистики, який я можу використати у вступному курсі статистики для навчальної програми з суспільствознавства. Студенти не мають попередніх знань зі статистики та не мають досвіду роботи з мовами програмування. Мета полягає в тому, щоб ознайомити їх з основними статистичними поняттями (як засоби, дисперсія, сума квадратів, p-значень, …

5
Що робити з колінеарними змінними
Відмова: Це для домашнього завдання. Я намагаюся придумати найкращу модель для ціни на алмази, залежно від кількох змінних, і, здається, поки що у мене досить гарна модель. Однак я зіткнувся з двома змінними, які, очевидно, колінеарні: >with(diamonds, cor(data.frame(Table, Depth, Carat.Weight))) Table Depth Carat.Weight Table 1.00000000 -0.41035485 0.05237998 Depth -0.41035485 1.00000000 …

1
Матриця коваріації для Гауссового процесу та розподілу Вішарта
Я читаю цей документ про Узагальнені процеси Вішарта (GWP). У роботі обчислюються коваріації між різними випадковими змінними (за Гауссовим процесом ) за допомогою функції експоненціальної коваріації у квадраті, тобто . Потім йдеться про те, що ця матриця коваріації слідує за GWP.K(x,x′)=exp(−|(x−x′)|22l2)K(x,x′)=exp⁡(−|(x−x′)|22l2)K(x,x') = \exp\left(-\frac{|(x-x')|^2}{2l^2}\right) Я думав, що коваріаційна матриця, обчислена з …

2
Як знайти міру кореляції між двома номінальними змінними?
Було проведено опитування, де люди обирали те, що використовують певний смайлик для представлення та в’їхали до своєї країни походження. Я переписав текстові відповіді на числові. Яку форму аналізу слід використовувати (бажано в SPSS), щоб перевірити рівень співвідношення між тим, звідки люди походять, та обраними ними представленнями?

1
Інтуїтивне розуміння коваріації, перехресної коваріації, авто- / перехресної кореляції та щільності спектру потужності
В даний час я навчаюсь для мого фіналу базової статистики для свого бакалавра ЄЕК. Хоча я думаю, що в мене математика здебільшого знижена, мені не вистачає інтуїтивного розуміння того, що насправді означають цифри. (Преамбула: Я буду використовувати досить неохайну мову). Я знаю, що E [X] є "середньозваженим" для всіх результатів …

1
Чи завжди ступінь свободи для тесту Вельча менша, ніж коефіцієнт DF для об'єднаного тесту?
Я викладаю курс з основ статистики, і ми робимо t-тест для двох незалежних зразків з неоднаковими відхиленнями (тест Вельча). У наведених прикладах скоригована ступінь свободи, використовувана тестом Велча, завжди менша або дорівнює . n1+n2−2n1+n2−2n_1+n_2-2 Це завжди так? Чи завжди тест Велча знижує (або залишає без змін) ступінь свободи об'єднаного (рівних …

Використовуючи наш веб-сайт, ви визнаєте, що прочитали та зрозуміли наші Політику щодо файлів cookie та Політику конфіденційності.
Licensed under cc by-sa 3.0 with attribution required.