Статистика та великі дані

Питання та відповіді для людей, зацікавлених у статистиці, машинному навчанні, аналізі даних, інтелектуальному аналізу даних та візуалізації даних

4
Порівнюючи коефіцієнти логістичної регресії в моделях?
Я розробив модель logit, яку слід застосувати до шести різних наборів даних поперечного перерізу. Я намагаюся розкрити, чи є зміни суттєвого впливу даної незалежної змінної (IV) на залежну змінну (DV), що контролює інші пояснення, в різний час та впродовж часу. Мої запитання: Як я оцінюю збільшення / зменшення розміру в …
11 logistic  spss 

4
Що означає лінійна регресія?
В R, якщо пишу lm(a ~ b + c + b*c) це все-таки буде лінійною регресією? Як зробити інші види регресії в R? Буду вдячний за будь-яку рекомендацію щодо підручників чи навчальних посібників?
11 r  regression 

4
Приклади досліджень з використанням p <0,001, p <0,0001 або навіть нижчих p-значень?
Я походить із соціальних наук, де р &lt;0,05 - це майже норма, і також з'являються р &lt;0,1 і р &lt;0,01, але мені було цікаво: у яких галузях дослідження, якщо такі є, використовуються нижчі значення p як загальні стандартний?

1
Розмір зразка, необхідний для визначення, який із набору рекламних оголошень має найвищу швидкість кліку
Я є дизайнером програмного забезпечення в галузі торгівлі, і працюю над проектом для клієнта, і хотів би переконатися, що мій аналіз є статистично обгрунтованим. Розглянемо наступне: у нас є n рекламних оголошень (n &lt;10), і ми просто хочемо знати, яке оголошення найкраще. Наш сервер оголошень буде випадково розміщувати одну з …

3
Чим відрізняється Z-оцінка від p-значень?
У алгоритмах мережевих мотивів здається досить звичайним повернення і p-значення, і a для статистики Z-оцінка : "Вхідна мережа містить X копій підграфа G". Підграф вважається мотивом, якщо він задовольняє p-значення &lt;A, Z-оцінка&gt; B і X&gt; C, для деяких визначених користувачем (або визначених спільнотою) A, B і C. Це мотивує питання: …

3
Як генерувати рівномірно розподілені точки в 3-денній одиничній кулі?
Я розмістив попереднє запитання , це пов’язано, але я думаю, що краще почати іншу тему. Цього разу мені цікаво, як генерувати рівномірно розподілені точки всередині 3-д одиничної сфери і як перевірити розподіл також візуально та статистично? Я не бачу стратегій, розміщених там, безпосередньо переноситись на цю ситуацію.

4
Маркування коробчастих машин в R
Заблокований . Це запитання та його відповіді заблоковано, оскільки це питання поза темою, але має історичне значення. Наразі не приймає нових відповідей чи взаємодій. Мені потрібно побудувати боксплот без будь-яких осей і додати його до поточного сюжету (крива ROC), але мені потрібно додати більше текстової інформації до boxplot: мітки для …
11 r  boxplot 

2
Як обчислити параметр регуляризації в регресії хребта із заданими ступенями свободи та вхідною матрицею?
Нехай A - матриця незалежних змінних, а B - відповідна матриця залежних значень. У коника регресії, визначимо параметр так , що: . Тепер нехай [usv] = svd (A) і діагональний запис 's'. визначимо ступені свободи (df) = . Регресія хребта зменшує коефіцієнти низькодисперсних компонентів, а отже параметр контролює ступеня свободи. …

2
Як обробити неіснуючі (не пропущені) дані?
Я ніколи не знаходив жодного хорошого тексту чи прикладів, як обробляти "неіснуючі" дані для входів до будь-якого класифікатора. Я багато читав про відсутні дані, але що можна зробити щодо даних, які не можуть або не існують стосовно багатовимірних входів. Я розумію, що це дуже складне запитання і буде змінюватися залежно …

3
Як вибрати хорошу точку роботи з кривих точності відкликання?
Чи існує якийсь стандартний метод визначення "оптимальної" точки роботи на кривій точності відкликання ? (тобто визначення точки на кривій, яка пропонує хороший компроміс між точністю та відкликанням) Дякую

1
Аналіз потужності для аналізу виживання
Якщо я гіпотезую, що генний підпис визначатиме суб'єктів, що мають менший ризик рецидиву, тобто зменшення на 0,5 (коефіцієнт небезпеки 0,5), рівень подій у 20% населення, і я маю намір використати зразки ретроспективного когортного дослідження. розмір вибірки потрібно відкоригувати для неоднакових чисел у двох гіпотезованих групах? Наприклад, використовуючи Collett, D: Моделювання …


2
Використання пуассонової регресії для безперервних даних?
Чи можна розподіл пуассона використовувати для аналізу безперервних даних, а також дискретних даних? У мене є кілька наборів даних, де змінні відповіді є безперервними, але більше нагадують розподіл Пуассона, а не звичайне. Однак розподіл пуассона є дискретним розподілом і зазвичай стосується чисел чи підрахунків.

2
Прогнози на 1 крок вперед із пакетом dynlm R
Я підходив до моделі з декількома незалежними змінними, одна з яких - відставання залежної змінної, використовуючи пакет dynlm. Якщо припустити, що я маю прогнози на 1 крок вперед для моїх незалежних змінних, як я можу отримати прогнози на 1 крок вперед для моїх залежних змінних? Ось приклад: library(dynlm) y&lt;-arima.sim(model=list(ar=c(.9)),n=10) #Create …

1
Прогнозування процесів довгої пам’яті
Я працюю з процесом з в для { 1 , - 1 } t = 1 , 2 , …xtxtx_t{1,−1}{1,−1}\{1, -1\}t=1,2,…t=1,2,…t = 1, 2, \ldots Функція автокореляції вказує на процес з довгою пам’яттю, тобто він відображає розпад закону потужності із показником &lt;1. Ви можете імітувати аналогічний ряд у R за …

Використовуючи наш веб-сайт, ви визнаєте, що прочитали та зрозуміли наші Політику щодо файлів cookie та Політику конфіденційності.
Licensed under cc by-sa 3.0 with attribution required.