Статистика та великі дані

Питання та відповіді для людей, зацікавлених у статистиці, машинному навчанні, аналізі даних, інтелектуальному аналізу даних та візуалізації даних

4
Максимальна кількість незалежних змінних, які можна ввести в рівняння множинної регресії
Яка межа обмеження кількості незалежних змінних, яку можна ввести в рівняння множинної регресії? У мене є 10 прогнозів, які я хотів би вивчити з точки зору їх відносного внеску в змінну результатів. Чи слід використовувати корекцію бонферроні для коригування кількох аналізів?

3
Як зробити вибірку з ?
Я хочу взяти вибірку відповідно до щільності де і суворо позитивні. (Мотивація: Це може бути корисно для вибірки Гіббса, коли параметр форми щільності Gamma має рівномірний попередній.)f( a ) ∝ cага - 1Γ ( a )1( 1 , ∞ )( а )f(a)∝cada−1Γ(a)1(1,∞)(a) f(a) \propto \frac{c^a d^{a-1}}{\Gamma(a)} 1_{(1,\infty)}(a) cccгdd Хтось знає, …

3
Як використовувати DLM з фільтруванням Калмана для прогнозування
Невже хтось може провести мене через приклад того, як використовувати фільтрацію DLM Kalman в R за часовим рядом. Скажіть, я маю ці значення (квартальні значення з річною сезонністю); як би ви використовували DLM для прогнозування наступних значень? І BTW, чи вистачає мені історичних даних (який мінімум)? 89 2009Q1 82 2009Q2 …

4
Проста лінійна модель з автокорельованими помилками в R [закрито]
Зачинено. Це питання поза темою . Наразі відповіді не приймаються. Хочете вдосконалити це питання? Оновіть питання, щоб воно було тематичним для перехресної перевірки. Закрито 8 місяців тому . Як мені підходити лінійна модель з автокорельованими помилками в R? У статистиці я використовував би praisкоманду, але не можу знайти еквівалент R …

1
Які алгоритми / методи MCMC використовуються для дискретних параметрів?
Я знаю неабияку кількість пристосування безперервних параметрів, зокрема методів на основі градієнта, але не дуже про пристосування дискретних параметрів. Які зазвичай використовуються алгоритми / методи MCMC для встановлення дискретних параметрів? Чи є алгоритми, які є досить загальними і досить потужними? Чи є алгоритми, які добре справляються з прокляттям розмірності? Наприклад, …
19 bayesian  mcmc 



3
Чи справді байєсівська статистика є поліпшенням порівняно з традиційною (частою) статистикою для поведінкових досліджень?
Під час відвідування конференцій прихильники байєсівської статистики мали певний поштовх для оцінки результатів експериментів. Він оцінюється як більш чутливий, відповідний та вибірковий щодо справжніх висновків (менше помилкових позитивних результатів), ніж частофілістська статистика. Я дещо дослідив цю тему, і поки що я не переконаний у користі використання байєсівської статистики. Байесівські аналізи …

1
Інтерпретація графіків аналізу 2D відповідності
Я шукав в Інтернеті далеко і широко ... Мені ще належить знайти дійсно хороший огляд того, як інтерпретувати сюжети 2D-аналізу кореспонденції. Чи може хтось запропонувати поради щодо тлумачення відстаней між точками? Можливо, приклад допоможе, ось сюжет, який можна знайти на багатьох веб-сайтах, які я бачив, і обговорюють аналіз листування. Червоні …

2
Коли сьогодні має значення "Найближчий сусід"?
У 1999 р. Beyer et al. запитав, коли має значення "Найближчий сусід"? Чи є кращі способи аналізу та візуалізації ефекту площини відстані на пошук NN з 1999 року? Чи дає [даний] набір даних змістовні відповіді на проблему 1-NN? Проблема 10-NN? Проблема 100 NN? Як би Ви сьогодні підходили до цього …

3
Як можна обчислити умовну ймовірність кількох подій?
Чи можете ви мені повідомити, як я можу обчислити умовну ймовірність кількох подій? наприклад: P (A | B, C, D) -? Я знаю це: P (A | B) = P (A B) / P (B)∩∩\cap Але, на жаль, я не можу знайти жодної формули, якщо подія A залежить від кількох …

7
Заходи складності моделі
Як можна порівняти складність двох моделей з однаковою кількістю параметрів? Редагувати 19.09 : Для уточнення складність моделі - це міра того, наскільки важко вчитися з обмежених даних. Коли дві моделі однаково добре вписуються в існуючі дані, модель з меншою складністю дасть менші помилки на майбутні дані. Коли використовуються наближення, це …

6
У чому різниця між обробкою даних та статистичним аналізом?
У чому різниця між обробкою даних та статистичним аналізом? З деякого походження, моя статистична освіта була, я думаю, досить традиційною. Поставлено конкретне запитання, розроблено дослідження, дані збираються та аналізуються, щоб дати деяке розуміння цього питання. Як результат, я завжди скептично ставився до того, що вважав "драгуванням даних", тобто шукав зразки …

10
Ресурси для навчання створення візуалізації даних?
Мені цікаво дізнатися, як створити тип візуалізацій, які ви бачите на http://flowingdata.com та informationisbeautiful. EDIT: Значення, цікаві самі по собі візуалізації - начебто на зразок графіки NY Times, на відміну від швидкої інформації для звіту. Які інструменти використовуються для їх створення - це в основному багато Adobe Illustrator / Photoshop? …

6
Яка «основна» ідея машинного навчання для оцінки параметрів?
"Основна" ідея статистики для оцінки параметрів - максимальна ймовірність . Мені цікаво, яка відповідна ідея в машинному навчанні. Qn 1. Було б справедливо сказати, що "фундаментальною" ідеєю в машинному навчанні для оцінки параметрів є: "Функції втрати" [Примітка. Мені здається, що алгоритми машинного навчання часто оптимізують функцію втрат і, отже, вищезазначене …

Використовуючи наш веб-сайт, ви визнаєте, що прочитали та зрозуміли наші Політику щодо файлів cookie та Політику конфіденційності.
Licensed under cc by-sa 3.0 with attribution required.