Статистика та великі дані

Питання та відповіді для людей, зацікавлених у статистиці, машинному навчанні, аналізі даних, інтелектуальному аналізу даних та візуалізації даних

3
Як знайти режим функції щільності ймовірності?
Надихнувшись іншим моїм запитанням , я хотів би запитати, як можна знайти режим функції щільності ймовірності (PDF) функції ?f( х )f(x)f(x) Чи є для цього якась процедура «кухарської книги»? Мабуть, це завдання набагато складніше, ніж здається спочатку.

2
Результат прогнозування логістичної регресії
Я створив логістичну регресію, використовуючи наступний код: full.model.f = lm(Ft_45 ~ ., LOG_D) base.model.f = lm(Ft_45 ~ IP_util_E2pl_m02_flg) step(base.model.f, scope=list(upper=full.model.f, lower=~1), direction="forward", trace=FALSE) Потім я використовував вихід, щоб створити остаточну модель: final.model.f = lm(Ft_45 ~ IP_util_E2pl_m02_flg + IP_util_E2_m02_flg + AE_NumVisit1_flg + OP_NumVisit1_m01_flg + IP_TotLoS_m02 + Ft1_45 + IP_util_E1_m05_flg + IP_TotPrNonElecLoS_m02 …

1
Приклад розповсюдження важкого хвоста, який не є довгохвостим
З читання про дистрибуцію важких та довгохвостих я зрозумів, що всі довгохвості дистрибуції є хвостатими з великим хвостом , але не всі розподіли з великим хвостом . Чи можете хтось надати приклад: функція безперервної, симетричної нульової середньої щільності, яка має довгий хвіст функція безперервної, симетричної, нульової середньої щільності, яка має …

8
Тренуйте нейронну мережу, щоб розрізняти парні та непарні числа
Питання: чи можна навчити NN розрізняти непарні і парні числа, використовуючи лише як введення самих числа? У мене є такий набір даних: Number Target 1 0 2 1 3 0 4 1 5 0 6 1 ... ... 99 0 100 1 Я тренував NN з двома вхідними нейронами (один …

1
Чи завжди диференціальна ентропія менше, ніж нескінченність?
Для довільної безперервної випадкової величини, скажімо , чи є її диференціальна ентропія завжди меншою від ? (Це нормально, якщо це .) Якщо ні, то яка необхідна і достатня умова, щоб вона була менше ?XXX∞∞\infty−∞−∞-\infty∞∞\infty

2
R: функція glm із специфікацією сімейства = “бінома” та “вага”
Мене дуже плутає те, як вага працює в glm з сім'єю = "двочлен". У моєму розумінні ймовірність glm з family = "binomial" визначається так: f(y)=(nny)pny(1−p)n(1−y)=exp(n[ylogp1−p−(−log(1−p))]+log(nny))f(y)=(nny)pny(1−p)n(1−y)=exp⁡(n[ylog⁡p1−p−(−log⁡(1−p))]+log⁡(nny)) f(y) = {n\choose{ny}} p^{ny} (1-p)^{n(1-y)} = \exp \left(n \left[ y \log \frac{p}{1-p} - \left(-\log (1-p)\right) \right] + \log {n \choose ny}\right) де yyy - "частка …

2
Чи точність = 1- коефіцієнт помилки тесту
Вибачте, якщо це дуже очевидне питання, але я читав різні публікації і, здається, не можу знайти хорошого підтвердження. У разі класифікації, чи є точність класифікатора = 1- коефіцієнт помилки тесту ? Я вважаю, що точність є , але моє питання полягає в тому, як саме пов’язані точність та швидкість помилок …

5
Підручник для байєсівської економетрики
Я шукаю теоретично суворий підручник з байєсівської економетрії, припускаючи чітке розуміння частістської економетрики. Я хотів би запропонувати одну роботу за кожну відповідь, щоб рекомендації можна було проголосувати вгору або вниз окремо.


2
Як інтерпретувати оцінки параметрів у результатах Poisson GLM [закрито]
Зачинено. Це питання поза темою . Наразі відповіді не приймаються. Хочете вдосконалити це питання? Оновіть питання, щоб воно було тематичним для перехресної перевірки. Закрито 5 років тому . Call: glm(formula = darters ~ river + pH + temp, family = poisson, data = darterData) Deviance Residuals: Min 1Q Median 3Q …

3
Формула для скидання кісток (без грубої сили)
Перш за все я не впевнений, де це питання слід розміщувати. Я запитую, чи є проблема зі статистикою NP-Complete і чи не вирішувати її програмно. Я розміщую це тут, оскільки проблема зі статистикою є центральною точкою. Я намагаюся знайти кращу формулу для вирішення проблеми. Проблема полягає в тому, що якщо …
14 dice  np 


5
Як визначити часовий ряд?
Як визначити часовий ряд? Чи гаразд просто взяти першу різницю та запустити тест Діккі Фуллера, і якщо він нерухомий, ми хороші? Також я виявив в Інтернеті, що можу зірвати часовий ряд, зробивши це в Stata: reg lncredit time predict u_lncredit, residuals twoway line u_lncredit time dfuller u_lncredit, drift regress lags(0) …


3
Відповідність ANOVA після кластерного аналізу k-означає
Повідомлення після таблиці ANOVA після аналізу K-засобів вказує на те, що рівні значущості не слід розглядати як випробування рівних засобів, оскільки рішення кластера було отримано на основі евклідової відстані для максимального відстані. Який тест слід використати, щоб показати, чи відрізняються засоби кластерних змінних між кластерами? Я бачив це застереження в …
14 anova  k-means 

Використовуючи наш веб-сайт, ви визнаєте, що прочитали та зрозуміли наші Політику щодо файлів cookie та Політику конфіденційності.
Licensed under cc by-sa 3.0 with attribution required.