Статистика та великі дані

Питання та відповіді для людей, зацікавлених у статистиці, машинному навчанні, аналізі даних, інтелектуальному аналізу даних та візуалізації даних

3
Чому розподіл t стає більш нормальним, оскільки розмір вибірки збільшується?
Згідно з Вікіпедією, я розумію, що t-розподіл - це вибіркове розподіл величини t, коли вибірки є спостереженнями з нормально розподіленої сукупності. Однак я не розумію, чому це призводить до того, що форма розподілу t змінюється від жировика до майже абсолютно нормальної. Я розумію, що якщо ви берете пробу із звичайного …

3
Асимптотичний розподіл дисперсії вибірки ненормальної вибірки
Це більш загальне трактування питання, поставленого цим питанням . Отримавши асимптотичний розподіл дисперсії вибірки, ми можемо застосувати метод Delta, щоб дійти до відповідного розподілу для стандартного відхилення. Нехай зразок розміру iid ненормальних випадкових величин , із середнім та дисперсією . Встановіть середню вибірку та дисперсію вибірки як nnn{Xi},i=1,...,n{Xi},i=1,...,n\{X_i\},\;\; i=1,...,nμμ\muσ2σ2\sigma^2x¯=1n∑i=1nXi,s2=1n−1∑i=1n(Xi−x¯)2x¯=1n∑i=1nXi,s2=1n−1∑i=1n(Xi−x¯)2\bar x …

1
Сюжет та інтерпретація порядкової логістичної регресії
У мене є порядкова змінна залежність, легкість, яка коливається від 1 (не просто) до 5 (дуже просто). Збільшення значень незалежних факторів пов'язане з підвищенням рейтингової легкості. Дві мої незалежні змінні ( condAі condB) є категоричними, кожна з яких має 2 рівні, а 2 ( abilityA, abilityB) - безперервні. Я використовую …

2
Значення нейронної мережі як чорного поля?
Я часто чую, як люди говорять про нейронні мережі як про щось як про чорну скриньку, яку ви не розумієте, що це робить або що вони означають. Я насправді не можу зрозуміти, що вони розуміють під цим! Якщо ви розумієте, як працює зворотне розповсюдження, то як це чорна скринька? Чи …

5
Що означає "ймовірність визначена лише до мультиплікативної константи пропорційності"?
Я читаю документ, де автори ведуть з обговорення максимальної оцінки ймовірності до теореми Байєса, нібито як вступу для початківців. Як імовірний приклад, вони починаються з біноміального розподілу: p(x|n,θ)=(nx)θx(1−θ)n−xp(x|n,θ)=(nx)θx(1−θ)n−xp(x|n,\theta) = \binom{n}{x}\theta^x(1-\theta)^{n-x} а потім запишіть обидві сторони ℓ(θ|x,n)=xln(θ)+(n−x)ln(1−θ)ℓ(θ|x,n)=xln⁡(θ)+(n−x)ln⁡(1−θ)\ell(\theta|x, n) = x \ln (\theta) + (n-x)\ln (1-\theta) з обґрунтуванням, що: "Оскільки ймовірність визначається …

2
Як ви «контролюєте» коефіцієнт / змінну?
Наскільки я розумію, "контроль" може мати два значення в статистиці. Контрольна група: В експерименті не проводиться лікування члена контрольної групи. Наприклад: Плацебо проти наркотиків: Ви даєте наркотики одній групі, а не іншій (контрольній), що також називається "контрольований експеримент". Управління змінною: техніка відокремлення ефекту конкретної незалежної змінної. Деякі інші назви, що …

4
Як оцінити придатність біноміального GLMM, оснащеного lme4 (> 1.0)?
У мене є GLMM з біноміальним розподілом і функцією logit-ланки, і я маю відчуття, що важливий аспект даних недостатньо добре представлений в моделі. Щоб перевірити це, я хотів би знати, чи добре дані описуються лінійною функцією за шкалою logit. Отже, я хотів би дізнатись, чи добре себе почувають залишки. Однак …

5
Бета-регресія даних пропорцій, включаючи 1 і 0
Я намагаюся створити модель, для якої у мене є змінна відповідь, яка є пропорцією між 0 і 1, сюди входить досить багато 0 і 1, але також багато значень між ними. Я думаю про спробу бета-регресії. Пакет, який я знайшов для R (betareg), допускає значення лише між 0 і 1, …


2
Що є найбільш безболісним способом підгонки логістичних кривих зростання в R?
Google це не так просто, як деякі інші речі, як, зрозуміло, я не кажу про логістичну регресію в сенсі використання регресії для прогнозування категоричних змінних. Я говорю про пристосування логістичної кривої зростання до заданих точок даних. Якщо конкретніше, - це заданий рік з 1958 по 2012 рік, а y - …

2
Підручники з художньої інженерії
Як відомо всім, функціональна інженерія надзвичайно важлива для машинного навчання, проте я знайшов мало матеріалів, пов’язаних із цією областю. Я брав участь у декількох змаганнях з Kaggle і вважаю, що хороші характеристики можуть бути навіть важливішими, ніж хороший класифікатор в деяких випадках. Хтось знає які-небудь навчальні посібники щодо художньої інженерії, …

1
Як налаштувати аргумент xreg в auto.arima () в R? [зачинено]
Зачинено. Це питання поза темою . Наразі відповіді не приймаються. Хочете вдосконалити це питання? Оновіть питання, щоб воно було тематичним для перехресної перевірки. Закрито 6 років тому . Я працюю над невеликим проектом з одним часовим рядом, який вимірює дані про відвідування клієнта (щодня). Мої коваріати - це суцільна змінна, …

2
Чому регресія щодо дисперсії?
Я читаю цю замітку . На сторінці 2 зазначено: "Скільки дисперсії в даних пояснюється заданою регресійною моделлю?" "Інтерпретація регресії - це середнє значення коефіцієнтів; умовивід - про їх відмінність." Я неодноразово читав про подібні твердження, чому ми б хвилювались про те, «скільки дисперсії в даних пояснюється даною регресійною моделлю?» ... …

1
Досяжна кореляція для лонормальних випадкових величин
Розглянемо лонормальні випадкові величини Х1Х1X_1 і Х2Х2X_2 з журнал( X1) ∼ N( 0 , 1 )журнал⁡(Х1)∼N(0,1)\log(X_1)\sim \mathcal{N}(0,1) і журнал( X2) ∼ N( 0 , σ2)журнал⁡(Х2)∼N(0,σ2)\log(X_2)\sim \mathcal{N}(0,\sigma^2) . ρ min ρ ( X 1 , X 2 )ρмаксρмакс\rho_{\max}ρхвρхв\rho_{\min}ρ ( X1, X2)ρ(Х1,Х2)\rho (X_1,X_2) ρmax=ρ(exp(Z),exp(σZ))ρmax=ρ(exp⁡(Z),exp⁡(σZ))\rho_{\max}=\rho (\exp(Z),\exp(\sigma Z)) і ρmin=ρ(exp(Z),exp(−σZ))ρmin=ρ(exp⁡(Z),exp⁡(−σZ))\rho_{\min}=\rho (\exp(Z),\exp(-\sigma Z)) , але …

2
Яке визначення симетричного розподілу?
Яке визначення симетричного розподілу? Хтось сказав мені, що випадкова величина походить від симетричного розподілу тоді і тільки тоді, коли і мають однаковий розподіл. Але я думаю, що це визначення частково вірно. Тому що я можу представити контрприклад та . Очевидно, він має симетричний розподіл, але і мають різний розподіл! Я …

Використовуючи наш веб-сайт, ви визнаєте, що прочитали та зрозуміли наші Політику щодо файлів cookie та Політику конфіденційності.
Licensed under cc by-sa 3.0 with attribution required.