Статистика та великі дані

Питання та відповіді для людей, зацікавлених у статистиці, машинному навчанні, аналізі даних, інтелектуальному аналізу даних та візуалізації даних

2
Загальний метод отримання стандартної помилки
Я, здається, не можу ніде знайти загальний метод отримання стандартних помилок. Я переглянув google, цей веб-сайт і навіть підручники, але все, що я можу знайти, - це формула стандартних помилок для середнього значення, дисперсії, пропорції, співвідношення ризиків тощо ..., а не те, як ці формули були отримані. Якщо будь-який орган …

1
Інтервали довіри, трансформовані назад
Натрапивши на цю дискусію, я піднімаю питання про конвенції перетворених довіри інтервалів. Згідно з цією статтею номінальне покриття, трансформоване CI для середнього значення випадкової величини журналу, є: LCL(X)=exp(Y+var(Y) UСL ( X) = Досвід( Y+ вар ( Y)2+ zвар ( Y)н+ вар ( Y)22 ( n - 1 )------------√) UСL(Х)=досвід⁡(Y+вар(Y)2+zвар(Y)н+вар(Y)22(н-1))\ UCL(X)= …

1
Оцінки параметрів для нормального розподілу перекосів
Які формульні параметри оцінюють для перекосу норми? Якщо ви можете, виведення через MLE або маму було б також чудово. Дякую Редагувати . У мене є набір даних, для яких я можу візуально розповісти за сюжетами, злегка перекошений ліворуч. Я хочу оцінити середнє значення та дисперсію, а потім зробити перевірку на …

2
Значення середнього коефіцієнта кореляції
Відмова від відповідальності: якщо ви вважаєте, що це питання є занадто схожим на інше, я радий за його об’єднання. Однак я ніде більше не знайшов задовільної відповіді (і ще не маю «репутації» коментувати чи оскаржувати), тому подумав, що найкраще самому задати нове запитання. Моє запитання таке. Для кожного з 12 …

3
Коли найменше квадратів буде поганою ідеєю?
Якщо у мене є модель регресії: Y= Xβ+ εY=Xβ+ε Y = X\beta + \varepsilon де V [ε]=Iг∈ Rn × nV[ε]=Id∈Rn×n\mathbb{V}[\varepsilon] = Id \in \mathcal{R} ^{n \times n} і E [ε]=(0,…,0)E[ε]=(0,…,0)\mathbb{E}[\varepsilon]=(0, \ldots , 0) , коли використання βOLSβOLS\beta_{\text{OLS}} , звичайного оцінювача найменших квадратів ββ\beta , буде поганим вибором для оцінки? Я …

1
Чи SurveyMonkey ігнорує той факт, що ви отримуєте невипадкову вибірку?
SurveyMonkey має кроки та діаграму, щоб визначити, який розмір вибірки потрібен для заданого інтервалу помилок або довірчого інтервалу, виходячи з чисельності вашого населення. Розмір вибірки SurveyMonkey Чи просто ігнорує цей графік той факт, що ви не отримаєте випадкову вибірку, оскільки ви отримуєте лише людей, які турбуються відповісти на опитування? Коли …

1
Тест на співвідношення ймовірності та тест Вальда дають різний висновок щодо glm в R
Я відтворюю приклад із узагальнених, лінійних та змішаних моделей . Мій MWE нижче: Dilution <- c(1/128, 1/64, 1/32, 1/16, 1/8, 1/4, 1/2, 1, 2, 4) NoofPlates <- rep(x=5, times=10) NoPositive <- c(0, 0, 2, 2, 3, 4, 5, 5, 5, 5) Data <- data.frame(Dilution, NoofPlates, NoPositive) fm1 <- glm(formula=NoPositive/NoofPlates~log(Dilution), family=binomial("logit"), …

3
Перший головний компонент не розділяє класи, але це роблять інші ПК; як це можливо?
Я запустив PCA на 17 кількісних змінних, щоб отримати менший набір змінних, що є основними компонентами, які будуть використовуватися в контрольованому машинному навчанні для класифікації примірників на два класи. Після PCA на PC1 припадає 31% дисперсії даних, PC2 - 17%, PC3 - 10%, PC4 - 8%, PC5 - 7%, а …

3
Яку відстань використовувати? наприклад, Манхеттен, Евклідовий, Брей-Кертіс тощо
Я не є екологом громади, але сьогодні працюю над даними екології громади. Те, що я не міг зрозуміти, окрім математики цих відстаней, - це критерії для кожної дистанції, яку потрібно використати, і в яких ситуаціях вона може бути застосована. Наприклад, що використовувати з даними підрахунку? Як перетворити кут нахилу між …

4
Аналіз основних компонентів та регресія в Python
Я намагаюся розібратися, як відтворити в Python якусь роботу, яку я робив у SAS. Використовуючи цей набір даних , де мультиколінеарність є проблемою, я хотів би провести аналіз основних компонентів у Python. Я переглянув scikit-learn та statsmodels, але я не впевнений, як взяти їх результат та перетворити його на ту …

3
Як перевірити, чи відповідають мої дані нормальному розповсюдженню журналу?
Я хотів би перевірити, Rчи відповідають мої дані нормальним журналом чи дистрибутивом Pareto. Як я міг це зробити? Можливо, ks.testміг би мені допомогти це зробити, але як я можу отримати параметри αα\alpha і кkk для розподілу Парето для своїх даних?

1
Навчання нейронної мережі згортки
Зараз я працюю над програмним забезпеченням для розпізнавання облич, яке використовує нейронні мережі згортки для розпізнавання облич. Спираючись на свої читання, я зрозумів, що звивиста нейронна мережа має загальну вагу, щоб заощадити час під час тренувань. Але як адаптувати зворотне розповсюдження, щоб його можна було використовувати в нейромережі згортки. Для …

3
Які приклади прихованих змінних у контрольованих експериментах є у публікаціях?
У цій статті: Приховані змінні: кілька прикладів Брайан Л. Столяр Американський статистик Vol. 35, № 4, листопад 1981 р. 227-233 Брайан Столяр заявляє, що "рандомізація - це не панацея". Це суперечить загальним твердженням, таким як наведене нижче: Добре розроблений експеримент включає конструктивні особливості, які дозволяють дослідникам усунути сторонні змінні як …

4
Класифікатор для міток невизначених класів
Скажімо, у мене набір примірників із пов’язаними мітками класів. Не важливо, як ці екземпляри були позначені, а наскільки певна їхня класність. Кожен екземпляр належить рівно одному класу. Скажімо, я можу кількісно оцінити визначеність кожного членства у класі за номінальним атрибутом, який переходить від 1 до 3 (дуже певний до невизначеного …

2
Гранічний графік рішення для перцептрона
Я намагаюся побудувати межу рішення алгоритму перцептрона, і я дуже заплутаний у кількох речах. Мої вхідні екземпляри мають форму , в основному 2D вхідний екземпляр ( і ) і цільове значення двійкового класу ( ) [1 або 0].х 1 х 2 у[ ( х1, х2) , у][(x1,x2),y][(x_{1},x_{2}), y]х1x1x_{1}х2x2x_{2}уyy Звідси мій …

Використовуючи наш веб-сайт, ви визнаєте, що прочитали та зрозуміли наші Політику щодо файлів cookie та Політику конфіденційності.
Licensed under cc by-sa 3.0 with attribution required.