Статистика та великі дані

Питання та відповіді для людей, зацікавлених у статистиці, машинному навчанні, аналізі даних, інтелектуальному аналізу даних та візуалізації даних

3
Які відмінності між AUC та F1-балом?
F1 бал - це гармонійне середнє значення точності та відкликання. Вісь y відкликання - це справжня позитивна швидкість (яка також є відкликанням). Отже, колись класифікатори можуть мати низький рівень виклику, але дуже високий AUC, що це означає? Які відмінності між AUC та F1-балом?

2
Повідомлення про ступінь свободи для тесту Welch
Т-тест Велча на неоднакові дисперсії (також відомий як Велч-Саттерватвайт або Велч-Аспін), як правило, має не цілі ступені ступеня свободи . Як слід цитувати ці ступені свободи при повідомленні про результати тесту? "Зазвичай, округляючи до найближчого цілого числа, перш ніж звертатися до стандартних таблиць t", відповідно до різних джерел * - …


1
Чому визначення послідовного оцінювача є таким, яким воно є? А як щодо альтернативних визначень послідовності?
Цитата з wikipedia: У статистиці послідовний оцінювач або асимптотично послідовний оцінювач - це оцінювач - правило для обчислення оцінок параметра володіє властивістю, яке в міру того, як кількість використаних точок даних збільшується нескінченно, результуюча послідовність оцінок з вірогідністю сходить до .θ ∗θ∗θ∗θ^*θ∗θ∗θ^* Щоб зробити це твердження точним, нехай θ∗θ∗\theta^* є …

1
Як використовувати метод Delta, коли похідна першого порядку дорівнює нулю?
http://en.wikipedia.org/wiki/Delta_method У статті у Вікіпедії було припущено, що g′(θ)g′(θ)g'(\theta) повинен існувати, а g′(θ)g′(θ)g'(\theta) має нульове значення. Чи можливо знайти асимптотичний розподіл для n−−√(g(Xn)−g(θ))n(g(Xn)−g(θ))\sqrt{n}(g(X_n)-g(\theta)) враховуючи, щог'( θ )г'(θ)g'(\theta)може бути нульовим ін--√( Xн- θ ) →гN( 0 , σ2)н(Хн-θ)→гN(0,σ2)\sqrt{n}(X_n-\theta) \stackrel{d}{\rightarrow} N(0,\sigma^2)?

5
Чи є міра "рівномірності" поширення?
Я подивився в Інтернеті, але не зміг знайти нічого корисного. Я в основному шукаю спосіб оцінити, наскільки «рівномірно» розподіляється значення. Як і в "рівномірному" розподілі, як X : і "нерівномірно" розподіленого Y розподілу приблизно однакового середнього та стандартного відхилення: Але чи є міра рівності m, така, що m (X)> m …

3
Пункт Теорія реагування та аналіз конфірмаційного фактора
Мені було цікаво, в чому полягають основні, змістовні відмінності між Теорією реагування на предмет та Аналіз підтверджуючого фактора. Я розумію, що в обчисленнях є відмінності (зосереджуючись більше на позиції проти коваріацій; логарифмічні та лінійні). Однак я не маю уявлення, що це означає з точки зору вищого рівня - чи це …

5
Які саме цензурні дані?
Я читав різні описи цензурованих даних: А) Як пояснено в цій темі, цензуруються не кількісні дані нижче або вище певного порогу. Некваліфіковані засоби означають, що вище або нижче певного порогу, але ми не знаємо точного значення. Потім дані маркуються за низьким або високим пороговим значенням у моделі регресії. Він відповідає …

3
Завантажувальний інструмент: питання про оснащення
Припустимо, виконується так звана непараметрична завантажувальна програма шляхом складання зразків розміром кожна з вихідних спостережень із заміною. Я вважаю, що ця процедура рівнозначна оцінці функції кумулятивного розподілу за емпіричним cdf:BBBnnnnnn http://en.wikipedia.org/wiki/Empirical_distribution_function а потім отримання зразків завантажувальної машини шляхом імітації спостережень із розрахункового cdf разів підряд.nnnBBB Якщо я маю рацію в …

1
Діапазони довіри для QQ-лінії
Це питання не стосується конкретно R, але я вирішив використовувати його Rдля ілюстрації. Розглянемо код для створення довірчих смуг навколо (нормальної) qq-лінії: library(car) library(MASS) b0<-lm(deaths~.,data=road) qqPlot(b0$resid,pch=16,line="robust") Я шукаю пояснення (або альтернативне посилання на паперовий / онлайн-документ, що пояснює), як будуються ці групи довіри (я бачив посилання на Fox 2002 у …

4
Упередженість у виборі журі?
Друг представляє клієнта в апеляційному порядку після кримінального судового розгляду, в якому виявляється, що вибір присяжних був расовим упередженням. Публічний склад журі складався з 30 осіб у 4 расових групах. Обвинувачення застосувало необов'язкові виклики, щоб усунути 10 людей із пулу. Кількість людей та кількість актуальних проблем у кожній расовій групі …

2
k-означає проти k-медіани?
Я знаю, що існує алгоритм кластеризації k-означає і k-медіана. Один, який використовує середнє як центр кластера, а другий, використовує медіану. Моє запитання: коли / де використовувати який?

3
Чи мають значення коефіцієнти логістичної регресії?
У мене є проблема бінарної класифікації з кількох функцій. Чи мають коефіцієнти (регульованої) логістичної регресії інтерпретаційне значення? Я думав, що вони можуть вказати на розмір впливу, враховуючи, що особливості попередньо нормалізуються. Однак у моїй проблемі коефіцієнти, здається, залежать від особливостей, які я вибираю. Навіть знак коефіцієнтів змінюється різними наборами функцій, …

2
Суб'єктивність у статистиці частотних лікарів
Я часто чую твердження, що байєсівська статистика може бути дуже суб’єктивною. Основним аргументом є те, що висновок залежить від вибору попереднього (навіть якщо можна вибрати принцип байдужості або максимальної ентропії для вибору попереднього). Для порівняння, стверджує твердження, часто-часто статистика є більш об'єктивною. Скільки правди в цьому твердженні? Крім того, це …

1
Діагностика конвергенції Гельмана та Рубіна, як узагальнити роботу з векторами?
Діагностика Гельмана і Рубіна використовується для перевірки конвергенції декількох ланцюгів mcmc, що працюють паралельно. Він порівнює дисперсію всередині ланцюга з дисперсією між ланцюгами, експозиція нижче: Кроки (для кожного параметра): Виконайте m ≥ 2 ланцюгів довжиною 2n від перерізних початкових значень. Відкиньте перші n малюнків у кожному ланцюжку. Обчисліть дисперсію всередині …

Використовуючи наш веб-сайт, ви визнаєте, що прочитали та зрозуміли наші Політику щодо файлів cookie та Політику конфіденційності.
Licensed under cc by-sa 3.0 with attribution required.