Статистика та великі дані

Питання та відповіді для людей, зацікавлених у статистиці, машинному навчанні, аналізі даних, інтелектуальному аналізу даних та візуалізації даних

2
Підмножина векторів часових рядів
У мене є часовий ряд, і я хочу його підмножити, зберігаючи його як часовий ряд, зберігаючи початок, кінець та частоту. Наприклад, скажімо, у мене є часовий ряд: > qs <- ts(101:110, start=c(2009, 2), frequency=4) > qs Qtr1 Qtr2 Qtr3 Qtr4 2009 101 102 103 2010 104 105 106 107 2011 …
25 r  time-series 

1
Пояснення кінцевого поправочного коефіцієнта
Я розумію, що при вибірці від кінцевої сукупності та розмірі вибірки більше 5% від сукупності нам потрібно виправити середню та стандартну помилку вибірки, використовуючи цю формулу: ЖПС= N- нN- 1----√ЖПС=N-нN-1\hspace{10mm} FPC=\sqrt{\frac{N-n}{N-1}} Де - чисельність сукупності і - розмір вибірки.NNNннn У мене є 3 питання щодо цієї формули: Чому встановлено поріг …



3
Які переваги метрики Wasserstein порівняно з розбіжністю Куллбека-Лейблера?
Яка практична різниця між Wasserstein метрикою і Кульбакою-Лейблером дивергенцией ? Метрику Вассерстейна також називають відстань руху Землі . З Вікіпедії: Метрика Вассерстейна (або Васерштейна) - це відстань, яка визначається між розподілами ймовірностей на заданому метричному просторі М. і Дивергенція Куллбека – Лейблера - це міра того, як один розподіл ймовірностей …

2
Як “працює” кількісна регресія?
Я сподіваюся отримати інтуїтивне, доступне пояснення кількісної регресії. Скажімо, у мене простий набір результатів YYY та прогнози X1,X2X1,X2X_1, X_2 . Наприклад, якщо я запускаю квантильну регресію в .25, .5, .75 і повертаюсь β0,.25,β1,.25...β2,.75β0,.25,β1,.25...β2,.75\beta_{0,.25},\beta_{1,.25}...\beta_{2,.75} . Чи знаходять значення ββ\beta простим упорядкуванням значень yyy та виконанням лінійної регресії на основі прикладів, що …

3
Щоденний аналіз часових рядів
Я намагаюся зробити аналіз часових рядів і я новачок у цій галузі. Я щодня перераховую подію 2006–2009 рр. І хочу приєднати до неї модель часових рядів. Ось прогрес, який я досяг: timeSeriesObj = ts(x,start=c(2006,1,1),frequency=365.25) plot.ts(timeSeriesObj) Отриманий сюжет я отримую: Щоб перевірити, чи є сезонність і тенденція в даних, чи ні, …

1
Вказання декількох (окремих) випадкових ефектів в lme [закрито]
Зачинено. Це питання поза темою . Наразі відповіді не приймаються. Хочете вдосконалити це питання? Оновіть питання, щоб воно було тематичним для Cross Valified. Закрито 6 місяців тому . Я працював у R-пакетах nlme та lme4 , намагаючись вказати моделі з декількома випадковими ефектами. Я виявив, що лише nlme дозволяє вказати …

3
Інтерпретація термінів взаємодії в логітній регресії з категоричними змінними
У мене є дані опитувального експерименту, в якому респонденти були випадковим чином віднесені до однієї з чотирьох груп: > summary(df$Group) Control Treatment1 Treatment2 Treatment3 59 63 62 66 Хоча три групи лікування дещо відрізняються залежно від застосованого подразника, головне розмежування, яке мене хвилює, - це контрольна та лікувальна групи. Тому …

5
Вступ до причинного аналізу
Які хороші книги, що запроваджують причинний аналіз? Я думаю про вступ, який обидва пояснює принципи причинного аналізу та показує, як різні статистичні методи можуть бути використані для застосування цих принципів.

3
Які міри для точності багатозначних даних?
Розглянемо сценарій, коли вам надаються матриця K PoznaLabel і матриця PredictedLabel. Я хотів би виміряти добротність матриці PredictedLabel щодо матриці KknownLabel. Але проблема тут полягає в тому, що у матриці K knownLabel є кілька рядків, лише один 1, а інші кілька рядків мають багато 1 (ці екземпляри мають багато міток). …

5
Процедура кластеризації, коли кожен кластер має рівну кількість балів?
У мене є кілька точок в R pX={x1,...,xn}X={x1,...,xn}X=\{x_1,...,x_n\}RpRpR^p , і я хочу об'єднати точки так, щоб: Кожен кластер містить рівну кількість елементів . (Припустимо, що кількість кластерів ділить nXXXnnn .) Кожен кластер є «просторово згуртованим» у певному сенсі, як кластери з значень.kkk Легко придумати безліч процедур кластеризації, які задовольняють одну …


2
Чому дисперсія вибірки змінюється, якщо спостереження дублюються?
Дисперсія, як кажуть, є мірою поширення. Отже, я думав, що дисперсія 3,5дорівнює дисперсії, 3,3,5,5оскільки числа однаково поширюються. Але це не так, дисперсія 3,5є, 2поки дисперсія 3,3,5,5є 1 1/3. Це спантеличує мене, враховуючи пояснення, що дисперсія повинна бути мірою поширення. Отже, в цьому контексті, що означає міра поширення ?
25 variance 

2
Як підтримується векторна регресія інтуїтивно?
Усі приклади SVM пов'язані з класифікацією. Я не розумію, як SVM для регресії (вектор регресора підтримки) може бути використаний при регресії. З мого розуміння, SVM максимально збільшує запас між двома класами, щоб знайти оптимальну гіперплану. Як це могло б працювати в регресійній проблемі?
25 regression  svm 

Використовуючи наш веб-сайт, ви визнаєте, що прочитали та зрозуміли наші Політику щодо файлів cookie та Політику конфіденційності.
Licensed under cc by-sa 3.0 with attribution required.