Статистика та великі дані

Питання та відповіді для людей, зацікавлених у статистиці, машинному навчанні, аналізі даних, інтелектуальному аналізу даних та візуалізації даних

3
Який алгоритм можна використовувати для пошуку кореляцій між подіями?
Я новачок у машинному навчанні, тому намагаюся знайти трохи літератури, але я навіть не впевнений, для чого Google. Мої дані мають такий вигляд: User A performs Action P User B performs Action Q User C performs Action R ... User C performs Action X User A performs Action Y User …

5
Чи мрія автоматизованого машинного навчання?
Коли я відкриваю машинне навчання, я бачу різні цікаві методи, такі як: автоматично налаштовувати алгоритми з такими методами, як grid search, отримати більш точні результати за допомогою комбінації різних алгоритмів одного "типу" boosting, отримати більш точні результати за рахунок поєднання різних алгоритмів (але не той же самий тип алгоритмів), це …

2
Чи застосовується «Теорема без вільного обіду» для загальних статистичних тестів?
Жінка, для якої я працював, попросила мене зробити ANOVA в одну сторону за деякими даними. Я відповів, що дані були повторними заходами (часовими рядами) і вважаю, що припущення про незалежність порушено. Вона відповіла, що я не повинен турбуватися про припущення, просто зробіть тест, і вона врахує, що припущення, можливо, не …

3
Різні способи створити інтервал довіри для коефіцієнта шансів від логістичної регресії
Я вивчаю, як побудувати 95% довірчий інтервал для коефіцієнта шансів з коефіцієнтів, отриманих при логістичній регресії. Отже, розглядаючи модель логістичної регресії, журнал( с1 - с) =α+βхжурнал⁡(p1-p)=α+βх \log\left(\frac{p}{1 - p}\right) = \alpha + \beta x \newcommand{\var}{\rm Var} \newcommand{\se}{\rm SE} таким, що x = 0х=0x = 0 для контрольної групи та х …

2
Обґрунтування попереднього сполучення?
Окрім зручності використання, чи є епістемічне обґрунтування (математичне, філософське, евристичне тощо) використання сполучених пріорів? Або це здебільшого просто те, що зазвичай це досить гарне наближення та робить речі набагато простішими?

1
Чому люди не використовують більш глибокі RBF або RBF у поєднанні з MLP?
Тож, дивлячись на нейронні мережі радіальної основи функції, я помітив, що люди лише рекомендують використовувати 1 прихований шар, тоді як при багатошарових персептронних нейронних мережах більше шарів вважається кращим. З огляду на те, що мережі RBF можуть бути навчені з версією поширення зворотного зв'язку? Чи є причини, чому більш глибокі …

2
Як перетворити негативні значення на логарифми?
Мені хотілося б знати, як перетворити негативні значення Log(), оскільки у мене є гетерокедастичні дані. Я прочитав, що це працює з формулою, Log(x+1)але це не працює з моєю базою даних, і я продовжую отримувати NaNs в результаті. Наприклад, я отримую це Попереджувальне повідомлення (я не помістив повну базу даних, тому …
12 r  logarithm 

2
Чи кидання монети справедливим способом рандомізації групи на дві групи?
Тож у мене з дядьком виникає суперечка щодо того, чи справжній випадковий переворот монети справді випадковий. Я стверджую, що це не тому, що в реальному плані монети завжди будуть маніпулювати монетою, тому результат не 50/50, тому це не є вдалим вибором в якості методу рандомізації для призначення груп у клінічні …

1
Коли я повинен турбуватися про парадокс Джеффріс-Ліндлі у виборі моделі Байесія?
Я розглядаю великий (але кінцевий) простір моделей різної складності, які я досліджую за допомогою RJMCMC . Попередній вектор параметрів для кожної моделі є досить інформативним. У яких випадках (якщо такі є) я повинен турбуватися через парадокс Джеффріс-Ліндлі, який надає перевагу більш простим моделям, коли одна з більш складних моделей буде …

1
Як інтерпретувати висоту ділянки щільності
Як слід інтерпретувати висоту ділянок щільності: Наприклад, у наведеному вище графіку пік становить приблизно 0,07 при x = 18. Чи можу я зробити висновок, що приблизно 7% значень приблизно 18? Чи можу я бути більш конкретним за це? Існує також другий пік при х = 30 з висотою 0,02. Чи …

1
Автоматичне вилучення ключових слів: використання схожих косинусів як функцій
У мене є документ-термін матриця , і тепер я хотів би отримати ключові слова для кожного документа з контрольованим методом навчання (SVM, Naive Bayes, ...). У цій моделі я вже використовую Tf-idf, Pos тег, ...ММM Але зараз мені цікаво про некси. У мене є матриця із косинусною схожістю між термінами.ССC …

2
Чому в ідентифікації мови тексту замість слів використовується n-грам?
У двох популярних мовних ідентифікаційних бібліотеках, компактному детекторі мови 2 для C ++ та мовному детекторі для Java, обидві вони використовували (на основі символів) n-грамів для отримання тексту. Чому мішок слів (одне слово / словник) не використовується, і яка перевага та недолік мішок слів і n-грам? Крім того, які ще …

1
Приблизний розподіл продукту N нормального iid? Особливий випадок μ≈0
З огляду на н.о.р. , і , шукаю:X n ≈ N ( μ X , σ 2 X ) μ X ≈ 0N≥ 30N≥30N\geq30Хн≈ N( мкХ, σ2Х)Xn≈N(μX,σX2)X_n\approx\mathcal{N}(\mu_X,\sigma_X^2)мкХ≈ 0μX≈0\mu_X \approx 0 точне наближення розподілу закритої форми YN= ∏1NХнYN=∏1NXnY_N=\prod\limits_{1}^{N}{X_n} асимптотичне ( експоненціальне ?) наближення того ж добутку Це окремий випадок більш загального …

3
Щодо зближення у ймовірності
Нехай {Xn}n≥1{Xn}n≥1\{X_n\}_{n\geq 1} - послідовність випадкових змінних st Xn→aXn→aX_n \to a з імовірністю, де a&gt;0a&gt;0a>0 - фіксована константа. Я намагаюся показати таке: Xn−−−√→a−−√Xn→a\sqrt{X_n} \to \sqrt{a} і aXn→1aXn→1\frac{a}{X_n}\to 1 імовірність. Я тут, щоб перевірити, чи була моя логіка здоровою. Ось моя робота ATTEMPT Для першої частини у нас |Xn−−−√−a−−√|&lt;ϵ⟸|Xn−a|&lt;ϵ|Xn−−−√+a−−√|=ϵ|(Xn−−−√−sqrta)+2a−−√||Xn−a|&lt;ϵ⟸|Xn−a|&lt;ϵ|Xn+a|=ϵ|(Xn−sqrta)+2a||\sqrt{X_n}-\sqrt{a}|<\epsilon \impliedby |X_n-a|<\epsilon|\sqrt{X_n}+\sqrt{a}|=\epsilon|(\sqrt{X_n}-sqrt{a})+2\sqrt{a}| …

1
Як називається метод оцінки щільності, де всі можливі пари використовуються для створення нормального розподілу суміші?
Я просто думав про акуратний (не обов'язково хороший) спосіб створення однієї розмірної оцінки щільності, і моє питання: Чи має цей метод оцінки щільності назву? Якщо ні, то це особливий випадок якогось іншого методу в літературі? Ось метод: У нас є вектор який, як ми вважаємо, виведений з якогось невідомого розподілу, …

Використовуючи наш веб-сайт, ви визнаєте, що прочитали та зрозуміли наші Політику щодо файлів cookie та Політику конфіденційності.
Licensed under cc by-sa 3.0 with attribution required.