Статистика та великі дані

Питання та відповіді для людей, зацікавлених у статистиці, машинному навчанні, аналізі даних, інтелектуальному аналізу даних та візуалізації даних

4
Тлумачення негативної косинусної подібності
Моє запитання може бути дурним. Тому я заздалегідь прошу вибачення. Я намагався використовувати модель GLOVE, попередньо підготовлену групою Stanford NLP ( посилання ). Однак я помітив, що результати моєї подібності показали деякі негативні цифри. Це відразу ж підштовхнуло мене переглянути файл файлів даних word-vector. Мабуть, значення у векторах слова мали …

4
Чи можна надати зображення змінного розміру як вхід до згорткової нейронної мережі?
Чи можемо ми дати зображення із змінним розміром як вхід у згорнуту нейронну мережу для виявлення об'єктів? Якщо можливо, як це зробити? Але якщо ми спробуємо обрізати зображення, ми втратимо частину зображення, а якщо спробуємо змінити розмір, то чіткість зображення буде втрачена. Чи означає це, що використання властивості властивості мережі …


4
Чому незалежність передбачає нульову кореляцію?
Перш за все, я цього не запитую: Чому нульова кореляція не передбачає незалежності? Це вирішено (досить приємно) тут: /math/444408/why-does-zero-correlation-not-imply-independence Що я прошу - це протилежне ... скажімо, дві змінні повністю незалежні одна від одної. Чи не могли вони мати крихітний кореляційний зв’язок випадково? Чи не повинно бути ... незалежність передбачає …

4
Про Джорджа Бокса, Галіта Шмулі та науковий метод?
(Це питання може здатися, що він краще підходить для філософії SE. Я сподіваюся, що статистики зможуть роз'яснити мої помилки щодо тверджень Бокса та Шмуелі, отже, я їх розміщую тут). Джордж Бокс (про славу ARIMA) сказав: "Усі моделі помиляються, але деякі корисні." Галіт Шмулі у своїй знаменитій статті "Пояснити або передбачити" …

3
Як математично визначається причинно-наслідковий зв’язок?
Яке математичне визначення причинно-наслідкового зв’язку між двома випадковими змінними? З огляду на вибірку із спільного розподілу двох випадкових величин і , коли ми говоримо, що викликає Y ?XXXYYYXXXYYY З контексту я читаю цей документ про причинно-наслідкове виявлення .

1
Чи навчається під наглядом підмножина підсилення навчання?
Схоже, визначення контрольованого навчання - це підмножина посиленого навчання з певним видом функції винагороди, яка базується на мічених даних (на відміну від іншої інформації в оточенні). Це точне зображення?

3
Чи існує більше однієї "серединної" формули?
У моїй роботі, коли люди посилаються на "середнє" значення набору даних, вони зазвичай посилаються на середнє арифметичне (тобто "середнє" або "очікуване значення"). Якби я надавав геометричну середню, люди, швидше за все, подумають, що я чинюсь чи не допомагаю, оскільки визначення "середнього" відомо заздалегідь. Я намагаюся визначити, чи існує декілька визначень …

1
Що означає, що AUC - це напівправильне залікове правило?
Правильне бальне оцінювання - це правило, яке максимально реалізується "справжньою" моделлю, і воно не дозволяє "хеджувати" або грати в систему (свідомо повідомляти про різні результати, як це справжня віра моделі для покращення балів). Оцінка Brier належна, точність (правильно класифікована пропорція) є неправильною і часто не рекомендується. Іноді я бачу, що …

2
Які форми розподілу дають «піфагорійське очікування»?
Нехай і є незалежними безперервними випадковими змінними, що генеруються з тієї ж не визначеної форми розподілу, але з урахуванням різних значень параметрів. Мені цікаво знайти параметричну форму розподілу, для якої має місце наступна ймовірність вибірки для всіх допустимих значень параметрів:Х∼ Розв( θ)Х)Х∼Розв(θХ)X \sim \text{Dist}(\theta_X)Y∼ Дист ( θ)Y)Y∼Розв(θY)Y \sim \text{Dist}(\theta_Y) Р …

4
Як Баєсівська статистика поводиться з відсутністю пріорів?
Це питання було натхнене двома останніми взаємодіями, які я мав, одна тут у резюме , а інша на економ.се. Там, я відправив відповідь на відомий «Конверт парадоксу» (зауважте, не як на «правильну відповідь» , але в якості відповіді , що випливають з конкретних припущень про структуру ситуації). Через деякий час …

1
Чому інформаційний критерій Akaike більше не використовується в машинному навчанні?
Я щойно натрапив на "критерій інформації Akaike", і я помітив цю велику кількість літератури щодо вибору моделі (також такі речі, як BIC, здається, існують). Чому сучасні методи машинного навчання не скористаються цими критеріями вибору моделі BIC та AIC?

6
Як я міг виявити нормальний розподіл?
Що було першим виведенням нормального розподілу, чи можете ви відтворити це похідне, а також пояснити його в його історичному контексті ? Я маю на увазі, якби людство забуло про нормальний розподіл, який найімовірніший спосіб я б його знову відкрив і що було б найімовірнішим виведенням? Я б здогадувався, що перші …

4
Чи можливо, що 3 вектори мають усі негативні попарні кореляції?
Враховуючи три вектори , і , чи можливо, що кореляції між і , і , і є негативними? Тобто це можливо?aaabbbcccaaabbbaaacccbbbccc corr(a,b)&lt;0corr(a,c)&lt;0corr(b,c)&lt;0corr(a,b)&lt;0corr(a,c)&lt;0corr(b,c)&lt;0\begin{align} \text{corr}(a,b) < 0\\ \text{corr}(a,c) < 0 \\ \text{corr}(b,c) < 0\\ \end{align}

2
Що відбувається тут, коли я використовую квадратичні втрати для налаштування логістичної регресії?
Я намагаюся використовувати збиток у квадраті, щоб зробити бінарну класифікацію набору даних про іграшки. Я використовую mtcarsнабір даних, використовуйте милю на галон і вагу для прогнозування типу передачі. На графіку нижче показані два типи даних передачі різних кольорів та межа прийняття рішення, породжена різними функціями втрат. Збиток у квадраті - …

Використовуючи наш веб-сайт, ви визнаєте, що прочитали та зрозуміли наші Політику щодо файлів cookie та Політику конфіденційності.
Licensed under cc by-sa 3.0 with attribution required.