Статистика та великі дані

Питання та відповіді для людей, зацікавлених у статистиці, машинному навчанні, аналізі даних, інтелектуальному аналізу даних та візуалізації даних

2
Алгоритми машинного навчання даних панелей
У цьому запитанні - чи існує метод побудови дерев рішень, який враховує структуровані / ієрархічні / багаторівневі предиктори?- вони згадують метод панельних даних для дерев. Чи існують конкретні методи даних панелей для підтримки векторних машин та нейронних мереж? Якщо так, чи можете ви навести деякі документи для алгоритмів та (якщо …

2
розуміння р-значення при множинній лінійній регресії
Щодо р-значення множинного лінійного регресійного аналізу, вступ із веб-сайту Minitab показано нижче. Значення р для кожного терміна перевіряє нульову гіпотезу про те, що коефіцієнт дорівнює нулю (немає ефекту). Низьке p-значення (<0,05) вказує на те, що ви можете відхилити нульову гіпотезу. Іншими словами, передбачувач, який має низьке значення р, швидше за …

2
Розподіл вірогідності для галасливої ​​синусоїди
Я шукаю аналітично обчислити розподіл ймовірності точок відбору з коливальної функції, коли є якась помилка вимірювання. Я вже підрахував розподіл ймовірності для частини "без шуму" (я поставлю це в кінці), але не можу зрозуміти, як включити "шум". Числова оцінка Щоб було зрозуміліше, уявіть, що існує деяка функція якої ви випадково …

2
Як порівняти два алгоритми ранжування?
Я хочу порівняти два алгоритми ранжування. У цих алгоритмах клієнт вказує деякі умови у своєму пошуку. Відповідно до вимог клієнта, цей алгоритм повинен призначити бал для кожного елемента в базі даних та отримати елементи з найвищими балами. Я читав різні теми, пов'язані з моїм запитанням на цьому веб-сайті, і шукав …

5
Норми хребта та LASSO
Цей пост слідує за цим: Чому оцінка хребта стає кращою за OLS, додаючи константу до діагоналі? Ось моє запитання: Наскільки мені відомо, регуляризація хребта використовує (евклідова відстань). Але чому ми використовуємо квадрат цієї норми? (пряме застосування призведе до квадратного кореня суми бета-квадрата).ℓ 2ℓ2ℓ2\ell_2ℓ2ℓ2\ell_2 Для порівняння, ми не робимо цього для …

2
Чому R потрібно тривалий час, щоб підходити до моделі з багаторівневим коефіцієнтом?
Мені підходить модель з коефіцієнтом з багатьма рівнями, і для отримання R потрібне дуже довгий час. Чому це? Наприклад, якщо мені підходить регресія, щоб прогнозувати зарплату гравців, і включати фактор прогнозування для всіх національних гравців, це займе більше часу, ніж встановлення моделі зарплати гравців з безперервним прогнозувачем, як-от гравців висоти.

1
Чи відповідає кожна напівпозитивна певна матриця коваріаційній матриці?
Загальновідомо, що матриця коваріації повинна бути напівпозитивно визначеною, однак чи справжнє зворотне? Тобто, чи відповідає кожна напівпозитивна певна матриця коваріаційній матриці?


1
Який розподіл призводить до додавання двох розподілів Pareto
Мені цікаво, який розподіл призводить до додавання двох (або більше) типів-одного розподілу Парето форми . Експериментально це виглядає як двомодовий закон про владу, асимптотичний різниці альфа.х- αx−αx^{-\alpha}

1
Різниця між серіями з дрейфом і серіями з трендом
Ряд із дрейфом можна моделювати як ут= c + ϕ yt - 1+ εтут=c+ϕут-1+εтy_t = c + \phi y_{t-1} + \varepsilon_t де ccc - дрейф (константа), а ϕ = 1ϕ=1\phi=1 . Ряд із трендом можна моделювати як ут= c + δt + ϕ yt - 1+ εтут=c+δт+ϕут-1+εтy_t = c + …

2
Непараметрична міра сили зв’язку між порядковою і безперервною випадковою змінною
Я кидаю тут проблему, як я її отримав. У мене є дві випадкові величини. Один з яких є безперервним (Y), а інший - дискретним і буде наближатися до порядкового (X). Я поставив нижче сюжет, який я отримав разом із запитом. Людина, яка надсилає мені дані, хоче виміряти силу зв’язку між …

1
Які умови регулярності тесту на коефіцієнт ймовірності
Чи не будь-хто, будь ласка, скажіть мені, які умови регулярності для асимптотичного розподілу тесту на коефіцієнт ймовірності? Куди б я не глянув, написано: "За умовами регулярності" або "Під імовірнісними закономірностями". Які саме умови? Що перша та друга похідні імовірності ідентифікації існують, а матриця інформації не дорівнює нулю? Або щось інше …

1
Що зумовлює U-образний малюнок у просторовій корелограмі?
Я помітив у власній роботі цю закономірність, коли вивчав просторову корелограму на різних відстанях, з’являється П-подібний візерунок у кореляціях. Більш конкретно, сильні позитивні кореляції на відстані невеликих відстаней зменшуються з відстанню, потім досягають ями в певній точці, а потім піднімаються назад. Ось приклад з блогу Conservation Ecology, майданчик макроекології (3) …

1
Як формувати криву точності нагадування, коли у мене є лише одне значення для PR?
У мене є завдання пошуку даних, де я створюю систему пошуку зображень на основі вмісту. У мене 20 зображень 5 тварин. Так загалом 100 зображень. Моя система повертає 10 найбільш релевантних зображень до вхідного зображення. Тепер мені потрібно оцінити працездатність моєї системи за допомогою кривої Precision-Recall. Однак я не розумію …


Використовуючи наш веб-сайт, ви визнаєте, що прочитали та зрозуміли наші Політику щодо файлів cookie та Політику конфіденційності.
Licensed under cc by-sa 3.0 with attribution required.