Наука про дані

Питання та відповіді для фахівців з науки про дані, фахівців з машинного навчання та тих, хто зацікавлений у вивченні даної області

2
Чи означає нормалізація партії, що сигмоїди працюють краще, ніж ReLU?
Пакетна нормалізація та ReLU - це рішення для зниклої градієнтної проблеми. Якщо ми використовуємо пакетну нормалізацію, чи повинні ми використовувати сигмоїди? Або є функції ReLU, які роблять їх корисними навіть при використанні batchnorm? Я припускаю, що нормалізація, проведена в batchnorm, посилатиме нульову активацію негативною. Чи означає це, що batchnorm вирішує …

4
SGDClassifier: Інтернет-навчання / часткова_фіксація з раніше невідомою міткою
Мій навчальний набір містить близько 50 тис. Записів, з якими я навчаюсь. Щотижня додається ~ 5k записів; але така ж кількість "зникає" (так як це дані користувачів, які доводиться видаляти через деякий час). Тому я використовую онлайн-навчання, оскільки в подальшому не маю доступу до повного набору даних. В даний час …


2
які методи машинного / глибокого навчання / nlp використовуються для класифікації певних слів як імені, мобільного номера, адреси, електронної пошти, штату, округу, міста тощо
Я намагаюся створити інтелектуальну модель, яка може сканувати набір слів або рядків і класифікувати їх як імена, мобільні номери, адреси, міста, штати, країни та інші об'єкти за допомогою машинного навчання або глибокого навчання. Я шукав підходи, але, на жаль, не знайшов жодного підходу. Я намагався вбудовувати мішок із слів моделі …

1
Збалансовані дані, що спричиняють неправильну класифікацію на множині набору даних
Я працюю над класифікацією тексту, де маю 39 категорій / класів та 8,5 мільйонів записів. (У майбутньому дані та категорії будуть збільшуватися). Структура або формат моїх даних наступний. ---------------------------------------------------------------------------------------- | product_title | Key_value_pairs | taxonomy_id | ---------------------------------------------------------------------------------------- Samsung S7 Edge | Color:black,Display Size:5.5 inch,Internal | 211 Storage:128 GB, RAM:4 GB,Primary …

1
Як реалізувати сигмоподібну функцію в Octave? [зачинено]
Закрито . Це питання потребує деталей або ясності . Наразі відповіді не приймаються. Хочете вдосконалити це питання? Додайте деталі та уточніть проблему, відредагувавши цю публікацію . Закрито 2 роки тому . так зважаючи на те, що сигмоїдна функція визначається як hθ (x) = g (θ ^ (T) x), як я …

2
Який алгоритм застосувати для вибору потрібної точки
На малюнку нижче показано 7 пунктів навколо початку. Один з них був обраний людиною на основі правил та досвіду і пофарбований у червоний колір (той у нижньому лівому квадранті). Зараз у нас є понад 1000 цих наборів точок, і для кожного набору людина вибрала одну точку. Ці умови стосуються всіх …

1
Чи можна HDF5 надійно записувати та читати одночасно окремими процесами python?
Я пишу сценарій для того, щоб записати дані в реальному часі в один файл HDF5, який включає весь мій набір даних для цього проекту. Я працюю з Python 3.6 і вирішив створити інструмент командного рядка clickдля збору даних. Мене хвилює те, що станеться, якщо сценарій збору даних запишеться у файл …
9 python  dataset 

2
«Теорема глибокого Нітера»: побудова обмежень симетрії
Якщо у мене є проблема навчання, яка повинна мати властиву симетрію, чи є спосіб піддати мою проблему навчання обмеженням симетрії для покращення навчання? Наприклад, якщо я роблю розпізнавання зображень, я, можливо, захочу 2D обертальну симетрію. Це означає, що повернута версія зображення повинна мати такий же результат, як і оригінал. Або …

1
Як підходити до проблеми класифікації, коли один із класів визначається "не будь-яким з інших"
Припустимо, мене цікавлять три класи c1c1c_1, c2c2c_2, c3c3c_3. Але мій набір даних насправді містить ще кілька реальних класів(cj)nj=4(cj)j=4n(c_j)_{j=4}^n. Очевидною відповіддю є визначення нового класу c^4c^4\hat c_4 що стосується всіх класів cjcjc_j, j>3j>3j>3 але я підозрюю, що це не гарна ідея, оскільки зразки в c^4c^4\hat c_4 будуть рідкісними і не дуже …

1
t-SNE: Чому рівні значення даних візуально не близькі?
У мене 200 точок даних, які мають однакові значення для всіх функцій. Після зменшення розміру t-SNE вони вже не виглядають настільки рівними, як це: Чому вони не в одній точці візуалізації і навіть, здається, розподілені у двох різних кластерах?

4
Класифікуйте багатоваріантний часовий ряд
У мене є набір даних, що складається з часових рядів (8 балів) з приблизно 40 вимірами (тому кожен часовий ряд - 8 на 40). Відповідний результат (можливі результати для категорій) - це 0 або 1. Який був би найкращий підхід до проектування класифікатора часових рядів з кількома розмірами? Моя початкова …

2
Чи має сенс тренувати CNN як автокодер?
Я працюю з аналізом даних ЕЕГ, які згодом потрібно буде класифікувати. Однак отримання міток для записів є дещо дорогим, що змусило мене розглянути непідвладний підхід, щоб краще використовувати наші досить великі обсяги незазначених даних. Це природно призводить до розгляду штабельних автокодерів, що може бути хорошою ідеєю. Однак було б також …

3
Чому б не тренувати кінцеву модель на всіх даних після проведення даних тестування на основі базової настройки гіперпараметрії та даних перевірки вибору моделі?
Під усіма даними я маю на увазі поїзд + тест + перевірка Після того, як я зафіксував свій гіперпараметр за допомогою даних валідації та обрав модель за допомогою тестових даних, чи не краще буде модель тренуватися за всіма даними, щоб параметри були краще навчені, а не модель була навчена тільки …

1
кількість параметрів для шарів згортки
У цій високо цитованій роботі автори дають наступне обговорення щодо кількості вагових параметрів. Мені не дуже зрозуміло, чому він має параметри . Я думаю, що це має бути оскільки кожен із вхідних каналів має той же фільтр, у якого є параметрів.49С249C249C^249 С49C49CСCC494949

Використовуючи наш веб-сайт, ви визнаєте, що прочитали та зрозуміли наші Політику щодо файлів cookie та Політику конфіденційності.
Licensed under cc by-sa 3.0 with attribution required.