Наука про дані

Питання та відповіді для фахівців з науки про дані, фахівців з машинного навчання та тих, хто зацікавлений у вивченні даної області

4
Яку статистичну модель я повинен використовувати для аналізу ймовірності того, що одна подія вплинула на поздовжні дані
Я намагаюся знайти формулу, метод чи модель, яку б використати для аналізу ймовірності того, що конкретна подія вплинула на деякі поздовжні дані. Мені важко зрозуміти, що шукати в Google. Ось приклад сценарію: Image Ви є власником бізнесу, який щодня має в середньому 100 відвідувачів. Одного разу ви вирішите, що хочете …

2
Чому ReLU використовується як функція активації?
Функції активації використовуються для введення нелінійностей у лінійний вихід типу w * x + bв нейронній мережі. Який я здатний зрозуміти інтуїтивно для таких функцій активації, як сигмоїд. Я розумію переваги ReLU, яка уникає мертвих нейронів під час розмноження. Однак я не в змозі зрозуміти, чому ReLU використовується як функція …

1
Що таке "перегляд досвіду" та які його переваги?
Я читав статтю Google DeepMind Atari і намагаюся зрозуміти поняття "перегляд досвіду". Повтор досвіду з'являється у багатьох інших навчальних роботах з підкріпленням (зокрема, папері AlphaGo), тому я хочу зрозуміти, як це працює. Нижче наведено кілька уривків. По-перше, ми використовували біологічно натхненний механізм, який називають переглядом досвіду, який рандомізує дані, тим …

1
Способи вирішення функції довготи / широти [закрито]
Закрито . Це питання потребує деталей або ясності . Наразі відповіді не приймаються. Хочете вдосконалити це питання? Додайте деталі та уточніть проблему, відредагувавши цю публікацію . Закрито 3 роки тому . Я працюю над вигаданим набором даних з 25 функціями. Дві особливості - це широта та довгота місця, а інші …

4
Яке значення "Кількість одиниць у комірці LSTM"?
З коду Tensorflow : Tensorflow. RnnCell num_units: int, The number of units in the LSTM cell. Не можу відкинути, що це означає. Назвіть одиниці комірки LSTM. Вхідні, вихідні та забуті ворота? Чи означає це "кількість одиниць у шарі періодичного проектування для Deep LSTM". Тоді чому це називається "кількість одиниць у …

4
Як заповнити пропущене значення на основі інших стовпців у фреймі даних Pandas?
Припустимо, у мене є кадр даних 5 * 3, в якому третій стовпець містить відсутнє значення 1 2 3 4 5 NaN 7 8 9 3 2 NaN 5 6 NaN Я сподіваюся створити значення для відсутнього значення на основі правила, що перший колонка продукту 1 2 3 4 5 …
19 pandas 

3
Набір даних для розпізнавання іменованої особи в неофіційному тексті
Зараз я шукаю мічені набори даних для підготовки моделі для вилучення названих об'єктів з неофіційного тексту (щось подібне до твітів). Оскільки великої літери та граматики часто не вистачає в документах у моєму наборі даних, я шукаю дані про домен, які є трохи більш "неофіційними", ніж статті новин та записи журналів, …
18 dataset  nlp 

4
Як коментувати текстові документи за допомогою метаданих?
Маючи багато текстових документів (на природній мові, неструктурованих), які можливі способи їх анотування за допомогою деяких смислових метаданих? Наприклад, розглянемо короткий документ: I saw the company's manager last day. Щоб мати змогу витягувати з неї інформацію, її потрібно зазначати додатковими даними, щоб бути менш неоднозначною. Процес пошуку таких метаданих не …

3
Як масштабувати розробку алгоритму?
Працюючи над аналітичним аналізом даних та розробкою алгоритмів, я знаходжу, що більшу частину свого часу я проводжу в циклі візуалізації, записую якийсь код, працює за невеликим набором даних, повторюю. Дані, які я маю, зазвичай є типом злиття з комп'ютерним зором / сенсором, а алгоритми важкі для зору (наприклад, виявлення та …
18 algorithms 

1
Word2Vec проти Sentence2Vec проти Doc2Vec
Нещодавно я натрапив на терміни Word2Vec , Sentence2Vec і Doc2Vec, і я щось плутаю , оскільки я новачок у векторній семантиці. Чи може хтось, будь ласка, детально прояснити відмінності цих методів. Які найбільш підходящі завдання для кожного методу?


4
Коли можна використовувати відстань Манхеттена як протилежну евклідовій відстані?
Я намагаюся шукати хороший аргумент щодо того, чому можна використовувати відстань Манхеттена над евклідовою дистанцією в машинному навчанні. Найближча річ, яку я вважаю хорошим аргументом до цих пір, є на цій лекції MIT . О 36:15 на слайдах ви можете побачити таке твердження: "Зазвичай використовують евклідову метрику; Манхеттен може бути …

3
Реалізація функції витрат Python в логістичній регресії: чому кратне множення в одному виразі, але елементарне множення в іншому
У мене дуже основне питання, яке стосується Python, нумерування та множення матриць при встановленні логістичної регресії. По-перше, дозвольте мені попросити вибачення за те, що не використовую математичні позначення. Мене плутає використання матричного множення крапок проти мультиплікаційного множення елементів. Функція витрат задається: І в python я написав це як cost = …

1
Чи мають значення розміри t-sne?
Чи є значення для розмірів вбудовування t-sne? Як і у PCA, у нас є сенс лінійно перетворених дисперсійних максимізацій, але для t-sne є інтуїція, крім простого простору, який ми визначаємо для відображення та мінімізації відстані KL?

1
Як боротися зі строковими мітками в багатокласовій класифікації з керами?
Я новачок у машинному навчанні та керах, і зараз працюю над класовою проблемою класифікації зображень за допомогою керас. Вхід позначено тегом зображення. Після деякої попередньої обробки дані тренінгу представлені в списку Python як: [["dog", "path/to/dog/imageX.jpg"],["cat", "path/to/cat/imageX.jpg"], ["bird", "path/to/cat/imageX.jpg"]] "собака", "кішка" та "птах" - це позначки класу. Я думаю, що для …

Використовуючи наш веб-сайт, ви визнаєте, що прочитали та зрозуміли наші Політику щодо файлів cookie та Політику конфіденційності.
Licensed under cc by-sa 3.0 with attribution required.