Наука про дані

Питання та відповіді для фахівців з науки про дані, фахівців з машинного навчання та тих, хто зацікавлений у вивченні даної області

2
Будь-які відмінності в регуляризації в MLP між пакетними та індивідуальними оновленнями?
Щойно я дізнався про регуляризацію як про підхід до контролю над приміркою, і хотів би включити цю ідею в просту реалізацію зворотного розповсюдження та багатошарового персептрону (MLP), який я зібрав разом. В даний час, щоб уникнути переналагодження, я перехресно підтверджую і зберігаю мережу з найкращим результатом досі на наборі перевірки. …

1
Кодування навчального сигналу
У мене є велика кількість зразків, які представляють закодовані в Манчестері потоки бітів як звукові сигнали. Частота, з якою вони кодуються, є основною складовою частоти, коли вона велика, а на задньому плані є стійка кількість білого шуму. Я вручну розшифрував ці потоки, але мені було цікаво, чи можу я використати …

4
Запропонувати набори навчальних наборів текстів класифікатора
Які вільно доступні набори даних я можу використовувати для тренування класифікатора тексту? Ми намагаємось посилити залучення наших користувачів, рекомендуючи для нього найпов'язаніший вміст, тому ми подумали, що якщо ми класифікуємо наш вміст на основі заздалегідь визначеного пакету слів, ми можемо рекомендувати йому залучати вміст, отримуючи його відгуки про випадкову кількість …

1
Реляційний обмін даними без ІЛП
У мене є величезний набір даних з реляційної бази даних, для чого мені потрібно створити модель класифікації. Зазвичай у цій ситуації я б використовував індуктивне логічне програмування (ILP), але через особливі обставини цього не можу. Іншим способом вирішити це було б просто спробувати узагальнити значення, коли у мене є зовнішні …

2
Розпізнавання діяльності людини за допомогою набору даних про смартфон
Я новачок у цій спільноті, і, сподіваюся, моє запитання тут добре впишеться. Як частина мого курсу бакалаврської аналітики даних я вирішив зробити проект з розпізнавання людської діяльності за допомогою наборів даних смартфонів. Наскільки мене хвилює ця тема стосується машинного навчання та підтримки векторних машин. Я ще не добре знайомий з …

1
Який найкращий показник ефективності, який використовується в балансуванні набору даних за допомогою технології SMOTE
Я використовував техніку smote, щоб проаналізувати мій набір даних, і тепер у мене є збалансований набір даних. Проблема, з якою я стикався, полягає в тому, що показники ефективності; точність, нагадаємо, міра f1, точність в незбалансованому наборі даних краще виконуватись, ніж у збалансованих даних. Яке вимірювання можна використовувати, щоб показати, що …

1
Керас 'ModelCheckpoint не працює
Я намагаюся навчити модель в керах і використовую ModelCheckpoint, щоб зберегти найкращу модель відповідно до контрольованої метрики перевірки (у моєму випадку індекс Жаккарда ). Хоча я бачу, як модель вдосконалюється в тензорній дошці, коли я намагаюся завантажити ваги і оцінити модель, вона взагалі не працює. Крім того, за міткою часу …
8 keras  convnet 

1
Категоризація підходів для боротьби з незбалансованими класами
Який найкращий спосіб класифікувати підходи, розроблені для вирішення проблеми класу дисбалансу? Ця стаття класифікує їх на: Попередня обробка: включає в себе передискретизацію, піддискретизацію та гібридні методи, Навчання, що залежить від затрат: включає прямі методи та мета-навчання, які останнє ділить на порог та вибірку, Ансамблеві прийоми: включає в себе рентабельні ансамблі …


3
Чи існують методи машинного навчання для визначення точок на ділянках / зображеннях?
У мене є дані про бічне положення кожного автомобіля за часом та номер смуги руху, як показано на цих 3-х графіках на зображенні та зразках даних нижче. > a Frame.ID xcoord Lane 1 452 27.39400 3 2 453 27.38331 3 3 454 27.42999 3 4 455 27.46512 3 5 456 …

5
Підручники з тематичних моделей та LDA
Мені хотілося б знати, чи є у вас якісь хороші підручники (швидкі та прості) про тематичні моделі та LDA, навчаючи інтуїтивно, як встановлювати деякі параметри, що вони означають і, якщо можливо, за допомогою реальних прикладів.

2
Чому регресія Gradient Boosting прогнозує негативні значення, коли в моєму навчальному наборі немає негативних значень y?
Як я можу збільшити кількість дерев в scikit дізнатися «S GradientBoostingRegressor, я отримую більше негативні прогнози, незважаючи на те, немає негативних значень в моєму навчанні або тестування набору. У мене є близько 10 функцій, більшість з яких є бінарними. Деякі з параметрів, які я налаштовував: кількість дерев / ітерацій; глибина …

2
Помилка пам'яті при використанні більше шарів у моделі CNN
На моєму ядро ​​Dell i7 - 16 ГБ оперативної пам’яті - 4 ГБ 960 м графічного процесора, я працюю над проектом, щоб класифікувати зображення легких КТ за допомогою 3D-CNN. Я використовую версію процесора tensorflow. Зображення готуються у вигляді масивного масиву (25,50,50). У моїй моделі CNN було 2 шари конвеєра, два …

2
Чи слід використовувати sklearn або tensorflow для нейронних мереж?
Я щойно почав вивчати нейронні мережі для глибокого навчання з cs231. Я намагаюся реалізувати Нейронну мережу в Python. Я дивлюся на використання Tensorflow або scikit-learn. Які плюси і мінуси цих бібліотек для цього додатка?

1
Питання про відхилення відхилень відхилення та засоби оптимізації
Тож мені було цікаво, як можна, наприклад, найкраще оптимізувати модель, яку вони намагаються побудувати, стикаючись із проблемами, представленими великими ухилами чи великою дисперсією. Тепер, звичайно, ви можете грати з параметром регуляризації, щоб дійти до задовільного кінця, але мені було цікаво, чи можна це зробити, не покладаючись на регуляризацію. Якщо b …
Використовуючи наш веб-сайт, ви визнаєте, що прочитали та зрозуміли наші Політику щодо файлів cookie та Політику конфіденційності.
Licensed under cc by-sa 3.0 with attribution required.