Наука про дані

Питання та відповіді для фахівців з науки про дані, фахівців з машинного навчання та тих, хто зацікавлений у вивченні даної області

3
Нульова середня та одинична варіація
Я вивчаю масштабування даних і, зокрема, метод стандартизації. Я зрозумів математику за цим, але мені незрозуміло, чому важливо наводити функції нульової середньої та одиничної дисперсії. Ви можете мені пояснити?

2
Як я можу виявити, чи було фотографії фотошоп?
Я хотів би перевірити JPG-файли, чи маніпулювали ними для зміни вмісту. Що я вважаю НЕ фотошопом: Обрізання Обертовий (Масштабування) Роздільна здатність зображення Автоматичні зміни можуть робити смартфони Що я вважаю фотошопом: Додавання нового зображення поверх частин старого зображення Зміна тексту частини зображення Як це можна автоматично перевірити? (І чи є …

4
Чи вважається PCA алгоритмом машинного навчання
Я розумів, що аналіз основних компонентів - це техніка зменшення розмірності, тобто з 10 вхідних ознак, вона створить меншу кількість незалежних ознак, які є ортогональними та лінійними перетвореннями оригінальних ознак. Є чи PCAсам по собі розглядається як алгоритм навчання або це крок попередньої обробки даних.

2
Навіщо використовувати регуляризацію L1 над L2?
Проведення лінійної регресійної моделі за допомогою функції втрат, чому я повинен використовувати L1L1L_1 замість L2L2L_2 регуляризація? Чи краще у запобіганні надмірного пристосування? Це детерміновано (тому завжди унікальне рішення)? Чи краще при виборі функцій (тому що виробляються рідкісні моделі)? Чи розподіляє ваги серед особливостей?

3
Чи можна використовувати координати GPS (широту та довготу) як функції в лінійній моделі?
У мене є набори даних, які містять серед багатьох функцій координати GPS (широта та довгота). Я хотів би використовувати ці набори даних для дослідження таких проблем, як: (1) обчислення ETA для руху між початковою та кінцевою точками; та (2) оцінка кількості злочину для конкретного пункту. Я хотів би використовувати лінійну …


2
Сортуйте числа за допомогою лише 2 прихованих шарів
Я читаю наріжний документ « Послідовність до послідовності навчання за допомогою нейронних мереж » Іллі Суцкевера та Квока Ле. На першій сторінці коротко згадується, що: A surprising example of the power of DNNs is their ability to sort N N-bit numbers using only 2 hidden layers of quadratic size Чи …

1
Чи має сенс найближчий сусід з t-SNE?
Відповіді на цю заяву вказували, що розміри в t-SNE є безглуздими і що відстані між точками не є мірою подібності . Однак чи можемо ми сказати що-небудь про точку на основі найближчих сусідів у просторі t-SNE? Ця відповідь на питання, чому точки, які точно однакові, не кластеризовані, дозволяє припустити, що …
10 tsne 

2
Як виконати логістичну регресію з великою кількістю функцій?
У мене є набір даних з 330 зразками та 27 функцій для кожного зразка, з проблемою бінарного класу для логістичної регресії. Відповідно до "правила, якщо десять", для кожної функції мені потрібно принаймні 10 подій. Хоча я маю незбалансований набір даних із 20% o позитивним класом і 80% негативним класом. Це …

4
Чому прискорюється спуск градієнта, якщо функція плавна?
Зараз я читаю книгу під назвою "Ручне машинне навчання за допомогою Scikit-Learn та TensorFlow", і в главі 11 вона містить такий опис щодо пояснення ELU (Exponential ReLU). По-третє, функція скрізь гладка, в тому числі навколо z = 0, що сприяє прискоренню градієнтного спуску, оскільки воно не відскакує стільки, скільки вліво …

2
Яка матриця функцій у word2vec?
Я початківець у нейромережах, і зараз вивчаю модель word2vec. Однак у мене важкий час, щоб зрозуміти, що саме являє собою матриця функцій. Я можу зрозуміти, що перша матриця - це гарячий вектор кодування для даного слова, але що означає друга матриця? Більш конкретно, що означає кожне з цих значень (тобто …


1
Як визначити складність англійського речення?
Я працюю над додатком, щоб допомогти людям вивчати англійську мову як другу мову. Я підтвердив, що речення допомагають вивчати мову, надаючи додатковий контекст. Я зробив це, провівши невелике дослідження в класі 60 учнів. Я видобув понад сто тисяч речень з Вікіпедії для різних англійських слів (включаючи 800 слів Баррона і …

1
Уникайте перезавантаження DataFrame між різними ядрами python
Чи існує спосіб збереження змінної (велика таблиця / кадр даних) у пам’яті та обміну нею в декількох ноутбуках ipython? Я б шукав щось, що концептуально схоже на постійні змінні MATLAB. Там можна викликати користувальницьку функцію / бібліотеку з декількох окремих редакторів (зошитів) і мати цю зовнішню функцію кешувати деякий результат …

1
Чому TensorFlow не може підходити до простої лінійної моделі, якщо я мінімізую абсолютну середню помилку замість середньої помилки у квадраті?
У Вступі я щойно змінився loss = tf.reduce_mean(tf.square(y - y_data)) до loss = tf.reduce_mean(tf.abs(y - y_data)) і модель не в змозі дізнатись, з часом збитки тільки зростали. Чому?

Використовуючи наш веб-сайт, ви визнаєте, що прочитали та зрозуміли наші Політику щодо файлів cookie та Політику конфіденційності.
Licensed under cc by-sa 3.0 with attribution required.