Notice: This page requires JavaScript to function properly.
Please enable JavaScript in your browser settings or update your browser.
Вивчайте Реалізація на реальному наборі даних | DBSCAN
Кластерний аналіз з Python

Реалізація на реальному наборі даних

Свайпніть щоб показати меню

Використовується набір даних mall customers, який містить такі стовпці:

Також слід виконати такі кроки перед кластеризацією:

  1. Завантаження даних: використовується pandas для завантаження CSV-файлу;
  2. Вибір релевантних ознак: фокус на стовпцях 'Annual Income (k$)' та 'Spending Score (1-100)';
  3. Масштабування даних (важливо для DBSCAN): оскільки DBSCAN використовує обчислення відстаней, важливо масштабувати ознаки до подібних діапазонів. Для цього можна використати StandardScaler.

Інтерпретація

У цьому випадку код створює 5 кластерів. Важливо проаналізувати отримані кластери для отримання уявлення про сегментацію клієнтів. Наприклад, можна виявити кластери, що представляють:

  • Клієнти з високим доходом і високими витратами;
  • Клієнти з високим доходом і низькими витратами;
  • Клієнти з низьким доходом і високими витратами;
  • Клієнти з низьким доходом і низькими витратами;
  • Клієнти із середнім доходом і середніми витратами.
Кластери DBSCAN

Підсумкові зауваження

Все було зрозуміло?

Як ми можемо покращити це?

Дякуємо за ваш відгук!

Секція 5. Розділ 5

Запитати АІ

expand

Запитати АІ

ChatGPT

Запитайте про що завгодно або спробуйте одне із запропонованих запитань, щоб почати наш чат

Реалізація на реальному наборі даних

Використовується набір даних mall customers, який містить такі стовпці:

Також слід виконати такі кроки перед кластеризацією:

  1. Завантаження даних: використовується pandas для завантаження CSV-файлу;
  2. Вибір релевантних ознак: фокус на стовпцях 'Annual Income (k$)' та 'Spending Score (1-100)';
  3. Масштабування даних (важливо для DBSCAN): оскільки DBSCAN використовує обчислення відстаней, важливо масштабувати ознаки до подібних діапазонів. Для цього можна використати StandardScaler.

Інтерпретація

У цьому випадку код створює 5 кластерів. Важливо проаналізувати отримані кластери для отримання уявлення про сегментацію клієнтів. Наприклад, можна виявити кластери, що представляють:

  • Клієнти з високим доходом і високими витратами;
  • Клієнти з високим доходом і низькими витратами;
  • Клієнти з низьким доходом і високими витратами;
  • Клієнти з низьким доходом і низькими витратами;
  • Клієнти із середнім доходом і середніми витратами.
Кластери DBSCAN

Підсумкові зауваження

Все було зрозуміло?

Як ми можемо покращити це?

Дякуємо за ваш відгук!

Секція 5. Розділ 5
some-alt