توضیحات
این دیتاست شامل 768 رکورد و 9 ستون است و درباره شاخصهای بالینی برای تشخیص برچسب diabetes است. متغیر هدف آن «diabetes» است. در فایل اصلی 0 مقدار Missing و 0 رکورد تکراری کامل شناسایی شد. براساس ساختار واقعی ستونها، برای تمرین Logistic Regression، KNN، Decision Tree، Random Forest، SVM، XGBoost مناسب است. اطلاعات ستونها، نوع داده و پیشنمایش صفحه از خود فایل ورودی استخراج شدهاند.
متغیر هدف
diabetesTarget قابل تشخیص از ساختار فایلColumns
9 ستونستونهای دیتاست
| # | نام ستون | Data Type | Missing | توضیح |
|---|---|---|---|---|
| 1 | times_pregnant | Integer | 0 | — |
| 2 | glucose_concentration | Integer | 0 | — |
| 3 | diastolic_blood_pressure | Integer | 0 | — |
| 4 | triceps_sf_thickness | Integer | 0 | — |
| 5 | serum_insulin | Integer | 0 | — |
| 6 | bmi | Number | 0 | شاخص توده بدنی |
| 7 | d_pedigree_function | Number | 0 | — |
| 8 | years_of_age | Integer | 0 | — |
| 9 | diabetes | Integer | 0 | متغیر هدف؛ برچسب دیابت |
Preview
۵ ردیف اولپیشنمایش دیتاست
برای حفظ سرعت، فقط چند ردیف و حداکثر ۱۲ ستون نمایش داده میشود؛ کل فایل در مرورگر بارگذاری نمیشود.
times_pregnant | glucose_concentration | diastolic_blood_pressure | triceps_sf_thickness | serum_insulin | bmi | d_pedigree_function | years_of_age | diabetes |
|---|---|---|---|---|---|---|---|---|
| 6.0 | 148.0 | 72.0 | 35.0 | 0.0 | 33.6 | 0.627 | 50.0 | 1.0 |
| 1.0 | 85.0 | 66.0 | 29.0 | 0.0 | 26.6 | 0.351 | 31.0 | 0.0 |
| 8.0 | 183.0 | 64.0 | 0.0 | 0.0 | 23.3 | 0.672 | 32.0 | 1.0 |
| 1.0 | 89.0 | 66.0 | 23.0 | 94.0 | 28.1 | 0.167 | 21.0 | 0.0 |
| 0.0 | 137.0 | 40.0 | 35.0 | 168.0 | 43.1 | 2.288 | 33.0 | 1.0 |
Files
2 فایل