توضیحات
این دیتاست شامل 4,001 رکورد و 9 ستون است و درباره ویژگیهای عددی سیب مانند اندازه، وزن، شیرینی و رسیدگی برای تشخیص کیفیت است. متغیر هدف آن «Quality» است. در فایل اصلی 8 مقدار Missing و 0 رکورد تکراری کامل شناسایی شد. براساس ساختار واقعی ستونها، برای تمرین Logistic Regression، KNN، Decision Tree، Random Forest، SVM، XGBoost مناسب است. اطلاعات ستونها، نوع داده و پیشنمایش صفحه از خود فایل ورودی استخراج شدهاند.
فایل خام یک ردیف پایانی metadata-like با عبارت Created_by دارد؛ فایل منبع بدون دستکاری نگهداری شده و Missingها در آمار منعکس شدهاند.
متغیر هدف
QualityTarget قابل تشخیص از ساختار فایلColumns
9 ستونستونهای دیتاست
| # | نام ستون | Data Type | Missing | توضیح |
|---|---|---|---|---|
| 1 | A_id | Number | 1 | — |
| 2 | Size | Number | 1 | — |
| 3 | Weight | Number | 1 | وزن |
| 4 | Sweetness | Number | 1 | — |
| 5 | Crunchiness | Number | 1 | — |
| 6 | Juiciness | Number | 1 | — |
| 7 | Ripeness | Number | 1 | — |
| 8 | Acidity | Text | 0 | — |
| 9 | Quality | Text | 1 | متغیر هدف؛ برچسب یا امتیاز کیفیت |
Preview
۵ ردیف اولپیشنمایش دیتاست
برای حفظ سرعت، فقط چند ردیف و حداکثر ۱۲ ستون نمایش داده میشود؛ کل فایل در مرورگر بارگذاری نمیشود.
A_id | Size | Weight | Sweetness | Crunchiness | Juiciness | Ripeness | Acidity | Quality |
|---|---|---|---|---|---|---|---|---|
| 0.0 | -3.970048523 | -2.512336381 | 5.346329613 | -1.012008712 | 1.844900361 | 0.329839797 | -0.491590483 | good |
| 1.0 | -1.195217191 | -2.839256528 | 3.664058758 | 1.588232309 | 0.853285795 | 0.867530082 | -0.722809367 | good |
| 2.0 | -0.292023862 | -1.351281995 | -1.738429162 | -0.342615928 | 2.838635512 | -0.038033328 | 2.621636473 | bad |
| 3.0 | -0.657195773 | -2.271626609 | 1.324873847 | -0.097874716 | 3.637970491 | -3.413761338 | 0.790723217 | good |
| 4.0 | 1.36421682 | -1.296611877 | -0.384658206 | -0.55300577 | 3.030874354 | -1.303849429 | 0.501984036 | good |
Files
2 فایل