pimadiabetes: Pima diabetes data

pimadiabetesR Documentation

Pima diabetes data

Description

A diabetes classification dataset with clinical measurements and a predefined train/test split column.

Usage

pimadiabetes

Format

A data frame with 532 rows and 9 variables:

npreg

Number of pregnancies.

glu

Plasma glucose concentration.

bp

Diastolic blood pressure.

skin

Triceps skin fold thickness.

bmi

Body mass index.

ped

Diabetes pedigree function.

age

Age in years.

diabetes

Diabetes outcome ("Yes" or "No").

split

Suggested split indicator ("train" or "test").

Source

National Institute of Diabetes and Digestive and Kidney Diseases Pima Indians Diabetes Database.

References

Smith JW, Everhart JE, Dickson WC, Knowler WC, Johannes RS (1988). Using the ADAP learning algorithm to forecast the onset of diabetes mellitus. In Proceedings of the Annual Symposium on Computer Application in Medical Care, 261-265.

Examples

str(funcml::pimadiabetes)
table(funcml::pimadiabetes$split)

funcml documentation built on Aug. 22, 2026, 5:08 p.m.