Skip to content

Repository files navigation

StruggleTab Benchmark

Environment

conda create --name sd python==3.12
conda activate sd
pip install pandas kagglehub[pandas-datasets] optuna

Steps to run

Install git LFS first if you don't have it:
https://gist.github.com/pourmand1376/bc48a407f781d6decae316a5cfa7d8ab

chmod +x acquisition.sh
./acquisition.sh
python handler.py moma # check if handler works

How to use inside a model pipeline:

sys.path.append(path_to_struggletab_codebase)
from handler import UnifiedDataLoader; from eval import evaluate
train_df = loader.get_train_data()

synthetic_data_frame = your_full_model_pipeline() # run your model training/sampling code

result = evaluate(dataset_name,  synthetic_data_frame)

Attributions

About

No description, website, or topics provided.

Resources

Stars

0 stars

Watchers

0 watching

Forks

Releases

Packages

Contributors

Languages