diff --git a/pkgs/development/python-modules/lm-eval/default.nix b/pkgs/development/python-modules/lm-eval/default.nix index 3bbaae0ce9e6..c1befc184c8d 100644 --- a/pkgs/development/python-modules/lm-eval/default.nix +++ b/pkgs/development/python-modules/lm-eval/default.nix @@ -4,59 +4,47 @@ fetchFromGitHub, # build-system - setuptools-scm, + setuptools, # dependencies accelerate, datasets, dill, evaluate, + jinja2, jsonlines, more-itertools, - numexpr, peft, - pybind11, pytablewriter, rouge-score, sacrebleu, scikit-learn, sqlitedict, torch, - tqdm-multiprocess, transformers, + typing-extensions, word2number, zstandard, # optional-dependencies - # api aiohttp, + hf-transfer, + immutabledict, + langdetect, + librosa, + nltk, + numpy, + optimum, + pandas, + pymorphy2, requests, + sentencepiece, + soundfile, + statsmodels, tenacity, tiktoken, tqdm, - # dscrim_eval - statsmodels, - # hf_transfer - hf-transfer, - # ifeval - immutabledict, - langdetect, - nltk, - # neuronx - optimum, - # mamba - causal-conv1d, - mamba-ssm, - # math - antlr4-python3-runtime, - sympy, - # sentencepiece - sentencepiece, - # vllm vllm, - # wandb - numpy, - pandas, wandb, # tests @@ -66,38 +54,33 @@ buildPythonPackage (finalAttrs: { pname = "lm-eval"; - version = "0.4.9.2"; + version = "0.4.10"; pyproject = true; src = fetchFromGitHub { owner = "EleutherAI"; repo = "lm-evaluation-harness"; tag = "v${finalAttrs.version}"; - hash = "sha256-Foz49XfIIzGJkgzjBu9P1J9cwYjl3fjAAJG9GKRwfq8="; + hash = "sha256-+fVLpJ/wzFyQJkdlHTirTNrtWg7Vn26kU0OV4+oDJXA="; }; build-system = [ - setuptools-scm + setuptools ]; dependencies = [ - accelerate datasets dill evaluate + jinja2 jsonlines more-itertools - numexpr - peft - pybind11 pytablewriter rouge-score sacrebleu scikit-learn sqlitedict - torch - tqdm-multiprocess - transformers + typing-extensions word2number zstandard ]; @@ -110,21 +93,25 @@ buildPythonPackage (finalAttrs: { tiktoken tqdm ]; + audiolm_qwen = [ + librosa + soundfile + ]; discrim_eval = [ statsmodels ]; + hf = [ + accelerate + peft + torch + transformers + ]; hf_transfer = [ hf-transfer ]; ifeval = [ immutabledict langdetect nltk ]; - neuronx = [ optimum ] ++ optimum.optional-dependencies.neuronx; - mamba = [ - causal-conv1d - mamba-ssm - ]; - math = [ - antlr4-python3-runtime - sympy + libra = [ + pymorphy2 ]; optimum = [ optimum ] ++ optimum.optional-dependencies.openvino; sentencepiece = [ sentencepiece ]; @@ -134,9 +121,23 @@ buildPythonPackage (finalAttrs: { pandas wandb ]; - # Still missing dependencies for the following: - # deepsparse, gptq, ibm_watsonx_ai, multilingual, promptsource, sparseml, - # zeno, gptqmodel, japanese_leaderboard; all = [...]; + # Still missing dependencies for the following optional dependency groups: + # - acpbench + # - deepsparse + # - gptq + # - gptqmodel + # - ibm_watsonx_ai + # - ipex + # - japanese_leaderboard + # - longbench + # - math + # - multilingual + # - ruler + # - sae_lens + # - sparsify + # - tasks + # - unitxt + # - zeno }; pythonRelaxDeps = [ "datasets" ]; @@ -145,9 +146,11 @@ buildPythonPackage (finalAttrs: { nativeCheckInputs = [ pytestCheckHook + sentencepiece writableTmpDirAsHomeHook ] - ++ finalAttrs.passthru.optional-dependencies.api; + ++ finalAttrs.passthru.optional-dependencies.api + ++ finalAttrs.passthru.optional-dependencies.hf; disabledTests = [ "test_deepsparse" # deepsparse is not available