{"package":"lm_eval","ecosystem":"pypi","latest_version":"0.4.12","description":"A framework for evaluating language models","license":"MIT","license_risk":"permissive","commercial_use_notes":"Permissive: commercial closed-source use OK; preserve the copyright notice.","homepage":"https://pypi.org/project/lm-eval/","repository":"https://github.com/EleutherAI/lm-evaluation-harness","downloads_weekly":0,"health":{"score":67,"risk":"moderate","breakdown":{"maintenance":25,"popularity":0,"security":25,"maturity":9,"community":8},"deprecated":false,"max_score":100},"vulnerabilities":{"count":0,"critical":0,"high":0,"medium":0,"low":0,"details":[]},"versions":{"latest":"0.4.12","total_count":18,"recent":["0.0.1","0.2.0","0.3.0","0.4.0","0.4.1","0.4.2","0.4.3","0.4.4","0.4.5","0.4.7","0.4.8","0.4.9","0.4.9.1","0.4.9.2","0.4.10","0.4.11","0.4.12","0.5.0.dev1"]},"metadata":{"deprecated":false,"deprecated_message":null,"maintainers_count":0,"first_published":null,"last_published":"2026-05-11T13:05:48.902288Z","dependencies_count":91,"dependencies":["datasets>=2.16.0","numpy","evaluate>=0.4.0","jinja2","pytablewriter","rouge-score>=0.0.4","sacrebleu>=1.5.0","scikit-learn>=0.24.1","sqlitedict","dill","word2number","more_itertools","typing_extensions","tqdm>=4.59.0","requests; extra == \"api\"","aiohttp; extra == \"api\"","tenacity; extra == \"api\"","tqdm; extra == \"api\"","tiktoken; extra == \"api\"","jsonlines; extra == \"archiver\"","zstandard; extra == \"archiver\"","transformers>=4.1; extra == \"hf\"","torch>=1.8; extra == \"hf\"","accelerate>=0.26.0; extra == \"hf\"","peft>=0.2.0; extra == \"hf\"","vllm>=0.18; extra == \"vllm\"","auto-gptq[triton]>=0.6.0; extra == \"gptq\"","gptqmodel>=1.0.9; extra == \"gptqmodel\"","optimum-intel; extra == \"ipex\"","ibm_watsonx_ai>=1.1.22; extra == \"ibm-watsonx-ai\"","python-dotenv; extra == \"ibm-watsonx-ai\"","litellm<1.85,>=1.60; extra == \"litellm\"","aiohttp; extra == \"litellm\"","requests; extra == \"litellm\"","tenacity; extra == \"litellm\"","tqdm; extra == \"litellm\"","optimum[openvino]; extra == \"optimum\"","optimum-habana; extra == \"habana\"","sparsify; extra == \"sparsify\"","lark>=1.1.9; extra == \"acpbench\"","tarski[clingo]==0.8.2; extra == \"acpbench\"","pddl==0.4.2; extra == \"acpbench\"","kstar-planner==1.4.2; extra == \"acpbench\"","librosa; extra == \"audiolm-qwen\"","soundfile; extra == \"audiolm-qwen\"","pytest>=9.0; extra == \"dev\"","pytest-cov; extra == \"dev\"","pytest-xdist; extra == \"dev\"","requests; extra == \"dev\"","aiohttp; extra == \"dev\"","tenacity; extra == \"dev\"","tqdm; extra == \"dev\"","tiktoken; extra == \"dev\"","sentencepiece; extra == \"dev\"","langdetect; extra == \"ifeval\"","immutabledict; extra == \"ifeval\"","nltk>=3.9.1; extra == \"ifeval\"","emoji==2.14.0; extra == \"japanese-leaderboard\"","neologdn==0.5.3; extra == \"japanese-leaderboard\"","fugashi[unidic-lite]; extra == \"japanese-leaderboard\"","rouge_score>=0.1.2; extra == \"japanese-leaderboard\"","jieba; extra == \"longbench\"","fuzzywuzzy; extra == \"longbench\"","rouge; extra == \"longbench\"","pymorphy2; extra == \"libra\"","sympy>=1.12; extra == \"math\"","antlr4-python3-runtime==4.11; extra == \"math\"","math_verify[antlr4_11_0]; extra == \"math\"","nagisa>=0.2.7; extra == \"multilingual\"","jieba>=0.42.1; extra == \"multilingual\"","pycountry; extra == \"multilingual\"","nltk; extra == \"ruler\"","wonderwords; extra == \"ruler\"","scipy; extra == \"ruler\"","sentencepiece>=0.1.98; extra == \"sentencepiece\"","statsmodels==0.14.4; extra == \"discrim-eval\"","unitxt==1.22.0; extra == \"unitxt\"","trackio>=0.23.0; extra == \"trackio\"","wandb>=0.16.3; extra == \"wandb\"","pandas; extra == \"wandb\"","numpy; extra == \"wandb\"","pandas; extra == \"zeno\"","zeno-client; extra == \"zeno\"","lm_eval[discrim_eval]; extra == \"tasks\"","lm_eval[ifeval]; extra == \"tasks\"","lm_eval[japanese_leaderboard]; extra == \"tasks\"","lm_eval[longbench]; extra == \"tasks\"","lm_eval[libra]; extra == \"tasks\"","lm_eval[math]; extra == \"tasks\"","lm_eval[multilingual]; extra == \"tasks\"","lm_eval[ruler]; extra == \"tasks\""]},"github_stats":{"stars":13585,"forks":3472,"open_issues":925,"is_archived":false,"pushed_at":"2026-08-10T11:31:31Z","subscribers_count":51},"bundle":null,"typescript":null,"known_issues":{"bugs_count":0,"bugs_severity":{},"status_breakdown":{},"link":null,"scope":"none"},"historical_compromise":null,"recommendation":{"action":"use_with_caution","issues":["Moderate health score (67/100) — verify manually"],"use_version":"0.4.12","version_hint":null,"summary":"lm_eval@0.4.12 low health (67/100) — consider alternatives"},"version_scoped":null,"_meta":{"endpoint":"check","tier":"full","philosophy":"DepScope is free. Use the cheapest endpoint that answers your real question.","cheaper_alternatives":[{"endpoint":"/api/exists/pypi/lm_eval","tokens_estimated":12,"use_when":"you only need to know if the package exists (hallucination guard)"},{"endpoint":"/api/health/pypi/lm_eval","tokens_estimated":80,"use_when":"you only need a 0-100 score for go/no-go (>=70 = safe)"},{"endpoint":"/api/prompt/pypi/lm_eval","tokens_estimated":280,"use_when":"you want a plain-text LLM-friendly brief instead of JSON"},{"endpoint":"POST /api/check_bulk","tokens_estimated":60,"use_when":"you have 5+ packages to check; sends one round-trip instead of N"}],"docs":"https://depscope.dev/integrate","hint_bulk":"You've called /api/check 59 times in 60s. Save bandwidth + tokens with POST /api/check_bulk (1 round-trip for N pkgs)."},"requested_version":null,"_cache":"hit","_response_ms":0,"_powered_by":"depscope.dev — free package intelligence for AI agents","typosquat":{"is_suspected":false},"maintainer_trust":{"available":false},"malicious":{"is_malicious":false},"scorecard":{"available":false},"quality":{"available":false},"version_history_summary":{"total_versions":18,"first_release_age_days":1803,"last_release_days_ago":91,"avg_days_between_releases":106,"release_velocity":"moderate"}}