Jjkim0807 Code Eval

Compute jjkim0807/code_eval via the HuggingFace `evaluate` library. Use when the user has predictions + references and wants the canonical implementation of jjkim0807/code_eval.

qhjqhj00 6a456c6 830 B Updated 3 repo stars

File contents

jjkim0807-code-eval

Metric jjkim0807/code_eval from the HuggingFace evaluate library.

When to invoke

User asks to compute jjkim0807/code_eval or wants HF evaluate's canonical version.

Recipe

import evaluate
metric = evaluate.load("jjkim0807/code_eval")
result = metric.compute(predictions=preds, references=refs)
print(result)

Don'ts

  • Don't assume your in-house jjkim0807/code_eval matches HF — version conventions vary.
  • Many evaluate metrics have task-specific arguments (average=, lang=, model_type=); read the metric card before reporting numbers.

qhjqhj00/research-skills-pool/tree/main/skill-factory/output/jjkim0807-code-eval commit 6a456c6480

Frequently asked questions

npx skillmds add qhjqhj00/jjkim0807-code-eval