dataset_path: nguha/legalbench
output_type: generate_until
test_split: test
fewshot_split: train
target_delimiter: " "
doc_to_target: "{{answer}}"
generation_kwargs:
  until:
    - "\n"
  do_sample: false
  temperature: 0.0
  max_gen_toks: 15
filter_list:
  - name: "get-answer"
    filter:
      - function: "remove_whitespace"
      - function: "take_first"
metric_list:
  - metric: exact_match
    aggregation: mean
    higher_is_better: true
    ignore_case: true
    ignore_punctuation: true
metadata:
  version: 1.0
