dataset_path: oscarqjh/MindCube_lmmseval

generation_kwargs:
  max_new_tokens: 4096
  temperature: 0.0
  top_p: 1.0
  do_sample: false
  repetition_penalty: 1.0

output_type: generate_until
doc_to_visual: !function utils.mindcube_doc_to_visual
doc_to_text: !function utils.mindcube_doc_to_text
doc_to_messages: !function utils.mindcube_doc_to_messages
doc_to_target: "grounded_output"
process_results: !function utils.mindcube_process_results

lmms_eval_specific_kwargs:
  neo_ov:
    pre_prompt: ""
    post_prompt: ""
    prompt_format: neo_ov

model_specific_generation_kwargs:
  neo_ov:
    patch_size: 16
    min_pixels: 691200
    max_pixels: 691200
    downsample_ratio: 0.5
    system_prompt: ""
    temperature: null
    top_p: null
    repetition_penalty: null

metric_list:
  - metric: overall_accuracy
    aggregation: !function utils.mindcube_aggregate_results
    higher_is_better: true
  - metric: rotation_accuracy
    aggregation: !function utils.mindcube_aggregate_rotation_results
    higher_is_better: true
  - metric: among_accuracy
    aggregation: !function utils.mindcube_aggregate_among_results
    higher_is_better: true
  - metric: around_accuracy
    aggregation: !function utils.mindcube_aggregate_around_results
    higher_is_better: true
