Reasoning Collab Memory Eval

Evaluates LLM logical and spatial reasoning capabilities under multi-agent collaboration and memory-augmented prompting. It probes how different reasoning styles, exemplar retrieval methods, and answer aggregation strategies impact accuracy on formal logic and object-tracking tasks. Use when the user wants to benchmark on FOLIO, RACO, TSO, or asks about evaluating this task. Reports accuracy.

qhjqhj00 1fdd7b1 3.1 KB Updated 3 repo stars

File contents

qhjqhj00/research-skills-pool/tree/main/skill-factory/output/reasoning-collab-memory-eval commit 1fdd7b1a3e

Frequently asked questions

npx skillmds add qhjqhj00/reasoning-collab-memory-eval