opendatalab/ProverQA
收藏官方服务:
资源简介:
该数据集用于评估大语言模型在逻辑推理方面的性能,适用于包含大于1K小于10K大小的数据集。它是根据论文《Large Language Models Meet Symbolic Provers for Logical Reasoning Evaluation》所述目的而构建的。
This dataset is used for evaluating the performance of large language models in logical reasoning, suitable for datasets with sizes between 1K and 10K. It is constructed for the purpose described in the paper Large Language Models Meet Symbolic Provers for Logical Reasoning Evaluation.
提供机构:
opendatalab


