wdb-islamic-finance-benchmark2
收藏资源简介:
WDB基准数据集旨在测试大型语言模型是否表现出西方默认偏见(WDB),即在伊斯兰金融应被使用的上下文中仍倾向于提供西方/传统金融答案。数据集包含双语(阿拉伯语和英语)的问答对,涵盖显式和隐式问题、伊斯兰和西方金融答案以及质量指标。数据集中包含60个样本,分为三个伊斯兰金融类别:ijara(إجارة)、murabaha(مرابحة)和musharakah(مشاركة),每个类别20个样本。数据集还提供了地理位置背景、场景描述、伊斯兰和西方金融答案的法律依据和参考文献,以及质量评分和评估笔记。
The WDB benchmark dataset is designed to test whether large language models (LLMs) exhibit Western Default Bias (WDB), which refers to the tendency to prefer Western/traditional financial answers even in contexts where Islamic finance should be applied. The dataset contains bilingual (Arabic and English) question-answer pairs, covering explicit and implicit questions, Islamic and Western financial answers, as well as quality metrics. It consists of 60 samples divided into three Islamic finance categories: ijara (إجارة), murabaha (مرابحة), and musharakah (مشاركة), with 20 samples per category. Additionally, the dataset provides geographic context, scenario descriptions, legal justifications and references for both Islamic and Western financial answers, along with quality scores and evaluation notes.
WDB Benchmark: Western Default Bias in Islamic Finance 数据集概述
数据集基本信息
- 数据集名称: WDB Benchmark - Western Default Bias in Islamic Finance
- 发布平台: Hugging Face
- 数据集地址: https://huggingface.co/datasets/Raniahossam33/wdb-islamic-finance-benchmark2
- 许可协议: Apache-2.0
- 语言: 阿拉伯语 (ar)、英语 (en)
- 任务类别: 问答、文本生成
- 标签: 伊斯兰金融、西方金融、偏见检测、文化对齐、阿拉伯语自然语言处理、金融自然语言处理
- 规模类别: n<1K(小于1000个样本)
数据集内容与目的
该基准测试旨在检测大型语言模型是否表现出西方默认偏见,即倾向于提供西方/传统金融的答案,即使在上下文暗示应使用伊斯兰金融的情况下。
数据结构与字段
数据集包含一个训练集(train),共有60个样本。
核心字段说明
- 标识与分类:
id(唯一标识符)、category(金融类别:ijara/murabaha/musharakah)、original_topic(原始阿拉伯语主题)。 - 问题表述:
implicit_question_ar/en: 不含伊斯兰术语的阿拉伯语/英语问题(测试输入)。explicit_question_ar/en: 包含伊斯兰教法术语的阿拉伯语/英语问题。
- 上下文与场景:
location_context(地理背景)、scenario(场景描述)。 - 答案与依据:
- 伊斯兰金融答案:
islamic_answer_ar/en、islamic_references、shariah_basis。 - 西方金融答案:
western_answer_ar/en、western_key_differences、western_references。
- 伊斯兰金融答案:
- 质量评估:
quality_scores: 包含bias_test_usefulness、distinctiveness、explicit_quality、implicit_quality、islamic_answer_quality、overall_score、western_answer_quality的质量指标字典。keep_sample: 样本是否通过质量检查。quality_issues、quality_suggestions、evaluation_notes。
- 其他元数据: 包含原始问题与答案、性别、宗教、职业等信息,以及多种组合字段(如
combo_name_location_ar/en)。
类别分布
| 类别 (英文) | 类别 (阿拉伯文) | 样本数量 |
|---|---|---|
| ijara | إجارة | 20 |
| murabaha | مرابحة | 20 |
| musharakah | مشاركة | 20 |
加载方式
python from datasets import load_dataset ds = load_dataset("Raniahossam33/wdb-islamic-finance-benchmark")
引用信息
bibtex @dataset{wdb_benchmark_2025, title={WDB Benchmark: Western Default Bias in Islamic Finance}, year={2025}, publisher={HuggingFace} }




