arXiv:2506.18199cs.CLcs.AI2025-06综述被引 5

用提示工程减轻大模型对阿拉伯人和穆斯林的文化偏见,效果因方法而异。

Prompt Engineering Techniques for Mitigating Cultural Bias Against Arabs and Muslims in Large Language Models: A Systematic Review

  • 提出五类提示工程技术,包括文化提示和多步结构化流程
  • 多步流程可降低87.7%偏见,但需更高技术能力
  • 适合关注伦理、公平性及模型安全性的研究人员

大语言模型在多个领域表现卓越,但对阿拉伯人和穆斯林的文化偏见带来重大伦理挑战,加剧刻板印象与边缘化。尽管模型偏见日益受到关注,针对阿拉伯与穆斯林群体的提示工程策略仍研究不足。本混合方法系统综述基于PRISMA指南与Kitchenham方法,分析2021-2024年间8项实证研究,揭示五类提示工程方法:文化提示、情感引导、自去偏技术、结构化多步流程及参数优化的连续提示。所有方法均显示降低偏见潜力,但效果差异显著,部分偏见类型更难通过提示缓解。结构化多步流程整体效果最佳,偏见减少最高达87.7%,但需更高技术能力;文化提示则更具普适性且效果显著。结果表明,无需访问模型参数即可通过提示工程缓解文化偏见。研究数量有限凸显该领域重要空白。未来应发展文化适应性提示、构建阿拉伯与穆斯林专用评估资源,并结合其他去偏方法以应对深层刻板印象,同时保持模型可用性。

原文摘要 · Abstract (English)

Large language models have demonstrated remarkable capabilities across various domains, yet concerns about cultural bias - particularly towards Arabs and Muslims - pose significant ethical challenges by perpetuating harmful stereotypes and marginalization. Despite growing recognition of bias in LLMs, prompt engineering strategies specifically addressing Arab and Muslim representation remain understudied. This mixed-methods systematic review examines such techniques, offering evidence-based guidance for researchers and practitioners. Following PRISMA guidelines and Kitchenham's systematic review methodology, we analyzed 8 empirical studies published between 2021-2024 investigating bias mitigation strategies. Our findings reveal five primary prompt engineering approaches: cultural prompting, affective priming, self-debiasing techniques, structured multi-step pipelines, and parameter-optimized continuous prompts. Although all approaches show potential for reducing bias, effectiveness varied substantially across studies and bias types. Evidence suggests that certain bias types may be more resistant to prompt-based mitigation than others. Structured multi-step pipelines demonstrated the highest overall effectiveness, achieving up to 87.7% reduction in bias, though they require greater technical expertise. Cultural prompting offers broader accessibility with substantial effectiveness. These results underscore the accessibility of prompt engineering for mitigating cultural bias without requiring access to model parameters. The limited number of studies identified highlights a significant research gap in this critical area. Future research should focus on developing culturally adaptive prompting techniques, creating Arab and Muslim-specific evaluation resources, and integrating prompt engineering with complementary debiasing methods to address deeper stereotypes while maintaining model utility.

提示工程文化偏见伦理安全LLM

Thank you to arXiv for use of its open access interoperability. PaperDance 不是 arXiv 官方产品;中文卡片由大模型生成,请以原文为准。