nebjj/Bias-Mitigation-Machine-Unlearning-of-LLMs-using-Multi-Agents
GitHub: nebjj/Bias-Mitigation-Machine-Unlearning-of-LLMs-using-Multi-Agents
基于多智能体架构的 LLM 偏见缓解与机器遗忘管线,通过微调、受控生成和公平性评估实现模型层面的偏见治理与敏感数据移除。
Stars: 0 | Forks: 0
# 使用多智能体的 LLM 偏见缓解机器遗忘
构建了一个用于偏见检测和缓解的多智能体 LLM pipeline。使用 Hugging Face 微调了 transformer 模型。设计了基于公平性指标的评估框架。实现了用于移除敏感数据的机器遗忘技术。使用了 prompt 工程 + 受控生成策略。
标签:DLL 劫持, Hugging Face, 人工智能, 偏见检测与缓解, 多智能体, 大语言模型, 机器遗忘, 模型微调, 用户模式Hook绕过, 逆向工具