TRUSTWORTHY AI
可信生成与模型评测
建立从数据、模型到应用的系统评测方法,让生成能力可解释、可衡量、可治理。
聚焦大模型可靠性、幻觉检测、对齐评测与红队测试,构建面向真实场景的可信生成基准。
研究背景
我们从真实问题出发,在基础方法、工程系统与实际场景之间建立可验证的研究闭环。每一项工作都保留清晰的问题定义、实验依据与迭代记录。
工作方法
项目采用跨学科协作机制,由研究人员、工程师与领域伙伴共同推进。阶段成果通过内部复核、开放讨论和场景测试持续校准,并沉淀为可复用的方法与工具。
OPEN RESEARCH
面向高校、实验室与产业研究团队开放联合研究与学术交流。