简体中文
外观
170 字小于 1 分钟
domain/aiai/papers
2026-07-24
RLHF 论文:基于人类反馈的强化学习 Red Teaming:AI 模型的红队测试方法 AI 对齐研究:确保 AI 与人类意图对齐的研究