Scale AI 最新论文
Lin等人揭示针对LLM的微妙同义词替换攻击,通过在提示中替换词汇可使LLM提及目标概念频率增加高达78%,且人类难以察觉。
https://hci.top/zh/institutions/Scale%20AI?source=all