2026年10月7日
AIは有害な発言へどう返せばよい?――会話で介入を学ぶProsocialDialog
会話AIの安全性というと、危険な入力を拒否する仕組みが注目されます。しかし実際の会話には、偏見を含む冗談、無神経な相談、他人を傷つける提案など、禁止語だけでは判定しにくい発言があります。 ProsocialDialogは、問題を含む発言に対して、会話を断ち切るだけでなく、社会的に望ましい方向へ応答する方法を研究するための英語対話データセットです。 社会規範は…
2026年10月7日
会話AIの安全性というと、危険な入力を拒否する仕組みが注目されます。しかし実際の会話には、偏見を含む冗談、無神経な相談、他人を傷つける提案など、禁止語だけでは判定しにくい発言があります。 ProsocialDialogは、問題を含む発言に対して、会話を断ち切るだけでなく、社会的に望ましい方向へ応答する方法を研究するための英語対話データセットです。 社会規範は…