2026年9月18日
嘘を見分ける研究では、どのように正解を作るのか|Deceptive Opinion Spam
文章を読んで嘘かどうかを判定する研究には、大きな問題があります。現実の文章が本当か嘘かを、研究者が確認できるとは限らないことです。 Deceptive Opinion Spamの研究では、実在するホテルの真正レビューと、クラウドワーカーへ依頼して作った虚偽レビューを組み合わせ、真偽が分かる比較データを作りました。 実験で依頼されて書いた虚偽レビューと、利害関…
2026年9月18日
文章を読んで嘘かどうかを判定する研究には、大きな問題があります。現実の文章が本当か嘘かを、研究者が確認できるとは限らないことです。 Deceptive Opinion Spamの研究では、実在するホテルの真正レビューと、クラウドワーカーへ依頼して作った虚偽レビューを組み合わせ、真偽が分かる比較データを作りました。 実験で依頼されて書いた虚偽レビューと、利害関…
2026年9月18日
共感的な返答は、単に「大変でしたね」と言えば成立するものではありません。相手の状況を質問する、言葉を言い換えて確認する、感情を受け止める、情報を示す、行動を提案するなど、会話の段階に応じた方法があります。 ESConvは、悩みを話す人と支援する人の会話を収集し、支援側の発話へ応答方略を付けたデータセットです。 ESConvは研究用の感情支援対話です。医療診断…
2026年9月18日
「Okay」「Yeah」のような短い返事だけを読んでも、話者が納得しているのか、怒っているのか、諦めているのかは分かりません。直前の会話、声の調子、表情を見ることで、初めて感情を推測できることがあります。 MELDは、一つの文章だけでは判断しにくい会話中の感情を、テキスト、音声、映像とともに記録したデータセットです。 本記事は公開論文と公開データセットの紹介…
2026年9月18日
「マクドナルドへ行きたい」という発言だけを見ても、その理由は分かりません。しかし前の会話に、同じ料理が続いて飽きたという話があれば、発言の動機を推測できます。 CICEROは、発言単体ではなく会話全体を読み、背景にある原因や動機を記録した英語データセットです。 本記事は公開論文と公開データセットの紹介です。株式会社イングクラウドが当該研究へ関与したことを示す…
2026年9月18日
標準語のテストで高い性能を示すAIが、方言や地域変種でも同じように動くとは限りません。利用者の言葉を「誤った表現」として扱えば、特定地域だけサービス品質が低くなる可能性があります。 本記事は公開論文と公開ベンチマークの紹介です。「方言」「言語変種」「近縁言語」の区分は、言語学的・社会的背景によって異なります。 今回取り上げる論文 DIALECTBENCH:…
2026年9月18日
会話AIが返答内容を理解していても、話し始めるタイミングが早ければ人の発話を遮り、遅ければ不自然な沈黙になります。「うん」「なるほど」といった相づちも、内容だけでなくタイミングが重要です。 本記事は公開論文と公開データセットの紹介です。株式会社イングクラウドが当該研究へ関与したことを示すものではありません。 今回取り上げる論文 Predicting Turn…
2026年9月18日
同じ「はい」という返事でも、上司への返答と親しい友人への返答では、言葉遣いも距離感も異なります。会話から二人の関係を読み取るには、呼称、敬語、話題、上下関係などを組み合わせる必要があります。 本記事は公開論文とデータセットの紹介です。映画脚本は現実の会話そのものではなく、著作権と利用条件にも注意が必要です。 今回取り上げる論文 Are they lovers…
2026年9月18日
「コーヒーを作って」と指示されても、砂糖やミルクの好みが分からないことがあります。安全に関わる条件や、置かれた物の種類が不足している場合もあります。優れたAIは勝手に決めるだけでなく、必要なときに確認できなければなりません。 本記事は公開論文と公開データセットの紹介です。株式会社イングクラウドが当該研究へ関与したことを示すものではありません。 今回取り上げる…
2026年9月18日
「さすがですね」という文字だけでは、称賛なのか皮肉なのか分かりません。声の調子、表情、直前の失敗を知れば、意味が変わることがあります。 MUStARDは、文章だけでなく映像・音声・前後の会話を使って皮肉を判定するためのデータセットです。 本記事は公開論文とデータセットの紹介です。映像作品をデータ化する場合は、著作権と利用条件を別途確認する必要があります。 今…
2026年9月18日
文章の感情を「喜び・怒り・悲しみ」だけに分けると、安心、感謝、失望、困惑などの違いが消えてしまいます。GoEmotionsは、英語のRedditコメントを細かな感情へ分類したデータセットです。 本記事は公開論文と公開データセットの紹介です。投稿データを新たに収集する場合は、利用条件、個人情報、研究倫理を別途確認する必要があります。 今回取り上げる論文 GoE…
2026年9月18日
「悲しい」というラベルを当てることと、悲しんでいる相手へ適切に応答することは別の能力です。EmpatheticDialoguesは、相手の感情を認識し、それに配慮して返答する対話AIの研究用に作られました。 本記事は公開論文と公開データセットの紹介です。株式会社イングクラウドが当該研究へ関与したことを示すものではありません。 今回取り上げる論文 Toward…
2026年9月17日
文章を読んで「これは皮肉だ」と感じても、書いた本人には皮肉のつもりがなかったかもしれません。反対に、本人は皮肉として書いたのに、前後の事情を知らない第三者には普通の文章に見えることもあります。 今回紹介するiSarcasmは、皮肉かどうかを第三者へ判定させるのではなく、文章を書いた本人から意図を集めた英語データセットです。 皮肉検出の研究で使われるデータは、…