SynapseAI Intelligence
ニュースを検索
ホーム/研究/OpenAI、メンタルヘルス対話の評価基準「MentalHealthBench」を公開
研究
★★★★★
■中立2026-09-24

OpenAI、メンタルヘルス対話の評価基準「MentalHealthBench」を公開

OpenAIは9月23日、メンタルヘルスの会話でAIの応答を比べる公開テスト集「MentalHealthBench」を発表した。80人超の有資格専門家が関わったが、臨床現場での有効性を証明するものではない。

AI TL;DRAI生成 · 3行要約
  1. 0122か国の有資格専門家80人超と作成し、日常的な悩みから緊急性の高い状況までを含む合成会話を評価する。
  2. 02安全性、必要な情報を尋ねる力、本人の意思を尊重する姿勢などを見る評価用の基準で、AIを治療の代わりにするものではない。

OpenAIは9月23日、AIのメンタルヘルス関連応答を調べる「MentalHealthBench」を公開した。22か国の心理士や精神科医など、80人を超える有資格専門家と共同で作成したという。

評価対象は、日常のストレスや人間関係の相談から、緊急の支援が必要な会話まで幅広い。会話は合成データで、成人、10代、介護者、臨床家などの状況を含む。専門家が作った基準に照らし、安全性、状況を確かめる質問、本人の意思の尊重、適切な次の行動の提案などを評価する。

この仕組みは、危険な回答を避けたかだけでなく、会話の状況に応じた応答を比較するための研究用テスト集だ。実際の患者への治療効果を検証した臨床試験ではなく、OpenAIもChatGPTは治療や専門家のケアの代わりではないと明記している。

▲ 事実 (Fact)
  • OpenAIは2026年9月23日、MentalHealthBenchを公開した。
  • OpenAIによると、22か国の有資格心理士・精神科医など80人超が作成に参加し、19言語を話す専門家が含まれる。
  • 評価には合成会話が使われ、日常的な相談、高い緊急度の悩み、緊急事態などを扱う。
◆ 意見・解釈(AIによる)
  • 専門家の基準を共有できる点は、AIの応答を改善する手がかりになり得る。一方、ベンチマークの点数だけで個別の相談への適切さや臨床的な有効性まで判断することはできない。
⌖ 一次情報(必ず原典をご確認ください)
運営者
ゆうき

救急・集中治療の現場で働く現役看護師。AIの進化を毎日追いかけています。

COLUMN
運営者が書いたコラム
Google Home MCPって何? AIに家電を任せる前に調べて分かったこと

Google Home MCPを公式情報から調べ、AIと家電の接続でできること、対応機器、安全性について整理したコラム。

他のコラムを見る →
同じ日のニュース

今日の他のニュース

01
研究
9/24

Anthropic、Claude支援でCRISPRに似た酵素系を発見と発表。機能は未解明

同社によると、ClaudeのエージェントがバクテリオファージのDNAから、逆転写酵素と反復配列などを伴う「ART」を見つけた。

■中立
02
政策
9/24

OpenAI、ウクライナの民間インフラ防衛にAIサイバー支援を提供へ

ウクライナのデジタル変革省と連携し、認可された防御活動にAIツールを使えるようにする。

■中立
03
ツール
9/24

YouTube Music、会話型AIとポッドキャスト音声ガイドを発表

Ask Musicでは、会話を通じて再生キューを調整したり、アーティストについて詳しく調べたりできる。

■中立
04
ツール
9/24

Spotify、文章でおすすめを調整できる「Taste Profile」を米国で展開

音楽、ポッドキャスト、オーディオブックの好みの要約を確認し、増やしたい内容や減らしたい内容を伝えられる。

■中立
関連の流れ

同じカテゴリの記事

◀ 2026年9月23日のニュースを見る