OpenAI, 정신건강 AI 벤치마크 공개

핵심 요약

OpenAI가 실제 정신건강 대화에서 AI 답변의 유용성과 안전성을 평가하는 MentalHealthBench를 공개했다.

OpenAI, 정신건강 AI 벤치마크 공개 — 기사 주제를 표현한 AI 생성 개념 삽화
AI 생성 개념 삽화 · 실제 사건을 촬영한 사진이 아닙니다.

OpenAI는 9월 23일 현실적인 정신건강 대화에서 인공지능(AI)의 답변이 얼마나 유용하고 안전한지 평가하는 벤치마크 ‘MentalHealthBench’를 공개했다.1

OpenAI 공식 발표에 따르면 MentalHealthBench는 전문가 의견을 반영해 설계됐다. 정신건강과 관련된 실제적인 대화 상황을 바탕으로 AI 답변의 유용성과 안전성을 함께 살피는 평가 도구다. 다만 이번 자료에는 평가 항목과 데이터 구성, 참여 전문가, 적용 모델, 구체적인 성능 결과는 제시되지 않았다.

Footnotes

  1. OpenAI 공식 뉴스, 「Introducing MentalHealthBench」 ↩

반응 확인 중

읽기 목록은 이 브라우저에 저장됩니다.

출처

  1. Introducing MentalHealthBench — OpenAI 공식 뉴스 · 자료: 2026. 9. 23.

이 글은 위 출처를 근거로 자동 생성된 뒤 발행됐습니다. 원문을 함께 확인해 주세요. 교차 보도 없이 단독 출처로 작성됐습니다.