AI 관련 사고는 급증하는 가운데, RAI 평가와 대응은 미흡한 상황
2023년
2024년
전년 대비 +56.4% 증가
사상 최고치 기록
HELM Safety
다양한 안전성 영역별 모델 평가
AIR-Bench
AI 시스템 위험 평가 벤치마크
FACTS
사실성 및 진실성 평가 도구
SimpleQA
정보 정확성 평가 프레임워크
표준화된 RAI 평가 부족, 단일화된 기준 필요
주요 파운데이션 모델 개발사의 투명성 점수 향상
AI 학습에 사용되는 공개 웹 데이터 접근이 점점 제한되는 추세
데이터 다양성, 모델 정렬에 영향
명시적 편향 감소 노력에도 불구하고, 최신 LLM에서도 인종/성별 편향 발견
GPT-4 등 주요 모델에서 확인
2023년 RAI 논문
2024년 RAI 논문
주요 AI 학회에서 채택된 책임감 있는 AI 관련 논문 수 꾸준히 증가