국가R&D로 수행 중인(또는 수행된) 연구과제 정보입니다.
■ 과제 개요
· 과제명: 사회기술적 정렬을 위한 대규모 언어모델의 사용자 프로필 기반 기만적 설득 위험 시뮬레이션 및 안전성 평가 연구
· 예산사업명: 이공학학술연구기반구축
· 기준년도: 2026년
· 총 연구기간: 2026-09-01 ~ 2028-08-31
· 당해연도 연구기간: 2026-09-01 ~ 2027-02-28
· 수집 분야: 교육, 심리
■ 수행 주체
· 과제수행기관: 한양대학교
· 연구책임자: 여해인
· 부처명: 교육부
■ 연구비 (당해년도)
· 정부투자연구비: 12,500,000원
■ 한글키워드
· AI 안전성, 기만적 설득, 인간-AI 상호작용, 사회기술적 정렬
■ 영문키워드
· AI Safety, Deceptive Persuasion, Human-AI Interaction, Socio-technical Alignment
■ 연구내용
본 연구개발과제는 대규모 언어모델(LLM)의 장기적·적응적 기만적 설득 위험을 체계적으로 탐지·평가하기 위해, 사회인지 이론 기반의 사용자 프로필과 다중 턴 상호작용 시뮬레이션을 결합한 통합 프레임워크(TRUST)를 구축하는 것을 핵심 내용으로 한다.우선, 건강, …
■ 원문 확인
· 과제고유번호: 2340065387
· NTIS 과제상세페이지:
https://www.ntis.go.kr/project/pjtInfo.do?pjtId=2340065387
(NTIS 로그인 후 조회할 수 있습니다)
※ 출처: 국가과학기술지식정보서비스(NTIS) — 공공저작물 제1유형(출처표시)
위에 없는 상세 정보는 NTIS 과제상세페이지에서 확인해 주세요.
댓글 0