순서가 있습니다. 포털 넷(연구방·지식센터·커뮤니티·아카데미)을 먼저 담고,
SSRA 는 맨 나중에 담아 주세요. SSRA 를 먼저 담으면 나머지가 그 안에 포함된 것으로
잡혀 따로 담기지 않습니다. 아이콘도 담을 차례대로 놓았습니다 — 왼쪽부터 차례로 누르시면 됩니다.
Foundation Models Defining a New Era in Vision: A Survey and Outlook
Muhammad Awais, Muzammal Naseer, Salman Khan 외 · IEEE Transactions on Pattern Analysis and Machine Intelligence · 2025년 · 조회 15
왜 이 논문인가 — 선정 기준
HOT PAPER · 최근 가장 주목받는 논문 — 피인용·FWCI·동년 인용 백분위
2025-01 발표 · 피인용 267회 · 분야 내 인용 영향력 상위권 · 동년 인용 상위 1%
HOT PAPER 슬롯에 선정된 이유는 2025년 발표 논문 중 인용 267회로 인용 영향력이 매우 높고, 동년 논문 상위 1%에 속하기 때문이다.
논문 요약
본 논문은 시각 시스템이 객체와 위치 간 복합 관계, 현실 세계의 모호성·변동성을 언어와 같은 다중 모달리티로 기술하는 필요성을 강조한다. 대규모 학습 데이터와 다중 모달리티를 연결하는 Foundation 모델을 제안하고, 이를 통해 상황적 추론·일반화·프롬프트 기반 조작이 가능함을 보였다. 모델 출력은 재학습 없이 인간이 제공하는 프롬프트(예: 바운딩 박스 지정, 이미지·비디오에 대한 질의, 로봇 행동 제어)로 수정될 수 있다.
후속 연구설계에 활용하기
다중 모달 프롬프트 설계와 평가를 위한 변수·척도로 본 논문의 모델 구조와 인터랙션 방식을 활용해 후속 실험을 설계할 수 있다.
핵심어
Foundation 모델비전멀티모달프롬프트
실존 확인
이 논문은 OpenAlex에서 후보로 수집한 뒤, Crossref에 등록된 DOI와 제목 일치를 확인해 노출합니다.
SSRA가 문헌연구에서 인용 논문의 실재 여부를 검증하는 원칙과 같습니다.