본문 바로가기
release

첫 시각언어 모델 DeepSeek-VL 공개

(2년 전)

이미지와 텍스트를 함께 이해하는 첫 멀티모달 모델군 DeepSeek-VL 공개.

관련 항목

상세 내용

1.3B·7B 크기의 기반 모델과 대화형 모델로 구성. 자연 이미지·웹페이지·도표·수식·과학 문헌·시각적 위치 지정 작업 처리. 텍스트와 코드 중심 연구를 실제 세계의 시각 정보로 확장한 계기.

관련 링크