프로젝트 정보
LAVIS / BLIP
시각 언어 기초 모델 및 원스톱 라이브러리, 글로벌 이미지-텍스트 AI의 초석 중 하나
- 기관
- Salesforce AI Research Singapore
- 분류
- 국제 기업 연구소
- 카테고리
- 시각 언어 기초 모델
- 상태
- 클래식 오픈소스 자산
- 시작
- 2022-08
- 언어 / 형태
- Python / Jupyter Notebook
- 라이선스
- BSD-3-Clause
- GitHub Stars
- 11,250
- 정보 업데이트
- 2026-05-04
LAVIS / BLIP는 Salesforce 싱가포르 연구 팀의 글로벌 시각 언어 AI에 대한 중요한 기여입니다. 이들은 이미지-텍스트 이해, 이미지 캡셔닝, 시각 질문 답변, 멀티모달 사전 학습을 더욱 재사용 가능한 오픈소스 형태로 만들었습니다.
무엇인가
LAVIS는 Library for Language-Vision Intelligence의 약자이며, 통합된 시각 언어 연구 및 애플리케이션 라이브러리입니다. BLIP와 BLIP-2는 그 중 가장 영향력 있는 모델 시리즈입니다.
개발자는 이를 사용하여 사전 학습된 모델을 로드하고 이미지 캡셔닝, 시각 질문 답변, 이미지-텍스트 검색, 멀티모달 정렬 등의 작업을 수행할 수 있습니다.
AI와의 관계
BLIP 시리즈는 멀티모달 AI의 기초 구성 요소 중 하나입니다. 오늘날 많은 시각 언어 모델, 데이터 생성 프로세스, 이미지-텍스트 정렬 연구가 직간접적으로 이것의 영향을 받고 있습니다.
이것의 가치는 논문 인용이 많을 뿐만 아니라 재사용 가능한 코드와 모델을 형성하여 후속 연구의 진입 장벽을 낮추었다는 점입니다.
싱가포르와의 관계
Salesforce 싱가포르 랩은 국제 기업이 싱가포르에 연구 팀을 설립하는 것이 판매나 지역 사무소에 그치지 않고 글로벌 수준의 기초 연구를 산출할 수 있음을 보여줍니다.
이러한 유형의 프로젝트는 싱가포르 AI 생태계에서 매우 중요하지만 과소평가되기 쉬운 한 계층입니다. 다국적 기업 랩이 현지 인재, 글로벌 연구 네트워크, 오픈소스 영향력을 연결합니다.
주요 마일스톤
- 2022BLIP 논문은 ICML 2022에 발표되었습니다
- 2023BLIP-2 논문은 ICML 2023에 발표되었습니다