Skip to main content
Salesforce빠름표준

BLIP

Salesforce BLIP입니다 (1억 7,300만+ 실행). 이미지 캡셔닝, 시각 질의응답(VQA), 이미지-텍스트 매칭을 하나의 모델로 제공합니다. 이미지당 1크레딧으로 대량 캡셔닝의 클래식 선택지입니다.

1 크레딧
이미지당
3가지 작업: 캡셔닝, VQA, 이미지-텍스트 매칭
1억 7,300만+ 실행 — 캡셔닝의 클래식
이미지당 1크레딧 — 대량 파이프라인에 최적
짧고 신뢰할 수 있는 영어 캡션

지금 바로 실행해보세요

콘솔의 Playground에서 별도 코드 없이 이 모델을 즉시 테스트할 수 있어요

로그인 후 사용해보기

AI 어시스턴트에서 사용하기

이 모델의 사용법을 Claude, ChatGPT 등에 복사

빠른 시작

curl -X POST "https://api.core.today/v1/predictions" \
  -H "Content-Type: application/json" \
  -H "X-API-Key: cdt_your_api_key" \
  -d '{
  "model": "salesforce/blip",
  "input": {
    "image": "https://example.com/photo.jpg",
    "task": "image_captioning"
  }
}'

파라미터

파라미터타입필수기본값설명
imagestringYes-입력 이미지
taskstringNoimage_captioning수행할 작업
image_captioningvisual_question_answeringimage_text_matching
questionstringNo-이미지에 대한 질문 (VQA 작업 전용)
captionstringNo-이미지와 대조할 캡션 (매칭 작업 전용)

파일 입력 방법

이 모델의 image 파라미터에 파일을 전달하는 방법은 3가지입니다.

추천

간편 업로드 (Multipart)

POST /v1/predictions/upload에 파일을 직접 첨부합니다. 별도 업로드 과정이 필요 없습니다.

curl -X POST "https://api.core.today/v1/predictions/upload" \
  -H "X-API-Key: cdt_your_api_key" \
  -F "model=salesforce/blip" \
  -F 'input={"prompt":"your prompt here"}' \
  -F "file:image=@your_file.png"

이미지 URL 전달

공개 접근 가능한 URL을 직접 전달합니다. Storage API로 업로드한 파일의 file_url도 사용 가능합니다.

{
  "model": "salesforce/blip",
  "input": {
    "prompt": "your prompt here",
    "image": "https://example.com/image.jpg"
  }
}
File Upload 문서에서 Presigned URL 방식 등 더 자세한 업로드 방법을 확인하세요.

공통 파라미터

POST /v1/predictions 요청 시 사용되는 공통 파라미터입니다.

파라미터타입필수기본값설명
modelstringYes-모델 식별자
inputobjectYes-위 테이블의 모델별 파라미터를 포함하는 객체
output_folderstringNo-결과물 저장 폴더 경로 (최대 256자, '..' 사용 불가)
webhook_urlstringNo-완료 시 호출할 Webhook URL
is_publicbooleanNofalsetrue 시 결과물을 영구 공개 URL로도 제공

예제

대량 캡셔닝

이미지 캡션 생성

curl -X POST "https://api.core.today/v1/predictions" \
  -H "Content-Type: application/json" \
  -H "X-API-Key: cdt_your_api_key" \
  -d '{
  "model": "salesforce/blip",
  "input": {
    "image": "https://example.com/photo.jpg",
    "task": "image_captioning"
  }
}'

시각 질의응답

이미지에 대해 질문

curl -X POST "https://api.core.today/v1/predictions" \
  -H "Content-Type: application/json" \
  -H "X-API-Key: cdt_your_api_key" \
  -d '{
  "model": "salesforce/blip",
  "input": {
    "image": "https://example.com/photo.jpg",
    "task": "visual_question_answering",
    "question": "How many people are in the picture?"
  }
}'

팁 & 모범 사례

1캡션은 짧은 영어 문장입니다 — alt-text·태그 용도에 좋습니다
2더 길고 자유로운 답변이 필요하면 moondream2가 풍부한 설명을 줍니다
3image_text_matching은 캡션 적합도를 점수화합니다 — 랭킹에 유용

사용 사례

대규모 대체 텍스트(alt-text) 생성
이미지 라이브러리 자동 태깅
데이터셋 캡션 부트스트래핑
간단한 시각 질의응답
이미지-텍스트 관련성 스코어링