이미지에서 SmolVLM2를 실행합니다.
이 워크플로 블록은 멀티모달 비전-언어 모델인 SmolVLM2를 실행합니다. 문서와 사진을 포함한 이미지에 대해 질문하고 자연어로 답변을 받을 수 있습니다.
단계에서 다음 식별자를 사용하세요 "type" 필드: roboflow_core/smolvlm2@v1 워크플로우에 이 블록을 단계로 추가하려면.
"type"
roboflow_core/smolvlm2@v1
이름
유형
설명
참조
name
str
이 단계에 대한 고유 식별자를 입력하세요..
❌
prompt
SmolVLM2에 추가 컨텍스트를 제공하는 선택적 텍스트 프롬프트입니다. 그렇지 않으면 None이 됩니다.
model_version
추론에 사용할 SmolVLM2 모델입니다..
✅
이 참조 열은 워크플로우 런타임에서 사용 가능한 동적 값으로 속성을 매개변수화할 수 있는 가능성을 나타냅니다 워크플로우 런타임입니다. 자세한 내용은 바인딩 을 참조하세요.
워크플로우
하드 - 런타임 self_hosted_cpu; 실행 로컬 : GPU가 필요합니다; run_locally()는 CUDA가 필요한 모델을 로드합니다.
하드
self_hosted_cpu
로컬
사용 가능한 연결은 바인딩 유형에 따라 달라집니다. 어떤 바인딩 유형인지 확인하세요 SmolVLM2 버전 v1 을 가지고 있는지.
SmolVLM2
v1
입력
이미지 (이미지): 추론할 이미지입니다..
이미지
model_version (roboflow_model_id): 추론에 사용할 SmolVLM2 모델입니다..
roboflow_model_id
출력
파싱된 출력 (딕셔너리): 딕셔너리.
파싱된 출력
딕셔너리
마지막 업데이트 4일 전
도움이 되었나요?
{ "name": "<your_step_name_here>", "type": "roboflow_core/smolvlm2@v1", "images": "$inputs.image", "prompt": "이 이미지에는 무엇이 있나요?", "model_version": "smolvlm2/smolvlm-2.2b-instruct" }