For the complete documentation index, see llms.txt. This page is also available as Markdown.

Qwen3-VL

이미지에서 Qwen3-VL을 실행합니다.

이 워크플로 블록은 이미지를 입력으로 받고 선택적 텍스트 프롬프트를 받아 대화 템플릿을 기반으로 텍스트 답변을 반환하는 Qwen3-VL-a 비전 언어 모델을 실행합니다.

유형 식별자

단계에서 다음 식별자를 사용하세요 "type" 필드: roboflow_core/qwen3vl@v1 워크플로에 블록을 단계로 추가하려면.

속성

이름

유형

설명

참조

이름

문자열

이 단계의 고유 식별자를 입력하세요..

프롬프트

문자열

Qwen3-VL에 추가 컨텍스트를 제공하는 선택적 텍스트 프롬프트입니다. 그렇지 않으면 기본값이 사용되며, 이는 원하는 모델 동작에 영향을 줄 수 있습니다..

모델 버전

문자열

추론에 사용할 Qwen3-VL 모델입니다..

시스템 프롬프트

문자열

Qwen3-VL에 추가 컨텍스트를 제공하는 선택적 시스템 프롬프트입니다..

참조 열은 다음에서 사용할 수 있는 동적 값으로 속성을 매개변수화할 수 있는 가능성을 나타냅니다 워크플로 런타임. 참조: 바인딩 자세한 정보는 참고하세요.

런타임 호환성

하드 - 런타임 self_hosted_cpu; 실행 로컬 : GPU가 필요합니다. run_locally()는 CUDA가 필요한 모델을 로드합니다.

입력 및 출력 바인딩

사용 가능한 연결은 바인딩 종류에 따라 달라집니다. 어떤 바인딩 종류가 Qwen3-VL 버전 v1 가 있습니다.

입력 및 출력 바인딩
  • 입력

    • 이미지들 (이미지): 추론할 이미지입니다..

    • 모델 버전 (roboflow_model_id): 추론에 사용할 Qwen3-VL 모델입니다..

  • 출력

JSON 정의 예시

마지막 업데이트

도움이 되었나요?