For the complete documentation index, see llms.txt. This page is also available as Markdown.

Qwen2.5-VL

이미지에서 Qwen2.5-VL을 실행합니다.

이 워크플로 블록은 이미지와 선택적 텍스트 프롬프트를 입력받아 대화 템플릿을 기반으로 텍스트 답변을 반환하는 Qwen2.5-VL-a 비전-언어 모델을 실행합니다.

유형 식별자

step에서 다음 식별자를 사용하세요 "type" 필드: roboflow_core/qwen25vl@v1 를 워크플로에 단계로 추가합니다.

속성

이름

유형

설명

참조

name

str

이 단계에 고유 식별자를 입력하세요..

프롬프트

str

Qwen2.5-VL에 추가 컨텍스트를 제공하기 위한 선택적 텍스트 프롬프트입니다. 그렇지 않으면 기본값이 사용되며, 원하는 모델 동작에 영향을 줄 수 있습니다..

모델 버전

str

추론에 사용할 Qwen2.5-VL 모델입니다..

시스템 프롬프트

str

Qwen2.5-VL에 추가 컨텍스트를 제공하기 위한 선택적 시스템 프롬프트입니다..

해당 참조 열은 워크플로 런타임에서 사용할 수 있는 동적 값으로 속성을 매개변수화할 수 있음을 나타냅니다. 자세한 내용은 워크플로 런타임. 자세한 내용은 바인딩 를 참조하세요.

런타임 호환성

하드 - 런타임 self_hosted_cpu; 실행 로컬 : GPU가 필요합니다. run_locally()는 CUDA가 필요한 모델을 로드합니다.

입력 및 출력 바인딩

사용 가능한 연결은 바인딩 종류에 따라 달라집니다. 어떤 바인딩 종류가 있는지 확인하세요 Qwen2.5-VL 버전 v1 가 있습니다.

입력 및 출력 바인딩
  • 입력

    • 이미지들 (image): 추론을 수행할 이미지입니다..

    • 모델 버전 (roboflow_model_id): 추론에 사용할 Qwen2.5-VL 모델입니다..

  • 출력

예시 JSON 정의

마지막 업데이트

도움이 되었나요?