Qwen3-VL
Serverless Hosted API를 통해 Alibaba의 Qwen3-VL vision-language model을 사용합니다.
코드 샘플
3
모델을 실행하세요
import os
import cv2
import numpy as np
import requests
from inference_sdk import InferenceHTTPClient
content = requests.get("https://media.roboflow.com/quickstart/dog.jpeg").content
image = cv2.imdecode(np.frombuffer(content, np.uint8), cv2.IMREAD_COLOR)
client = InferenceHTTPClient(
api_url="https://serverless.roboflow.com",
api_key=os.environ["ROBOFLOW_API_KEY"],
)
result = client.infer_lmm(
image,
model_id="qwen3vl-2b-instruct",
prompt="이 이미지를 간단히 설명하세요.",
max_new_tokens=128,
)
print(result["response"] )흰색 티셔츠와 빨간 반바지를 입은 남성이 비글을 어깨에 올리고 가고 있습니다. 개는 검은 하네스를 착용하고 있으며 앞을 보고 있습니다. 남성은 배경에 아파트 건물이 있는 주거 지역의 포장된 길을 걷고 있습니다. 왼쪽에는 푸른 잔디와 하얀 꽃이 있는 작은 정원이 있습니다.
추론 속도
별칭
지연 시간, 128 토큰(ms)
Tokens/sec
마지막 업데이트
도움이 되었나요?