Qwen3-VL
हमारे Serverless Hosted API के माध्यम से Alibaba के Qwen3-VL vision-language model का उपयोग करें
कोड नमूना
3
मॉडल चलाएँ
import os
import cv2
import numpy as np
import requests
from inference_sdk import InferenceHTTPClient
content = requests.get("https://media.roboflow.com/quickstart/dog.jpeg").content
image = cv2.imdecode(np.frombuffer(content, np.uint8), cv2.IMREAD_COLOR)
client = InferenceHTTPClient(
api_url="https://serverless.roboflow.com",
api_key=os.environ["ROBOFLOW_API_KEY"],
)
result = client.infer_lmm(
image,
model_id="qwen3vl-2b-instruct",
prompt="इस image का संक्षेप में वर्णन करें।",
max_new_tokens=128,
)
print(result["response"])सफेद t-shirt और लाल shorts पहने एक आदमी अपने कंधों पर एक beagle dog लेकर चल रहा है। Dog एक black harness पहने हुए है और आगे देख रहा है। आदमी एक residential area में paved path पर चल रहा है, पृष्ठभूमि में apartment buildings हैं। बाईं ओर हरी घास और सफेद फूलों वाला एक छोटा garden है।
Inference speed
उपनाम
विलंबता, 128 tokens (ms)
टोकन/सेकंड
अंतिम अपडेट
क्या यह उपयोगी था?