Qwen3-VL
Serverless Hosted API を通じて Alibaba の Qwen3-VL vision-language model を使用します
コードサンプル
3
モデルを実行する
import os
import cv2
import numpy as np
import requests
from inference_sdk import InferenceHTTPClient
content = requests.get("https://media.roboflow.com/quickstart/dog.jpeg").content
image = cv2.imdecode(np.frombuffer(content, np.uint8), cv2.IMREAD_COLOR)
client = InferenceHTTPClient(
api_url="https://serverless.roboflow.com",
api_key=os.environ["ROBOFLOW_API_KEY"],
)
result = client.infer_lmm(
image,
model_id="qwen3vl-2b-instruct",
prompt="この画像を簡単に説明してください。",
max_new_tokens=128,
)
print(result["response"])白いTシャツと赤いショートパンツを着た男性が、ビーグル犬を肩に乗せて運んでいます。犬は黒いハーネスを着けていて、前を見ています。男性は住宅街の舗装された道を歩いており、背景にはアパートの建物があります。左側には、緑の芝生と白い花のある小さな庭があります。
推論速度
別名
レイテンシ、128 トークン (ms)
トークン/秒
最終更新
役に立ちましたか?