Qwen3-VL
Alibaba の Qwen3-VL 画像言語モデルを Serverless Cloud API で使用します
コード例
3
モデルを実行する
import os
import supervision as sv
from inference_sdk import InferenceHTTPClient
image = sv.load_image_from_url("https://media.roboflow.com/quickstart/dog.jpeg")
client = InferenceHTTPClient(
api_url="https://serverless.roboflow.com",
api_key=os.environ["ROBOFLOW_API_KEY"],
)
result = client.infer_lmm(
image,
model_id="qwen3vl-2b-instruct",
prompt="この画像を簡単に説明してください。",
max_new_tokens=128,
)
print(result["response"])白いTシャツと赤いショーツを着た男性が、ビーグル犬を肩に乗せて運んでいます。犬は黒いハーネスを着けており、前を見ています。男性は住宅地の舗装された小道を歩いており、背景には集合住宅の建物があります。左側には緑の芝生と白い花のある小さな庭があります。
推論速度
エイリアス
レイテンシ、128トークン(ms)
トークン/秒
最終更新
役に立ちましたか?