SmolVLM2
Dedicated Deployment または self-hosted Inference で HuggingFace の SmolVLM2 vision-language model を使用します
コードサンプル
3
モデルを実行する
import os
import cv2
import numpy as np
import requests
from inference_sdk import InferenceHTTPClient
content = requests.get("https://media.roboflow.com/quickstart/dog.jpeg").content
image = cv2.imdecode(np.frombuffer(content, np.uint8), cv2.IMREAD_COLOR)
client = InferenceHTTPClient(
api_url="https://your-deployment.roboflow.cloud",
api_key=os.environ["ROBOFLOW_API_KEY"],
)
result = client.infer_lmm(
image,
model_id="smolvlm2",
prompt="この画像を簡単に説明してください。",
max_new_tokens=64,
)
print(result["response"])男性が犬を肩に担いでいます。
推論速度
別名
レイテンシ、128 トークン (ms)
トークン/秒
最終更新
役に立ちましたか?