SmolVLM2
Dedicated Deployment 또는 self-hosted Inference에서 HuggingFace의 SmolVLM2 vision-language model을 사용합니다.
코드 샘플
3
모델을 실행하세요
import os
import cv2
import numpy as np
import requests
from inference_sdk import InferenceHTTPClient
content = requests.get("https://media.roboflow.com/quickstart/dog.jpeg").content
image = cv2.imdecode(np.frombuffer(content, np.uint8), cv2.IMREAD_COLOR)
client = InferenceHTTPClient(
api_url="https://your-deployment.roboflow.cloud",
api_key=os.environ["ROBOFLOW_API_KEY"],
)
result = client.infer_lmm(
image,
model_id="smolvlm2",
prompt="이 이미지를 간단히 설명하세요.",
max_new_tokens=64,
)
print(result["response"] )한 남자가 어깨에 개를 태우고 있습니다.
추론 속도
별칭
지연 시간, 128 토큰(ms)
Tokens/sec
마지막 업데이트
도움이 되었나요?