SmolVLM2
HuggingFace의 SmolVLM2 비전-언어 모델을 Dedicated Deployment 또는 자체 호스팅 Inference에서 사용하세요.
코드 예시
3
모델 실행
import os
import supervision as sv
from inference_sdk import InferenceHTTPClient
image = sv.load_image_from_url("https://media.roboflow.com/quickstart/dog.jpeg")
client = InferenceHTTPClient(
api_url="https://your-deployment.roboflow.cloud",
api_key=os.environ["ROBOFLOW_API_KEY"],
)
result = client.infer_lmm(
image,
model_id="smolvlm2",
prompt="이 이미지를 간단히 설명해 주세요.",
max_new_tokens=64,
)
print(result["response"])한 남자가 어깨에 개를 메고 있습니다.
추론 속도
별칭
지연 시간, 128 토큰(ms)
토큰/초
Inference(자가 호스팅)에서 사용
워크플로의 실행 모드
마지막 업데이트
도움이 되었나요?