コアモデル
inference-sdk の HTTP クライアントを通じて、同期・非同期メソッドで CLIP と DocTR の基盤モデルを呼び出します。
CLIP
from inference_sdk import InferenceHTTPClient
CLIENT = InferenceHTTPClient(
api_url="http://localhost:9001", # または "https://serverless.roboflow.com" を使ってホスト型サービングを利用
api_key="ROBOFLOW_API_KEY"
)
CLIENT.get_clip_image_embeddings(inference_input="./my_image.jpg") # 単一画像のリクエスト
CLIENT.get_clip_image_embeddings(inference_input=["./my_image.jpg", "./other_image.jpg"]) # バッチ画像リクエスト
CLIENT.get_clip_text_embeddings(text="some") # 単一テキストのリクエスト
CLIENT.get_clip_text_embeddings(text=["some", "other"]) # その他のテキストリクエスト
CLIENT.clip_compare(
subject="./my_image.jpg",
prompt=["fox", "dog"],
)DocTR
Gaze(非推奨)
最終更新
役に立ちましたか?