For the complete documentation index, see llms.txt. This page is also available as Markdown.

PaliGemma 2

हमारे Serverless Hosted API के माध्यम से Google के PaliGemma 2 vision-language model का उपयोग करें

PaliGemma 2 Google का vision-language model है। यह एक image और एक text prompt स्वीकार करता है और एक text response लौटाता है। हम PaliGemma 2 को हमारे Serverless Hosted API, Dedicated Deployments, और self-hosted Inference.

कोड नमूना

1

अपनी API Key प्राप्त करें

एक Roboflow खाता बनाएं, अपनी key यहाँ पर ढूँढें Roboflow API settings page और इसे अपने shell में उपलब्ध कराएँ:

export ROBOFLOW_API_KEY="your-key-here"
2

निर्भरताएँ इंस्टॉल करें

इंस्टॉल करें Inference SDK:

pip install inference-sdk
3

मॉडल चलाएँ

यह sample pretrained को कॉल करता है paligemma2-3b-pt-224 checkpoint को एक caption prompt के साथ.

import os
import cv2
import numpy as np
import requests
from inference_sdk import InferenceHTTPClient

content = requests.get("https://media.roboflow.com/quickstart/dog.jpeg").content
image = cv2.imdecode(np.frombuffer(content, np.uint8), cv2.IMREAD_COLOR)

client = InferenceHTTPClient(
    api_url="https://serverless.roboflow.com",
    api_key=os.environ["ROBOFLOW_API_KEY"],
)
result = client.infer_lmm(
    image,
    model_id="paligemma2-3b-pt-224",
    prompt="caption en",
    max_new_tokens=64,
)
print(result["response"])

ऊपर दिया गया code terminal में model का response प्रिंट करता है:

यहाँ एक कुत्ता एक आदमी के कंधे पर दिखाई देता है

Inference speed

Latency मापी गई Roboflow Inference 1x NVIDIA L4 पर, batch size 1 के साथ, fixed prompt से greedy decoding का उपयोग करके बिल्कुल 128 tokens generate करते हुए। Latency output length के साथ scale होती है, इसलिए अन्य lengths का अनुमान लगाने के लिए tokens/sec का उपयोग करें।

उपनाम
विलंबता, 128 tokens (ms)
टोकन/सेकंड

paligemma2-3b-pt-224

3986

32

सेट करें api_url को अपने deployment target से मिलाएँ:

  • https://serverless.roboflow.com Serverless Hosted API के लिए।

  • http://localhost:9001 एक local Inference server.

  • आपका Dedicated Deployment एक private endpoint के लिए URL.

आप Roboflow पर अपना खुद का PaliGemma 2 checkpoint train कर सकते हैं और उसे उसके per-model {workspace}/{model-slug} ID (देखें Versions, Trainings, and Models). देखें the Inference documentation अतिरिक्त prompt formats और समर्थित checkpoints के लिए।

अंतिम अपडेट

क्या यह उपयोगी था?