> For the complete documentation index, see [llms.txt](https://docs.roboflow.com/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.roboflow.com/models/ko/supported-models/owlv2.md).

# OwlV2

OwlV2는 Google의 개방형 어휘 객체 탐지기입니다. 참조 이미지에 하나 이상의 예시 바운딩 박스를 제공하면, OwlV2는 별도의 학습 없이 대상 이미지에서 유사한 객체를 탐지합니다.

{% hint style="info" %}
OwlV2는 Serverless Hosted API에서 사용할 수 없습니다. 다음에서 실행하세요. [전용 배포](https://docs.roboflow.com/deployment/roboflow-cloud/dedicated-deployments) 또는 [자가 호스팅 Inference](https://docs.roboflow.com/deployment/self-hosted/self-hosted).
{% endhint %}

## 코드 샘플

{% stepper %}
{% step %}

### API 키 받기

Roboflow 계정을 만들고, 다음에서 키를 찾으세요 [Roboflow API 설정 페이지](https://app.roboflow.com/settings/api) 그리고 셸에서 사용할 수 있도록 설정하세요:

```bash
export ROBOFLOW_API_KEY="your-key-here"
```

{% endstep %}

{% step %}

### 의존성 설치하기

이 패키지들은 API를 호출하고 결과를 그립니다:

```bash
pip install -U requests supervision opencv-python
```

{% endstep %}

{% step %}

### 모델 실행하기

아래 샘플은 입력 이미지의 단일 예시 상자를 프롬프트로 사용하여 같은 이미지에서 일치하는 객체를 탐지합니다. 실제로는 보통 별도의 참조 이미지를 전달합니다. 설정하세요. `URL` 전용 배포 URL 또는 로컬 추론 서버로.

```python
import base64
import os
import cv2
import numpy as np
import requests
import supervision as sv

URL = "https://your-deployment.roboflow.cloud"
image = sv.load_image_from_url("https://media.roboflow.com/notebooks/examples/dog.jpeg")
_, buffer = cv2.imencode(".jpg", image)
image_base64 = base64.b64encode(buffer).decode("utf-8")

response = requests.post(
    f"{URL}/owlv2/infer",
    json={
        "api_key": os.environ["ROBOFLOW_API_KEY"],
        "image": {"type": "base64", "value": image_base64},
        "training_data": [{
            "image": {"type": "base64", "value": image_base64},
            "boxes": [{"x": 360, "y": 800, "w": 500, "h": 500, "cls": "dog"}],
        }],
        "confidence": 0.99,
    },
)
preds = response.json()["predictions"]

xyxys = [
    [p["x"] - p["width"] / 2, p["y"] - p["height"] / 2,
     p["x"] + p["width"] / 2, p["y"] + p["height"] / 2]
    for p in preds
]
detections = sv.Detections(
    xyxy=np.array(xyxys, dtype=float),
    class_id=np.array([p.get("class_id", 0) for p in preds]),
    confidence=np.array([p["confidence"] for p in preds], dtype=float),
    data={"class_name": np.array([p["class"] for p in preds])},
)
labels = [f"{p['class']} {p['confidence']:.2f}" for p in preds]
annotated = sv.BoxAnnotator().annotate(image.copy(), detections)
annotated = sv.LabelAnnotator().annotate(annotated, detections, labels=labels)
cv2.imwrite("dog_annotated.png", annotated)
```

<figure><img src="/files/a160ee283d0864a764a64ad20fadd6777d32addf" alt=""><figcaption></figcaption></figure>
{% endstep %}
{% endstepper %}

## 추론 속도

다음을 사용해 측정한 지연 시간 [Roboflow Inference](https://docs.roboflow.com/deployment/self-hosted/self-hosted) 1x NVIDIA L4, 배치 크기 1, 워밍업 후 평균.

<table data-search="false"><thead><tr><th>모델</th><th>지연 시간(ms)</th></tr></thead><tbody><tr><td><code>owlv2</code></td><td>541.2</td></tr></tbody></table>

다음에서 측정했습니다: `owlv2-large-patch14-ensemble` 텍스트 프롬프트가 두 개인 체크포인트.

{% hint style="info" %}
설정하세요 `URL` 배포 대상에 맞게 설정하세요:

* `http://localhost:9001` 로컬 [Inference](https://docs.roboflow.com/deployment/self-hosted/self-hosted) 서버.
* 사용자 [전용 배포](https://docs.roboflow.com/deployment/roboflow-cloud/dedicated-deployments) 비공개 엔드포인트용 URL.
  {% endhint %}

OwlV2의 신뢰도는 일반적으로 매우 높습니다(0.99 이상). 다음을 조정하세요. `신뢰도` 매개변수를 그에 맞게 조정하세요.

## Inference(자가 호스팅)와 함께 사용

OwlV2는 다음을 사용하여 직접 로드할 수 있습니다. [`inference`](https://docs.roboflow.com/deployment/self-hosted/self-hosted) 패키지입니다. Inference의 구현은 다음에서 객체를 탐지합니다. *시각적* 예시: 하나 이상의 예시 객체를 박싱하면, 모델이 유사한 객체를 찾습니다.

{% stepper %}
{% step %}

### 패키지 설치하기

```bash
pip install "inference[transformers]"
```

사용 `inference-gpu[transformers]` 를 GPU 머신에서 사용하세요.
{% endstep %}

{% step %}

### 모델 실행하기

```python
import base64
import io

from PIL import Image

from inference.core.entities.requests.owlv2 import OwlV2InferenceRequest
from inference.models.owlv2.owlv2 import OwlV2

image = {"type": "url", "value": "https://media.roboflow.com/inference/seawithdock.jpeg"}

request = OwlV2InferenceRequest(
    image=image,
    training_data=[
        {
            "image": image,
            "boxes": [{"x": 223, "y": 306, "w": 40, "h": 226, "cls": "post"}],
        }
    ],
    visualize_predictions=True,
    confidence=0.9999,
)

response = OwlV2().infer_from_request(request)

visualization = Image.open(io.BytesIO(response.visualization))
visualization.save("owlv2_visualization.jpg")
```

다음을 `훈련 데이터` 일치시키고 싶은 예시 객체와 이미지 URL을 사용자의 입력으로 바꾸세요. 주석이 달린 결과는 다음에 저장됩니다. `owlv2_visualization.jpg`.
{% endstep %}
{% endstepper %}
