For the complete documentation index, see llms.txt. This page is also available as Markdown.

Google Vision OCR

Google Vision API를 사용하여 이미지의 텍스트를 감지합니다

Google Vision OCR을 사용해 이미지에서 텍스트를 감지합니다.

지원되는 텍스트 감지 유형:

  • text_detection: 더 큰 이미지 내의 텍스트 영역에 최적화되어 있습니다.

  • ocr_text_detection: 밀집된 텍스트 문서에 최적화되어 있습니다.

Google Vision API 키를 제공하거나 값을 다음으로 설정하세요 rf_key:account (또는 rf_key:user:<id>)를 Roboflow의 API를 통해 요청을 프록시하도록 설정하세요.

유형 식별자

단계에서 다음 식별자를 사용하세요 "type" 필드: roboflow_core/google_vision_ocr@v1 워크플로우에 이 블록을 단계로 추가하려면.

속성

이름

유형

설명

참조

name

str

이 단계에 대한 고유 식별자를 입력하세요..

ocr_type

str

사용할 OCR 유형입니다.

API 키

str

Google Vision API 키입니다.

language_hints

List[str]

OCR API에 전달할 선택적 언어 코드 목록입니다. 제공하지 않으면 API가 언어를 자동으로 감지하려고 시도합니다. 제공하는 경우 언어 코드는 OCR API에서 지원해야 하며, 지원되는 언어 코드 목록은 https://cloud.google.com/vision/docs/languages 를 방문하세요..

참조 열은 워크플로우 런타임에서 사용 가능한 동적 값으로 속성을 매개변수화할 수 있는 가능성을 나타냅니다 워크플로우 런타임입니다. 자세한 내용은 바인딩 을 참조하세요.

런타임 호환성

인터넷 필요 - 에어갭 / 오프라인 배포 : 이 블록은 완전히 오프라인 / 에어갭된 배포에서는 접근할 수 없는 서비스에 의존합니다.

입력 및 출력 바인딩

사용 가능한 연결은 바인딩 유형에 따라 달라집니다. 어떤 바인딩 유형인지 확인하세요 Google Vision OCR 버전 v1 을 가지고 있는지.

입력 및 출력 바인딩
예시 JSON 정의

마지막 업데이트

도움이 되었나요?