For the complete documentation index, see llms.txt. This page is also available as Markdown.

AWS にデプロイ

Inference CLI と SkyPilot を使用して、AWS EC2 インスタンスに Roboflow Inference サーバーをデプロイします。

Roboflow Inference は、Amazon Web Services 上でホストされたマシンで実行できます。自分でクラウドインフラを管理しながら Inference の機能を使いたい場合に適しています。

AWS EC2 インスタンスをセットアップする

始めるには、AWS 上で稼働している EC2 インスタンスが必要です。インスタンスのプロビジョニングには、AI プロジェクト向けのクラウドインスタンスのセットアップを支援するツールである SkyPilot をおすすめします。

まずは自身のマシンで次のコマンドを実行してください:

pip install inference "skypilot[aws]"

次の手順に従ってください SkyPilot のクラウドアカウント設定ドキュメント AWS で認証したら、次を実行します:

inference cloud deploy --provider aws --compute-type gpu

これにより、AWS 上に GPU 対応インスタンスがプロビジョニングされ、最新バージョンの Roboflow Inference が自動的にインストールされます。

コマンドが完了すると、次のようなメッセージが表示されるはずです:

Roboflow Inference を aws の gpu にデプロイしました。デプロイ名は ...
デプロイ一覧を表示するには: inference cloud status
デプロイを削除するには: inference cloud undeploy ...
デプロイされたサーバーに ssh で接続するには: ssh ...
Roboflow Inference Server は http://34.66.116.66:9001 で実行されています

そのエンドポイントを使ってモデルを実行できます: object detection、segmentation、classification、そして Roboflow ワークスペースの keypoint モデルに加え、CLIP、PaliGemma、SAM2 などの基盤モデルも利用できます。

次の手順

次の設定を行って、クライアントを新しいサーバーに向けます api_url を、VM の IP アドレスとサーバーが実行されているポートに設定します(9001 がデフォルトです)。 モデルを実行する 最初のリクエストについては Inference CLI のクラウドコマンド を参照して、デプロイを管理してください。

サーバーをプライベートネットワークの外部に公開する前に、 セルフホスト型サーバーのセキュリティ保護.

最終更新

役に立ちましたか?