For the complete documentation index, see llms.txt. This page is also available as Markdown.

Inference 1.0: モジュラーなビジョン実行エンジン

Inference 1.0 が利用可能になりました。コンピュータビジョンモデルを実行するために再設計された推論エンジンです。この更新では、モデルの読み込みの高速化、リソース利用率の向上、サービス提供とモデル実行環境のより明確な分離に重点を置いています。

新しいエンジンは、PyTorch、ONNX、TensorRT などのマルチバックエンド対応、自動モデル読み込み、必要なコンポーネントだけをインストールできる組み合わせ可能な依存関係システムを提供します。これにより、ローカル展開、Docker ワークロード、エッジデバイス、本番システム向けのモジュール型アーキテクチャが実現します。

リリースノートを読む

最終更新

役に立ちましたか?