For the complete documentation index, see llms.txt. This page is also available as Markdown.

Cosmos 3

NVIDIA Cosmos 3で物理シーンを推論します。

このワークフローブロックは、NVIDIA Cosmos 3 reasoner(物理的なシーン理解向けに調整された世界モデル)を、任意のテキストプロンプト付きの画像に対して実行し、テキストの回答を返します。このモデルは、空間関係、安全性、そしてシーン内で次に何が起こるかに関する質問に適しています。

型識別子

ステップで次の識別子を使用してください "type" フィールド: roboflow_core/cosmos3_edge@v1 ワークフローにこのブロックをステップとして追加するには。

プロパティ

名前

説明

参照

name

str

このステップの一意の識別子を入力してください。

プロンプト

str

Cosmos 3 Edge に渡す任意のテキストプロンプト。それ以外の場合は、デフォルトのシーン説明プロンプトが使用され、望ましいモデルの動作に影響する場合があります。

model_version

str

推論に使用する Cosmos 3 Edge モデル。

system_prompt

str

Cosmos 3 Edge に追加のコンテキストを提供する任意のシステムプロンプト。

この 参照 列は、で利用可能な動的値を使ってプロパティをパラメータ化できる可能性を示します ワークフロー 実行時。参照 バインディング 詳細は。

ランタイム互換性

ハード - ランタイム self_hosted_cpu;実行 ローカル : GPU が必要です。run_locally() は CUDA を必要とするモデルを読み込みます。

入力と出力のバインディング

利用可能な接続は、そのバインディング種別によって異なります。どのバインディング種別が Cosmos 3 のバージョン v1 あるか確認してください。

入力と出力のバインディング
  • 入力

    • images (image): 推論対象の画像です..

    • プロンプト (string): Cosmos 3 Edge に渡す任意のテキストプロンプト。それ以外の場合は、デフォルトのシーン説明プロンプトが使用され、望ましいモデルの動作に影響する場合があります。

    • model_version (roboflow_model_id): 推論に使用する Cosmos 3 Edge モデル。

    • system_prompt (string): Cosmos 3 Edge に追加のコンテキストを提供する任意のシステムプロンプト。

  • 出力

    • 出力 (Union[string, language_model_output]):の文字列値 string または LLM / VLM の出力(条件が language_model_output.

JSON 定義の例

最終更新

役に立ちましたか?