Workflows の Llama Vision 3.2 対応

最終更新
役に立ちましたか?

Llama Vision 3.2、Meta AI によって開発されたマルチモーダル LLM が、Roboflow Workflows で使えるようになりました。
このモデルを使って、画像の内容について質問し、テキストの応答を取得できます。
例えば、このブロックは次の用途に使えます:
画像内のテキストを読み取る。
画像内のテキストについて質問する。
特定のプロンプトに基づいて画像を分類する。
この応答は、そのまま Workflow から返すことも、他のブロック(例: Expression ブロック)でさらに処理することもできます。
注: Llama Vision 3.2 ブロックは次を使用するように設定されています OpenRouter 推論に OpenRouter を使用します。Llama Vision 3.2 ブロックを使用するには、OpenRouter API キーが必要です。
最終更新
役に立ちましたか?
役に立ちましたか?