> ## Documentation Index
> Fetch the complete documentation index at: https://private-7c7dfe99-home-button.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# ビジョン

> ClickHouse Agents における画像入力と視覚的理解

export const Image = ({img, alt, size}) => {
  return <Frame>
      <img src={img} alt={alt} />
    </Frame>;
};

export const galaxyOnClick = eventName => () => {
  try {
    if (typeof window !== "undefined" && window.galaxy && eventName) {
      window.galaxy.track(eventName, {
        interaction: "click"
      });
    }
  } catch (e) {}
};

export const BetaBadge = ({link, galaxyTrack, galaxyEvent}) => {
  if (link) {
    return <a href={link} target="_blank" rel="noopener noreferrer" className="betaBadge" onClick={galaxyTrack && galaxyEvent ? galaxyOnClick(galaxyEvent) : undefined}>
                <Icon />
                <span>Beta</span>
            </a>;
  }
  return <div className="betaBadge">
            <Icon />
            <span>
                Beta feature. 
                <u>
                    <a href="/docs/beta-and-experimental-features#beta-features">
                        Learn more.
                    </a>
                </u>
            </span>
        </div>;
};

ビジョンでは、ユーザーがエージェントに解析させる画像をアップロードできます。エージェントはその画像をビジョン対応モデルに渡し、モデルが画像の内容を説明したり、要約したり、画像についての質問に答えたりします。

<div id="enable-it">
  ## ビジョン機能を有効にする
</div>

ビジョンは、画像入力をサポートするモデルでのみ使用できます。選択したモデルが画像入力に対応していない場合、メッセージコンポーザーのアップロードコントロールは無効になります。
再度有効にするには、[モデルパラメーター](/ja/products/cloud/features/ai-ml/agents/builder/model-parameters) でビジョン対応モデルに切り替えてください。

<div id="use-it">
  ## ビジョン機能を使う
</div>

メッセージコンポーザーの左下にあるクリップアイコンをクリックし、**Upload to Provider** を選んでイメージを添付します。スクリーンショット、写真、チャート、図表などを追加できます。続いて、そのイメージを読み取る必要がある質問をします。たとえば、*"このクエリプランの何が問題ですか？"*、*"このスクリーンショット内のテキストを書き起こしてください"*、*"このダッシュボードを先週のものと比較してください"* といった質問です。

<Image img="https://mintcdn.com/private-7c7dfe99-home-button/Ip992kvO_UeREAXS/images/cloud/agent-builder/vision/vision.png?fit=max&auto=format&n=Ip992kvO_UeREAXS&q=85&s=16078f3452a0e5fbb56917a8d09f6eb9" alt="Upload to Provider、Upload as Text、Upload to Code Environment の各オプションが表示された、クリップメニューを開いた状態のメッセージコンポーザー" size="lg" width="3838" height="1936" data-path="images/cloud/agent-builder/vision/vision.png" />

エージェントはイメージをメッセージコンテキストの一部として扱うため、同じターン内の追加の質問では、再アップロードしなくても見た内容を参照できます。

<div id="combine-with-other-tools">
  ## ビジョンを他のツールと組み合わせる
</div>

ビジョンは、画像ベースの分析では[コードインタープリター](/ja/products/cloud/features/ai-ml/agents/builder/code-interpreter)と特に相性がよく、たとえばエージェントがスクリーンショットから数値を読み取り、その後 Python を実行して合計を計算できます。また、画像にモデルが調べる必要のある対象への言及が含まれている場合は、[ウェブ検索](/ja/products/cloud/features/ai-ml/agents/builder/web-search)も効果的です。
