AI用語
視覚エージェント
Visual agent
視覚エージェントとは
画像や動画などの視覚情報を入力として解釈し、操作や意思決定を行うAIモデル。
他の言語での表記と説明
- 한국어시각 에이전트
- 이미지나 비디오 등 시각적 정보를 처리하고 이를 바탕으로 사용자 인터페이스(GUI) 탐색이나 게임 플레이와 같은 환경 내 작업을 수행하는 인공지능 모델
- EnglishVisual agent
- An AI system capable of perceiving visual inputs and taking autonomous actions within a GUI or simulated environment
関連用語
- GUIエージェントグラフィカルな操作画面上のアイコンやテキストを認識し、人間のようにクリックや入力を行うAI。
- ビジョン・言語・行動モデル視覚情報と自然言語を理解し、ロボットの具体的な動作を生成・制御するために統合されたAIアーキテクチャ。
- 身体化AI物理的な身体を持ち、現実世界での知覚と行動を通じて課題を解決する知能システム。
- コンピュータ利用エージェントPC等のオペレーティングシステム上でマウス操作やキーボード入力を実行し、人間のようにソフトウェアを操作する自律型AI
- 汎用エージェント複数の手順にまたがる目標を理解し、必要な操作を選びながらタスクを進めるソフトウェアエージェント
- エージェントシステム目標に向けて判断、行動、外部ツール利用を行うAIシステム
- AI推論エージェント与えられた情報をもとに段階的な判断や推論を行い、質問応答や業務支援を実行するAIシステム
- Webエージェント人間のようにWebブラウザを操作して検索、クリック、フォーム入力などを行い、タスクを実行するAIエージェント。
- フィジカルAIセンサーやロボティクスを融合し、現実の物理空間を認識して実際に動作や作業を行うAI技術。
- 能動的探索AIが受動的にデータを受け取るのではなく、自律的に動いて情報を収集し、環境を理解すること。
- ヘッドレスエージェントユーザーが操作するグラフィカルな画面を持たず、サーバー側やバックグラウンドでAPIなどを通じて自律的にデータ監視や処理を行うAIプログラム。
- グラスボックスAI推論プロセスや意思決定の根拠が人間にとって透明で、監査可能なAIの設計思想