Skip to content

DNET_ImageProcessingCVObjectID

nishi_74322014 edited this page Sep 11, 2026 · 1 revision

画像処理とコンピュータビジョン(物体識別)

概要

画像認識中の物体に関する画像認識(≒ 分類)
畳み込みニューラルネットワーク(CNN)を参照)、物体認識とも。

  • 物体が
    事前に与えられたどのラベルに属するか?


  • ラベルが追加されていくオペレーションには向かない。
    (店舗における商品分類など、新商品の追加)

詳細

アルゴリズム・モデル

古くは、

テンプレート・マッチング

特徴抽出器

HOG特徴量を抽出しSVMを用いて分類

DNN以降

CNN

畳み込みニューラルネットワーク(CNN)

CapsNet

  • CNNのプーリングは様々な情報、特に特徴間の空間的な関係を失う。
  • CapsNetはニューロンがスカラーを出力するのに対しベクトルを出力する。

ViT

  • Vision Transformer (ViT) は、従来のCNNに比べて高い精度を達成することができる。
  • 画像を固定サイズのパッチに分割し、
    Transformerで算出したAttentionマップで重み付けを行った特徴マップを使用。

参考


Tags: 移行, 人工知能, 画像処理, コンピュータビジョン, 物体識別, CNN

NetDevInfraWiki

マイクロソフト系技術情報 Wiki
Open 棟梁 Wiki

(未着手)

開発基盤部会 Wiki

移行管理: DONETODO

Clone this wiki locally