-
Notifications
You must be signed in to change notification settings - Fork 0
DNET_ImageProcessingCVObjectID
nishi_74322014 edited this page Sep 11, 2026
·
1 revision
画像認識中の物体に関する画像認識(≒ 分類)
(畳み込みニューラルネットワーク(CNN)を参照)、物体認識とも。
-
物体が
事前に与えられたどのラベルに属するか? -
注
ラベルが追加されていくオペレーションには向かない。
(店舗における商品分類など、新商品の追加)
アルゴリズム・モデル
HOG特徴量を抽出しSVMを用いて分類
- CNNのプーリングは様々な情報、特に特徴間の空間的な関係を失う。
- CapsNetはニューロンがスカラーを出力するのに対しベクトルを出力する。
- Vision Transformer (ViT) は、従来のCNNに比べて高い精度を達成することができる。
- 画像を固定サイズのパッチに分割し、
Transformerで算出したAttentionマップで重み付けを行った特徴マップを使用。
- 深層学習についてのレポート(CNN編)
https://www.osscons.jp/joho108j0-537/#_537 - 深層学習についてのレポート(画像系、CNN画像認識以外)
https://www.osscons.jp/joy1y64w3-537/#_537
Tags: 移行, 人工知能, 画像処理, コンピュータビジョン, 物体識別, CNN
このWikiは「Open棟梁Project」,「OSSコンソーシアム 開発基盤部会」によって運営されています。