見出し画像

第3章:目を持つAI!画像認識と動画のテクノロジー

第3章のテーマは、AIの「視力」である画像認識と動画テクノロジー!

スマホの顔認証から自動運転まで、現代のテクノロジーを陰で支える主役「CNN」の仕組みを解き明かします。写真の特徴を見つけ出す「虫眼鏡(畳み込み)」や、データをギュッと圧縮する「整理術(プーリング)」、さらには写真の枚数を強引に増やす「裏ワザ(データ拡張)」まで盛りだくさん。

ちょっと用語は増えますが、基本となるアイデアさえ掴めば怖くありません。AIがどんな風に世界を「見ている」のか、その秘密をのぞいてみましょう!

重要度: ★★★★☆ 【ここが踏ん張りどころ!出題率高めの超定番】


第1回(通算第21回):
(学ぶキーワード:コンピュータビジョン)
👉 スマホの顔認証はどうやってる?「画像認識」の基本

第2回(通算第22回):
(学ぶキーワード:CNN)
👉 AIに「目」を授けた!「CNN(畳み込みニューラルネットワーク)」

第3回(通算第23回):
(学ぶキーワード:畳み込み層)
👉 画像の特徴を虫眼鏡で見つける「畳み込み層」の役割

第4回(通算第24回):
(学ぶキーワード:プーリング層)
👉 細かいズレは気にしない!画像をギュッとまとめる「プーリング層」

第5回(通算第25回):
(学ぶキーワード:ストライド)
👉 何マスずつ進む?AIの目の動かし方「ストライド」

第6回(通算第26回):
(学ぶキーワード:パディング)
👉 画像の端っこも見落とさない!外枠を埋める「パディング」

第7回(通算第27回):
(学ぶキーワード:AlexNet、VGG、ResNetなどのCNNアーキテクチャ)
👉 エラーを乗り越えて進化!CNNスター誕生の歴史

第8回(通算第28回):
(学ぶキーワード:物体検出、YOLOなど)
👉 写真の中の「どこに何がある」を秒で見つける「物体検出」

第9回(通算第29回):
(学ぶキーワード:セマンティックセグメンテーション)
👉 写真の1ピクセルまで見分ける「セマンティックセグメンテーション」

第10回(通算第30回):
(学ぶキーワード:データ拡張)
👉 写真が足りない?裏返したり薄暗くしたりする「データ拡張」


❤️ この記事が役に立ったら「スキ」で応援してください!
あなたの応援が、次の解説を作るエネルギーになります!


いいなと思ったら応援しよう!