コンピュータビジョン

記事数:(8)

AI活用

テンプレートマッチングで画像を探す

型板合わせとは、絵の中から特定の模様を探す技術のことです。例えるなら、探し物をするときに、持っている写真と目の前の景色を細かく比べながら探すようなものです。具体的には、探し物の写真が「型板」となり、景色の写真が「対象の絵」となります。この型板を対象の絵の上で少しずつずらしながら、それぞれの位置で型板と対象の絵の一部がどれくらい似ているかを計算します。そして、最も似ている部分が、探し物が見つかった場所として特定されます。この技術は、様々な分野で使われています。製造業における部品の検査を例に挙げると、工場の製造ラインで製品の外観検査を行う際に、不良品の絵を型板として登録しておけば、自動的に不良品を見つけ出すことができます。型板の絵と製品の絵を比較することで、傷や汚れなどの欠陥を素早く見つけることができるのです。また、医療画像診断では、特定の臓器や病変部の形を型板として、絵の中からそれらを見つけ出すことができます。例えば、レントゲン写真から骨折箇所を見つけ出す際、骨折の形を型板として登録しておけば、医師は容易に骨折箇所を特定することができます。型板合わせは、単純な模様だけでなく、複雑な模様にも対応することができます。型板の大きさや形を調整することで、様々な対象に対応できます。例えば、対象の絵が回転していたり、拡大縮小されていたりする場合でも、型板を調整することで、正しく模様を見つけ出すことができます。さらに、複数の型板を同時に使用することで、複数の模様を同時に探し出すことも可能です。これは、例えば、複数の種類の部品が混ざっている中から特定の部品を見つけ出す際に役立ちます。このように、型板合わせは、絵認識における重要な技術の一つとなっています。高度な処理を必要とせず、比較的簡単に実装できるため、幅広い分野で活用が期待されています。
AI活用

画像で探す!類似画像検索の世界

今では、目に映るものすべてが写真に収められ、世界中のあらゆる場所に共有される時代になりました。インターネット上には無数の写真が溢れかえり、その数は増える一方です。これらの写真の中から、まさに探し求めている写真を見つけ出すのは、砂浜から一粒の砂を探すようなものです。これまでの探し方は、主に言葉を使う方法でした。写真につけられた説明や名前を手がかりに、目的の写真を探し出すのです。しかし、言葉だけでは写真の微妙な雰囲気や見た目の特徴をうまく捉えられないことがしばしばあります。例えば、「夕焼け」という言葉で検索しても、空の色合いや雲の形など、細かい違いまでは表現できません。そこで、写真そのものを使って似た写真を探し出す新しい方法が登場しました。これは、まるで写真の「見た目」を言葉に変換して検索するようなものです。この方法を「類似写真検索」と言います。探したい写真を見せるだけで、似た雰囲気や構図の写真を見つけることができるのです。この技術によって、私たちの探し物は大きく変わります。例えば、街で見かけた素敵な服の写真を撮って、同じようなデザインの服をインターネットで見つけることができます。また、旅行で行きたい場所の写真を使って、似た景色を持つ場所を探すこともできます。さらに、絵画や美術品の写真から、作者や時代を特定することも可能になるでしょう。このように、類似写真検索は、単に写真を探すだけでなく、私たちの生活をより便利で豊かにする可能性を秘めています。まるで宝探しの名人のように、膨大な写真の海から貴重な情報を見つけ出す、頼れる味方となることでしょう。
AI活用

物体認識:画像の可能性を広げる技術

物体認識とは、写真や動画といった、視覚的な情報から、写っているものが何かを判別する技術のことです。カメラやセンサーといった機器で得られた情報を元に、何が写っているかを理解するという点が重要です。まるで人間の目が物体を捉え、脳がそれを認識する過程と似ています。具体的に何が出来るかというと、まず、写真の中に特定の物体が写っているかどうかを判断できます。例えば、リンゴの画像を入力すれば、「これはリンゴである」と判断します。さらに、単に物体を判別するだけでなく、その種類や位置、大きさといった詳細な情報も抽出可能です。写真の中に複数の物体が写っている場合、それぞれの物体が何で、どこにあるのか、どれくらいの大きさなのかを正確に把握できます。この技術は、様々な分野で活用されています。例えば、自動運転車では、周囲の状況を把握するために不可欠です。道路上の他の車や歩行者、信号機、標識などを認識することで、安全な走行を実現しています。また、製造業の現場でも活躍しています。製品の外観検査工程では、傷や汚れといった欠陥を自動で見つけることで、品質管理の向上に役立っています。さらに、医療現場では、レントゲン写真やCT画像から病変部を特定する際に活用され、医師の診断を支援しています。このように物体認識は、私たちの生活をより便利で安全なものにするための重要な技術として、幅広い分野で応用され、進化を続けています。
AI活用

画像認識の進化:物体検知の世界

「物体検知」とは、写真や動画といった視覚情報の中から、特定のものを探し出し、その場所を特定する技術のことです。まるで人間の目で見て、それが何でどこにあるのかを理解するのと同じように、コンピュータが画像を解析します。例えば、一枚の写真に猫、犬、車が写っていたとしましょう。物体検知を使うと、コンピュータはこれらのものをそれぞれ「猫」「犬」「車」と認識し、写真の中のどこに位置しているかを正確に捉えます。そして、それぞれの物体を囲むように四角い枠を描いて示すのです。この技術の重要な点は、単に写真に何が写っているかを判別するだけでなく、そのものが写真のどの位置にあるのかという情報も同時に得られることです。従来の画像認識技術では、写真の中に何が写っているかを大まかに把握することしかできませんでしたが、物体検知では、複数のものが写っている場合でも、一つ一つを個別に認識し、それぞれの種類と位置を特定することができます。例えば、工場の生産ラインにおいて、製品の不良個所を自動で見つける、あるいは、自動運転車において、周囲の歩行者や車両を認識して安全に走行する、といった応用が考えられます。近年、「深層学習」と呼ばれる技術の進歩によって、物体検知の精度は飛躍的に向上しました。深層学習とは、人間の脳の仕組みを模倣したコンピュータによる学習方法で、大量のデータから複雑なパターンを自動的に学習することができます。この深層学習を用いることで、従来の手法では難しかった複雑な形状の物体や、照明条件の変化などにも対応できるようになり、様々な分野での活用が進んでいます。今後、ますます発展が期待される技術の一つと言えるでしょう。
AI活用

画像認識の進化:物体検出技術

「物体検出」とは、写真や動画といった視覚情報の中から、特定の物体が写っている場所を自動的に見つけ出し、それが何かを判別する技術のことです。たとえば、一枚の写真に車、人、自転車が写っていたとします。物体検出は、それぞれの物体の周りを四角形で囲み、「これは車」「これは人」「これは自転車」といった具合に名前を付けます。この技術は、近年の人工知能技術、特に「深層学習」と呼ばれる技術の進歩によって、飛躍的に精度が向上しました。その結果、自動運転や医療画像診断など、様々な分野で活用されるようになりました。自動運転では、周りの車や歩行者、信号などを検出し、安全な運転を支援します。医療画像診断では、レントゲン写真やCT画像から病変を見つけ出すのに役立っています。従来の画像認識技術は、画像全体を見て「この画像には何が写っているか」を判断するだけでした。たとえば、猫の画像を見せると「猫」と答えることはできましたが、猫が画像のどこに写っているかは分かりませんでした。しかし、物体検出は「何が、どこに写っているか」を特定できます。つまり、猫の画像を見せると、猫の位置を四角で囲み、「ここに猫がいます」と教えてくれるのです。この「位置情報」を得られることが、物体検出の大きな特徴であり、様々な分野への応用を可能にしています。ただ物体を認識するだけでなく、その位置まで特定できることで、ロボットが物体を掴んだり、自動運転車が障害物を避けたり、といった複雑な作業が可能になるのです。まさに、物体検出は、機械が人間の目を持つように、視覚情報をより深く理解するための重要な技術と言えるでしょう。
AI活用

画像認識の進化:セグメンテーションとは

近年、計算機によって人の知覚をまねる技術が急速に発展しており、中でも絵の解析技術は目覚ましい進歩を見せています。絵の解析とは、人の目と同じように絵の内容を理解し、分析する技術のことです。自動で車を動かす技術や病気の診断、ものづくりなど、様々な分野で既に活用されています。こうした技術の中でも、特に注目されているのが「分割」と呼ばれる技術です。分割とは、絵を細かい点の集まりとして捉え、一つ一つの点がどの物体に属するかを判別する技術です。例えば、人の顔の絵を解析する場合、分割技術を用いることで、目、鼻、口といった各パーツを正確に区別することができます。また、道路の写真を解析する場合には、車、歩行者、信号などをそれぞれ細かく識別することが可能です。この技術の精度は近年飛躍的に向上しており、様々な分野での応用が期待されています。例えば、医療分野では、レントゲン写真やCT画像から腫瘍などの病変を正確に特定するために役立ちます。製造業では、製品の外観検査を自動化し、不良品を効率的に検出することができます。さらに、自動運転技術においては、周囲の環境を正確に認識するために不可欠な技術となっています。このように、分割技術は、絵の解析技術の中でも特に重要な技術であり、今後の技術革新を牽引していくことが期待されます。本稿では、分割技術の仕組みや、様々な分野での活用事例について、より詳しく説明していきます。
ハードウエア

エッジAIを加速するHailoの技術

近年、人工知能は暮らしの様々な場面で利用されるようになってきました。ものを認識する、言葉を理解する、状況を判断するといった高度な処理を、機械が自ら行う人工知能は、既に身近なところで活躍しています。例えば、写真に写る人物を判別したり、音声で機器を操作したり、車の自動運転支援など、多くの場所で利用されています。特に注目を集めているのが、端末側で人工知能の処理を行う「組み込み人工知能」です。従来の人工知能は、多くの場合、クラウドと呼ばれるインターネット上の巨大な計算機で処理を行っていました。しかし、この方法では、常にインターネットに接続している必要があり、通信遅延が発生したり、個人情報の保護が課題となっていました。組み込み人工知能は、これらの課題を解決する技術です。人工知能の処理をスマートフォンや家電製品、自動車などに搭載された小さな計算機で行うことで、インターネットへの接続が不要になり、処理速度の向上と個人情報の保護を実現します。今回ご紹介するのは、この組み込み人工知能向けに高性能な処理装置を開発・提供するイスラエルの企業「ハイロ」です。ハイロは、独自の革新的な技術を用いて、小さなチップでありながら、従来の組み込み人工知能処理装置に比べてはるかに高い処理能力と低い消費電力を実現しています。ハイロの技術は、組み込み人工知能の可能性を大きく広げると期待されています。より多くの機器に人工知能が搭載されることで、私たちの生活はより便利で豊かになるでしょう。ハイロの技術が、今後どのように発展し、私たちの社会に貢献していくのか、注目が集まります。
AI活用

画像認識:可能性と未来

「画像認識」とは、機械に人の目と同じように画像を見分けさせ、何が写っているかを理解させる技術のことです。まるで私たちが目で見てリンゴや猫を認識するように、機械も画像の中から様々な特徴を読み取り、それが何であるかを判断します。この技術は、近年の人工知能技術の進歩、特に「深層学習」と呼ばれる技術のおかげで、大きく精度が上がりました。深層学習は、人間の脳の仕組みを真似た仕組みで、大量のデータから複雑なパターンを自ら学ぶことができます。このおかげで、以前は人間にしかできなかった複雑な画像認識作業も、今では機械が速く正確にこなせるようになりました。画像認識は、すでに様々な場所で役立っています。例えば、工場では製品の不良品を見つけるのに使われています。人の目で確認していた作業を機械が代わりに行うことで、見落としを減らし、作業効率を上げることができます。また、病院では、レントゲン写真やCT画像から病気を診断するのを助けるために使われています。医師の診断をサポートすることで、より正確な診断が可能になります。さらに、自動運転技術にも画像認識は欠かせません。周りの車や歩行者、信号などを認識することで、安全な運転を支援します。私たちの生活の中でも、スマートフォンで写真を撮るときに顔を認識してピントを合わせたり、インターネットで画像検索をしたりする際に、この技術が使われています。このように画像認識は、私たちの生活をより便利で安全なものにするための重要な技術となっています。今後ますます発展していくことで、さらに多くの分野で活躍していくことが期待されます。