マルチモーダル情報による音源位置推定
画像から計算できるLine Of Sight(LOS)情報とマイクロホンアレイにより取得できる音響情報から計算される音源方向情報をグリッドベースのベイズ推論で統合することで、位置情報を計算する手法。 画像からLOSの計算は、SSD + KCF + ラベルクラスタリングを行い、音源方向推定はMUSIC法を用いた。
450万人が利用するビジネスSNS
株式会社Fusic / 先進技術部門 機械学習チーム
現職の株式会社Fusic (2020年4月~)では、画像処理、自然言語処理、音声処理を中心に信号処理・機械学習モデルの開発を行い、それらの推論環境をAWSで構築しています。
機械学習エンジニアとして、面白い開発であれば、特に分野は関係なく、挑戦していきたいです。 ですが、最近は、音声合成など音声情報の活用に関する研究開発が好きです。
鷲崎 海さん
のプロフィールをすべて閲覧
Wantedlyユーザー もしくは つながりユーザーのみ閲覧できる項目があります
過去の投稿を確認する
共通の知り合いを確認する
鷲崎 海さんのプロフィールをすべて見る
画像から計算できるLine Of Sight(LOS)情報とマイクロホンアレイにより取得できる音響情報から計算される音源方向情報をグリッドベースのベイズ推論で統合することで、位置情報を計算する手法。 画像からLOSの計算は、SSD + KCF + ラベルクラスタリングを行い、音源方向推定はMUSIC法を用いた。