音の判定デモ

聞いたことのない音を、鳥・笑い声・エンジンなど10種類のどれかに振り分けます

デモ一覧へ
DEMO

学習に使っていない音を選ぶと、その場で判定します

公開音源 件で学習しました。下に並んでいるのは 学習にも調整にも一度も使っていない音です。 再生して、モデルの答えと実際の正解を見比べてください。 解析も判定もこのブラウザの中で動いています。

準備しています…

音を選ぶクリックで再生して判定します

自分の音で試す

音声ファイルを放り込むか、マイクで4秒録音してください。

ファイルも録音もサーバーに送りません。すべてこのブラウザの中だけで処理します。

左から音を選んでください

モデルが見ている図

音を周波数ごとの強さに直したもの(メルスペクトログラム)。横が時間、縦が高さ。

どのくらい当たるか

件(学習にも調整にも使っていない音)で測りました。 10種類なので、でたらめに答えても は当たります。 いちばん多い「」と答え続けると です。

指標読み方

種類ごとの当たり方

音の種類件数当てられた割合F1

この構成について

音のデータ
前処理16kHz・4秒に揃え、メルスペクトログラム(64帯域 × 247フレーム)にします。ブラウザでも同じ計算をしています。
モデル小さな畳み込みニューラルネット( パラメータ、ONNX で )。ONNX Runtime Web で動かします。
サーバー静的ファイルのみ。API もデータベースもありません。