聞いたことのない音を、鳥・笑い声・エンジンなど10種類のどれかに振り分けます
公開音源 – 件で学習しました。下に並んでいるのは 学習にも調整にも一度も使っていない音です。 再生して、モデルの答えと実際の正解を見比べてください。 解析も判定もこのブラウザの中で動いています。
音声ファイルを放り込むか、マイクで4秒録音してください。
ファイルも録音もサーバーに送りません。すべてこのブラウザの中だけで処理します。
– 件(学習にも調整にも使っていない音)で測りました。 10種類なので、でたらめに答えても – は当たります。 いちばん多い「–」と答え続けると – です。
| 指標 | 値 | 読み方 |
|---|
| 音の種類 | 件数 | 当てられた割合 | F1 |
|---|
| 音のデータ | – |
| 前処理 | 16kHz・4秒に揃え、メルスペクトログラム(64帯域 × 247フレーム)にします。ブラウザでも同じ計算をしています。 |
| モデル | 小さな畳み込みニューラルネット(– パラメータ、ONNX で –)。ONNX Runtime Web で動かします。 |
| サーバー | 静的ファイルのみ。API もデータベースもありません。 |