NEWS

Jev型の音声判断AI「AudioDecisionModel」を公開

mocomoco株式会社は、Jev型の音声判断AI「AudioDecisionModel」を、オープンウェイトで公開しました。

短い音声への質問に、Yes/No、選択、数値で答えます。話し言葉だけでなく、音楽や動物の鳴き声、周囲の音についても尋ねられます。入出力の例は次のとおりです。

音声への質問と回答

入力

音声
犬の鳴き声が入った短い音声 サンプル音声です。Amada44 / CC BY-SA 3.0
文脈
短い音声に、犬の声が入っているかを確認する
質問 JSON
{
  "犬の声は入っていますか": {
    "type": "noul",
    "instructions": "音声に犬の鳴き声が含まれているか確認してください。"
  }
}

出力

回答 JSON
{
  "犬の声は入っていますか": "Yes"
}

mocomoco inc.のミッションとして「人の声を集め、価値としてめぐらせる。」を掲げています。集めた声を必要な人の判断や行動まで届けるには、現場や手元でも動かせる必要があるという考えのもと、ブラウザ上で動くエッジ実行と、より普及しやすいオープンウェイトモデルへの貢献として、本モデルを公開しました。

モデルとデモは Hugging Face で公開しています。

本モデルは、TypeSafe AI が提供する Jev を参考にしています。利用している基盤モデルは次のとおりです。

本件に関するお問い合わせはお問い合わせフォームよりお願いします。

お問い合わせ