This is a Japanese sentence BERT model. 日本語用Sentence BERTモデル(バージョン2)です。 バージョン1よりも良いロス関数であるMultipleNegativesRankingLossを用いて学習した改良版です。 手元の非公開データセットでは、バージョン1よりも1.5〜2ポイントほど精度が高い結果が得られました。 事前学習済みモデルとしてcl tohoku/bert base japanese whole word maskingを利用しました。 従って、推論の実行にはfugashiとipadicが必要です(pip install fugashi ipadic)。 旧バージョンの解説 https://qiita.com/sonoisa/items/1df94d0a98cd4f209051 モデル名を"sonoisa/sentence bert base ja mean tokens v2"に書き換えれば、本モデルを利用した挙動になります。 使い方
We use cookies for essential functionality and analytics. You can accept or reject analytics cookies.Cookie policy