Oossa

Perplexity AI、エッジ端末向けを含む埋め込みモデル2種を追加

同社は、端末上での利用を想定した6億パラメーターの「pplx-embed-v2-late」と、MADQAベンチマークで92.4%を記録した90億パラメーター版を公開した。

著者: Oossa公開日: 1 分で読める

Pankaj Patel · Unsplash

Perplexity AIは、「pplx-embed-v2-late」の新バージョンを2種類発表した。小型版はパラメーター数が6億で、スマートフォンやIoT機器などのエッジ端末で動作するよう設計されている。大型版は90億パラメーターで、検索やレコメンドシステム向けの高品質なベクトルインデックスの構築を想定している。どちらもMITライセンスで公開されており、誰でもダウンロードして自前のサーバーで運用できる。

モデルの性能

Perplexityの社内テストでは、90億パラメーター版は、質問応答の精度を測る標準的なテストであるMADQAベンチマークで92.4%を記録した。同モデルは、Markdown形式のテキスト処理能力を測るViDoRe v3 Markdownベンチマークでは61.2%だった。同社によると、6億パラメーター版は速度と省メモリー性能を重視して最適化され、90億パラメーター版は精度を重視している。

なぜ重要か

開発者は、クラウドサービスを使わずに、軽量な埋め込みモデルをスマートフォンや小型端末上で直接動かせるようになった。精度の高い検索やレコメンド機能を必要とする大規模チームは、より高性能なモデルを使いながら、データを完全に自社で管理できる。どちらのモデルもオープンソースで公開されているためだ。

この記事は役に立ちましたか?
共有

次に読む

Oossa · ニュースレター

今週のAIを、わかりやすく

毎週月曜日、知っておきたいニュースをやさしい言葉で。無料・スパムなし。